arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-11-03 至 2025-11-03 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 2 篇

2510.27364 2025-11-03 cs.CV cs.AI 57%

Fine-Tuning Open Video Generators for Cinematic Scene Synthesis: A Small-Data Pipeline with LoRA and Wan2.1 I2V

Meftun Akarsu, Kerem Catay, Sedat Bin Vedat, Enes Kutay Yarkan, Ilke Senturk, Arda Sar, Dafne Eksioglu

机构 * AI Yapım Hagia Labs Singapore(AI Yapım 赫亚实验室新加坡) AI Engineer Hagia Labs İstanbul(AI工程师 赫亚实验室伊斯坦布尔) Full Stack Engineer Hagia Labs İstanbul(全栈工程师 赫亚实验室伊斯坦布尔) Chief Creator Hagia Labs İstanbul(首席创作者 赫亚实验室伊斯坦布尔)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments video generation, image-to-video, dif- fusion transformer, LoRA, fine-tuning, cinematic scene synthesis, multi-GPU inference, fully sharded data parallelism, computational efficiency

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15743 2025-11-03 cs.CV 57%

SRAGAN: Saliency Regularized and Attended Generative Adversarial Network for Chinese Ink-wash Painting Style Transfer

Xiang Gao, Yuqi Zhang

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王轩计算机技术研究所) School of Mathematical Sciences, University of Chinese Academy of Sciences(中国科学院大学数学科学学院)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments Pattern Recognition, Volume 162, June 2025, 111344

Journal ref Pattern Recognition, 2025, 162: 111344

详情

展开后加载摘要…

URL PDF HTML 收藏