arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-11-26 至 2025-11-26 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 2 篇

2510.20820 2025-11-26 cs.CV 83%

LayerComposer: Multi-Human Personalized Generation via Layered Canvas

LayerComposer: 通过分层画布实现多人类个性化生成

Guocheng Gordon Qian, Ruihang Zhang, Tsai-Shien Chen, Yusuf Dalva, Anujraaj Argo Goyal, Willi Menapace, Ivan Skorokhodov, Meng Dong, Arpit Sahni, Daniil Ostashev, Ju Hu, Sergey Tulyakov, Kuan-Chieh Jackson Wang

机构 * Snap Inc. University of Toronto(多伦多大学) UC Merced(加州大学默塞德分校) Virginia Tech(弗吉尼亚理工大学)

专题命中 个性化与一致性 :personalized generation(title,abstract);image generation(abstract);分类 cs.CV

AI总结 LayerComposer通过分层画布实现多人类个性化生成,提供直观的人类注入和高效 scalable 的生成框架。

Comments 17 pages including appendix, preprint. Project page: https://snap-research.github.io/layercomposer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16655 2025-11-26 cs.CV 57%

MovieDreamer: Hierarchical Generation for Coherent Long Visual Sequence

MovieDreamer:用于生成连贯长视觉序列的分层生成

Canyu Zhao, Mingyu Liu, Wen Wang, Weihua Chen, Fan Wang, Hao Chen, Bo Zhang, Chunhua Shen

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 MovieDreamer通过结合自回归模型与扩散渲染,实现长时长视频生成,提升叙事连贯性和视觉质量。

Comments 30 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏