arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-12-01 至 2025-12-01 共收录 5 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 5 篇

2511.10555 2025-12-01 cs.CV cs.AI 85%

A Style is Worth One Code: Unlocking Code-to-Style Image Generation with Discrete Style Space

一种风格等同于一个代码:通过离散风格空间解锁代码到风格图像生成

Huijie Liu, Shuhao Cui, Haoxiang Cao, Shuai Ma, Kai Wu, Guoliang Kang

机构 * Beihang University(北航大学) Kolors Team, Kuaishou Technology(快手科技色彩团队) South China Normal University(华南师范大学)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出CoTyle,通过离散风格空间实现代码到风格图像生成,以数值代码控制图像风格,提升生成效率与多样性。

Comments Code: https://github.com/Kwai-Kolors/CoTyle Demo: https://huggingface.co/spaces/Kwai-Kolors/CoTyle Homepage: https://kwai-kolors.github.io/CoTyle/

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05538 2025-12-01 cs.CV 85%

A Survey on Personalized Content Synthesis with Diffusion Models

扩散模型在个性化内容合成中的综述

Xulu Zhang, Xiaoyong Wei, Wentao Hu, Jinlin Wu, Jiaxin Wu, Wengyu Zhang, Zhaoxiang Zhang, Zhen Lei, Qing Li

机构 * Department of Computing(计算系) The Hong Kong Polytechnic University(香港理工大学) Center for Artificial Intelligence and Robotics(人工智能与机器人中心) Hong Kong Institute of Science & Innovation(香港科学创新研究院) Chinese Academy of Sciences(中国科学院) State Key Laboratory of Multimodal Artificial Intelligence Systems(多模态人工智能系统国家重点实验室) Chinese Academy of Sciences Institute of Automation(中国科学院自动化研究所) School of Artificial Intelligence(人工智能学院) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 个性化与一致性 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文综述了扩散模型在个性化内容合成中的应用,分析了测试时微调和预训练适应方法,探讨了个性化任务的挑战与创新,并提出了未来发展方向。

Journal ref Machine intelligence research, Oct. 2025, v. 22, no. 5, p. 817-848

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17344 2025-12-01 cs.CV 70%

Loomis Painter: Reconstructing the Painting Process

Loomis Painter: 复原绘画过程

Markus Pobitzer, Chang Liu, Chenyi Zhuang, Teng Long, Bin Ren, Nicu Sebe

机构 * University of Trento(特伦托大学) University of Pisa(比萨大学)

专题命中 个性化与一致性 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 Loomis Painter通过统一框架和语义驱动的风格控制机制,实现多媒体绘画过程的复原,提升跨媒体一致性与生成流畅性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15258 2025-12-01 cs.CV 57%

SplitFlux: Learning to Decouple Content and Style from a Single Image

SplitFlux: 从单张图像中学习解耦内容与风格

Yitong Yang, Yinglin Wang, Changshuo Wang, Yongjun Zhang, Ziyang Chen, Shuting He

机构 * School of Computing and Artificial Intelligence(计算与人工智能学院) University College London, University of London(伦敦大学大学学院) College of Computer Science and Technology(计算机科学与技术学院)

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

AI总结 SplitFlux通过LoRA微调单流块,实现内容与风格的解耦,提升图像生成的质量和多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16915 2025-12-01 cs.CV 57%

DreamO: A Unified Framework for Image Customization

DreamO:图像定制的统一框架

Chong Mou, Yanze Wu, Wenxu Wu, Zinan Guo, Pengze Zhang, Yufeng Cheng, Yiming Luo, Fei Ding, Shiwen Zhang, Xinghui Li, Mengtian Li, Mingcong Liu, Yi Zhang, Shaojin Wu, Songtao Zhao, Jian Zhang, Qian He, Xinglong Wu

机构 * Peking University(北京大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 DreamO提出了一种统一的图像定制框架,通过扩散变压器和渐进式训练策略,实现多种条件的无缝集成与高质量定制。

详情

展开后加载摘要…

URL PDF HTML 收藏