arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-02-23 至 2026-02-23 共收录 5 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 5 篇

2602.18309 2026-02-23 cs.CV 83%

Multi-Level Conditioning by Pairing Localized Text and Sketch for Fashion Image Generation

通过局部文本和草图配对实现多级条件生成时尚图像

Ziyue Liu, Davide Talon, Federico Girella, Zanxi Ruan, Mattia Mondo, Loris Bazzani, Yiming Wang, Marco Cristani

机构 * University of Verona(博洛尼亚大学) Polytechnic Institute of Turin(都灵理工大学) Fondazione Bruno Kessler(布鲁诺·凯斯勒基金会) Reykjavik University(雷克雅未克大学)

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 LOTS通过结合全局草图指导与多级局部草图-文本对,提升时尚图像生成的结构准确性和局部语义指导能力。

Comments Project page: https://intelligolabs.github.io/lots/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18612 2026-02-23 cs.CV 77%

Mod-Adapter: Tuning-Free and Versatile Multi-concept Personalization via Modulation Adapter

Mod-Adapter:通过调制适配器实现无需微调的多概念个性化

Weizhi Zhong, Huan Yang, Zheng Liu, Huiguo He, Zijian He, Xuesong Niu, Di Zhang, Guanbin Li

机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) Kolors Team, Kuaishou Technology(快手科技Kolors团队) Shenzhen Loop Area Institute, Shenzhen, China(深圳循环区研究所) Guangdong Key Laboratory of Big Data Analysis and Processing, Guangzhou, China(广东大数据分析与处理重点实验室) South China University of Technology, Guangzhou, China(华南理工大学)

专题命中 可控生成 :image generation(abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出Mod-Adapter方法,通过调制适配器实现无需微调的多概念个性化,有效定制物体和抽象概念,提升生成质量。

Comments Accepted by ICLR 2026, project page: https://weizhi-zhong.github.io/Mod-Adapter

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18422 2026-02-23 cs.CV 57%

Generated Reality: Human-centric World Simulation using Interactive Video Generation with Hand and Camera Control

生成现实:基于交互式视频生成的人本世界模拟

Linxi Xie, Lisong C. Sun, Ashley Neall, Tong Wu, Shengqu Cai, Gordon Wetzstein

机构 * Stanford University(斯坦福大学) NYU Shanghai(纽约大学上海分校) UNC Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 本文提出了一种基于交互式视频生成的人本世界模拟系统,通过结合头部和手部姿态控制,提升虚拟环境的交互性和用户控制感。

Comments Project page here: https://codeysun.github.io/generated-reality

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18282 2026-02-23 cs.CV 57%

DEIG: Detail-Enhanced Instance Generation with Fine-Grained Semantic Control

DEIG:细节增强的实例生成与细粒度语义控制

Shiyan Du, Conghan Yue, Xinyu Cheng, Dongyu Zhang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 DEIG通过细粒度语义控制生成多实例场景,提升空间一致性与语义准确性。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17823 2026-02-23 math.OC math.PR 50%

Duality methods in stochastic optimal control

随机最优控制中的对偶方法

Peter Bank, Filippo de Feo

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出两种对偶方法,用于解决随机最优控制问题中的价值函数描述,扩展了受控扩散情况下的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏