arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-11-21 至 2025-11-21 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 2 篇

2511.16666 2025-11-21 cs.CV 79%

SceneDesigner: Controllable Multi-Object Image Generation with 9-DoF Pose Manipulation

SceneDesigner: 9自由度姿态操控的可控多物体图像生成

Zhenyuan Qin, Xincheng Shuai, Henghui Ding

机构 * Fudan University(复旦大学)

专题命中 可控生成 :image generation(title,abstract);分类 cs.CV

AI总结 SceneDesigner通过9自由度姿态操控实现多物体图像生成,采用CNOCS图和两阶段训练策略提升可控性与质量。

Comments NeurIPS 2025 (Spotlight), Project Page: https://henghuiding.com/SceneDesigner/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02260 2025-11-21 cs.CV 57%

MagicFace: High-Fidelity Facial Expression Editing with Action-Unit Control

MagicFace: 通过动作单元控制实现高保真的面部表情编辑

Mengting Wei, Tuomas Varanka, Xingxun Jiang, Huai-Qian Khor, Guoying Zhao

机构 * Center for Machine Vision and Signal Analysis, Faculty of Information Technology and Electrical Engineering, University of Oulu(机器视觉与信号分析中心,信息科技与电气工程学院,奥卢大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 MagicFace通过动作单元控制实现高保真的面部表情编辑,结合扩散模型和ID编码器,能够精细调整表情并保持身份和背景一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏