arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-12-10 至 2025-12-10 共收录 4 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4 篇

2512.08645 2025-12-10 cs.CV 83%

Chain-of-Image Generation: Toward Monitorable and Controllable Image Generation

图像生成链:迈向可监控和可控的图像生成

Young Kyung Kim, Oded Schlesinger, Yuzhou Zhao, J. Matias Di Martino, Guillermo Sapiro

机构 * Duke University(杜克大学) Princeton University(普林斯顿大学) Universidad Católica del Uruguay(乌拉圭天主教大学) Apple(苹果公司)

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 CoIG框架通过将图像生成过程分解为可监控的步骤,提升图像生成的可控性和可解释性。

Comments 19 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08534 2025-12-10 cs.CV 57%

PaintFlow: A Unified Framework for Interactive Oil Paintings Editing and Generation

PaintFlow:一种用于交互式油画创作与生成的统一框架

Zhangli Hu, Ye Chen, Jiajun Yao, Bingbing Ni

机构 * Zhangli Hu, Ye Chen, Jiajun Yao, Bingbing Ni(张立虎、陈叶、姚佳君、倪炳炳)

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

AI总结 PaintFlow提出了一种统一框架,通过多模态输入实现交互式油画创作与编辑,利用空间对齐、语义增强和自监督风格迁移技术,提升油画生成与编辑的风格一致性与艺术表现力。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08229 2025-12-10 cs.CV cs.RO 57%

Geometry-Aware Sparse Depth Sampling for High-Fidelity RGB-D Depth Completion in Robotic Systems

基于几何的稀疏深度采样用于机器人系统中高保真的RGB-D深度补全

Tony Salloom, Dandi Zhou, Xinhai Sun

机构 * Saisuode (Shanghai) Intelligent Technology Co., Ltd. (Synthoid.ai)(上海思度智能科技有限公司(Synthoid.ai))

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 本文提出基于几何的稀疏深度采样方法,利用表面法线估计提升RGB-D深度补全的准确性和现实感。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08215 2025-12-10 cs.CV 57%

Blur2Sharp: Human Novel Pose and View Synthesis with Generative Prior Refinement

Blur2Sharp: 基于生成先验细化的人体新颖姿态与视角合成

Chia-Hern Lai, I-Hsuan Lo, Yen-Ku Yeh, Thanh-Nguyen Truong, Ching-Chun Huang

机构 * National Yang Ming Chiao Tung University

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 Blur2Sharp通过整合3D感知神经渲染和扩散模型,实现从单一视角生成清晰且几何一致的新视角图像,提升复杂场景下的姿态与视角合成效果。

详情

展开后加载摘要…

URL PDF HTML 收藏