arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-09 至 2026-01-09 共收录 5 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 5 篇

2403.04279 2026-01-09 cs.CV 89%

Controllable Generation with Text-to-Image Diffusion Models: A Survey

基于文本到图像扩散模型的可控生成:综述

Pu Cao, Feng Zhou, Qing Song, Lu Yang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 可控生成 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 本文综述了基于文本到图像扩散模型的可控生成方法,分析了不同条件下的生成机制及分类。

Comments TPAMI 2025; A collection of resources on controllable generation with text-to-image diffusion models: https://github.com/PRIV-Creation/Awesome-Controllable-T2I-Diffusion-Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05124 2026-01-09 cs.CV 79%

Re-Align: Structured Reasoning-guided Alignment for In-Context Image Generation and Editing

Re-Align:基于结构化推理的对齐方法用于上下文图像生成与编辑

Runze He, Yiji Cheng, Tiankai Hang, Zhimin Li, Yu Xu, Zijin Yin, Shiyi Zhang, Wenxun Dai, Penghui Du, Ao Ma, Chunyu Wang, Qinglin Lu, Jizhong Han, Jiao Dai

机构 * Hunyuan, Tencent(腾讯文库) IIE, CAS(中国科学院信息工程研究所) UCAS Project Page(中国科学技术大学)

专题命中 可控生成 :image generation(title,abstract);分类 cs.CV

AI总结 Re-Align通过结构化推理引导的对齐方法,提升上下文图像生成与编辑任务的性能。

Comments 13 pages, 9 figures, project page: https://github.com/hrz2000/realign

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05246 2026-01-09 cs.CV 57%

Pixel-Perfect Visual Geometry Estimation

像素级视觉几何估计

Gangwei Xu, Haotong Lin, Hongcheng Luo, Haiyang Sun, Bing Wang, Guang Chen, Sida Peng, Hangjun Ye, Xin Yang

机构 * School of Electronic Information and Communications, Huazhong University of Science and Technology(华中科技大学电子信息与通信学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Xiaomi EV(小米电动车)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 本文提出像素级视觉几何模型,通过生成建模技术实现高质量无飞像素点云,提升单目和视频深度估计的性能和准确性。

Comments Code: https://github.com/gangweix/pixel-perfect-depth

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10688 2026-01-09 cs.CV 57%

Novel View Synthesis using DDIM Inversion

基于DDIM反向的新型视图合成

Sehajdeep Singh, A V Subramanyam, Aditya Gupta, Sahil Gupta

机构 * Indraprastha Institute of Information Technology(印度普拉斯塔大学信息科技学院)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 本文提出基于DDIM反向的轻量级视图合成方法,利用预训练扩散模型生成高质量新视角重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15338 2026-01-09 econ.TH math.OC 50%

Network-Based Optimal Control of Pollution Growth

基于网络的污染增长最优控制

Fausto Gozzi, Marta Leocata, Giulia Pucci

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出了一种基于网络结构的污染扩散最优控制模型,通过分析绿色与非绿色技术的权衡,解决了线性污染成本下的最优控制问题。

详情

展开后加载摘要…

URL PDF HTML 收藏