arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-11-10 至 2025-11-10 共收录 39 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 29 篇

2409.01083 2025-11-10 cs.RO cs.AI 50%

Affordance-based Robot Manipulation with Flow Matching

Fan Zhang, Michael Gienger

机构 * Honda Research Institute EU(本田欧洲研究院)

专题命中 扩散模型 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 4 篇

2511.04753 2025-11-10 cs.CV cs.AI cs.LG 83%

CPO: Condition Preference Optimization for Controllable Image Generation

Zonglin Lyu, Ming Li, Xinxin Liu, Chen Chen

机构 * Institute of Artificial Intelligence(人工智能研究院) University of Central Florida(中央佛罗里达大学)

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05219 2025-11-10 cs.CV 57%

FreeControl: Efficient, Training-Free Structural Control via One-Step Attention Extraction

Jiang Lin, Xinyu Chen, Song Wu, Zhiqiu Zhang, Jizhi Zhang, Ye Wang, Qiang Tang, Qian Wang, Jian Yang, Zili Yi

机构 * Nanjing University(南京大学) JIUTIAN Research(JIUTIAN研究) University of British Columbia(不列颠哥伦比亚大学) Jilin University(吉林大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by NIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13816 2025-11-10 cs.CV 57%

MOSAIC: Generating Consistent, Privacy-Preserving Scenes from Multiple Depth Views in Multi-Room Environments

Zhixuan Liu, Haokun Zhu, Rui Chen, Jonathan Francis, Soonmin Hwang, Ji Zhang, Jean Oh

机构 * Carnegie Mellon University(卡内基梅隆大学) Bosch Center for AI(博世人工智能中心) Hanyang University(翰阳大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.08186 2025-11-10 cs.GR 57%

City Street Layout Generation via Conditional Adversarial Learning

Lehao Yang, Cui Zhu, Tian Feng

专题命中 可控生成 :image synthesis(abstract);分类 cs.GR

Comments in Chinese language

Journal ref Bulletin of Science and Technology, 2025, 41(10):83-90+115

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 个性化与一致性 1 篇

2511.04973 2025-11-10 cs.LG 50%

Less Is More: Generating Time Series with LLaMA-Style Autoregression in Simple Factorized Latent Spaces

Siyuan Li, Yifan Sun, Lei Cheng, Lewen Wang, Yang Liu, Weiqing Liu, Jianlong Li, Jiang Bian, Shikai Fang

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) Microsoft Research Asia(微软亚洲研究院)

专题命中 个性化与一致性 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 效率与蒸馏 2 篇

2505.21005 2025-11-10 cs.LG stat.ML 78%

Efficient and Unbiased Sampling from Boltzmann Distributions via Variance-Tuned Diffusion Models

Fengzhe Zhang, Laurence I. Midgley, José Miguel Hernández-Lobato

机构 * University of Cambridge(剑桥大学) Ångström AI(安格斯特罗姆人工智能)

专题命中 效率与蒸馏 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20349 2025-11-10 cs.CV 57%

Consistency Trajectory Matching for One-Step Generative Super-Resolution

Weiyi You, Mingyang Zhang, Leheng Zhang, Xingyu Zhou, Kexuan Shi, Shuhang Gu

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 其他图像生成 1 篇

2504.14245 2025-11-10 cs.CV cs.CL 57%

Towards Explainable Fake Image Detection with Multi-Modal Large Language Models

Yikun Ji, Yan Hong, Jiahui Zhan, Haoxing Chen, jun lan, Huijia Zhu, Weiqiang Wang, Liqing Zhang, Jianfu Zhang

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

Comments Accepted to ACM MM 2025; 14 pages including Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏