arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70159 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70159 篇

2504.05815 2025-09-12 cs.CV cs.AI 85%

Parasite: A Steganography-based Backdoor Attack Framework for Diffusion Models

Jiahao Chen, Yu Pan, Yi Du, Chunkai Wu, Lin Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06068 2025-09-09 cs.CV 85%

Home-made Diffusion Model from Scratch to Hatch

Shih-Ying Yeh

机构 * National Tsing Hua University(国立清华大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02000 2025-09-03 cs.CV 85%

Palette Aligned Image Diffusion

Elad Aharoni, Noy Porat, Dani Lischinski, Ariel Shamir

机构 * Hebrew University(希伯来大学) Reichman University(雷赫曼大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 14 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15093 2025-08-26 cs.CV 85%

CurveFlow: Curvature-Guided Flow Matching for Image Generation

Yan Luo, Drake Du, Hao Huang, Yi Fang, Mengyu Wang

专题命中 扩散模型 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14933 2025-08-22 cs.GR cs.AI cs.LG 85%

Inference Time Debiasing Concepts in Diffusion Models

Lucas S. Kupssinskü, Marco N. Bochernitsan, Jordan Kopper, Otávio Parraga, Rodrigo C. Barros

机构 * MALTA - Machine Learning Theory and Applications Lab(机器学习理论与应用实验室) School of Technology, Pontifícia Universidade Católica do Rio Grande do Sul(技术学院,里约格朗德杜斯尔格斯天主教大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13628 2025-08-21 cs.CV 85%

DiffIER: Optimizing Diffusion Models with Iterative Error Reduction

Ao Chen, Lihe Ding, Tianfan Xue

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14276 2025-08-21 cs.CV cs.AI 85%

Tooth-Diffusion: Guided 3D CBCT Synthesis with Fine-Grained Tooth Conditioning

Said Djafar Said, Torkan Gholamalizadeh, Mostafa Mehdipour Ghazi

机构 * Pioneer Centre for AI, Department of Computer Science, University of Copenhagen Research(先锋人工智能中心、计算机科学系、哥本哈根大学研究)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);image synthesis(abstract);分类 cs.CV

Comments MICCAI 2025 Workshop on Oral and Dental Image Analysis (ODIN)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12718 2025-08-19 cs.CV 85%

Single-Reference Text-to-Image Manipulation with Dual Contrastive Denoising Score

Syed Muhmmad Israr, Feng Zhao

机构 * Department of Automation, School of Information Science and Technology, University of Science and Technology of China(自动化系、信息科学与技术学院、中国科学技术大学)

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20094 2025-08-19 cs.CV cs.AI cs.MA 85%

Local Prompt Adaptation for Style-Consistent Multi-Object Generation in Diffusion Models

Ankit Sanjyal

机构 * Fordham University(福特汉姆大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 10 Pages,10 figures, pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13307 2025-08-15 cs.CV cs.AI 85%

Quantitative Comparison of Fine-Tuning Techniques for Pretrained Latent Diffusion Models in the Generation of Unseen SAR Images

Solène Debuysère, Nicolas Trouvé, Nathan Letheule, Olivier Lévêque, Elise Colin

机构 * Paris-Saclay University(巴黎-萨克雷大学) ONERA - The French Aerospace Lab(法国航空航天实验室)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10340 2025-08-05 cs.CV 85%

Text Embedding Knows How to Quantize Text-Guided Diffusion Models

Hongjae Lee, Myungjun Son, Dongjea Kang, Seung-Won Jung

机构 * Korea University(韩国大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08255 2025-07-23 cs.CV 85%

Make Me Happier: Evoking Emotions Through Image Diffusion Models

Qing Lin, Jingfeng Zhang, Yew-Soon Ong, Mengmi Zhang

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) The University of Auckland, New Zealand(奥克兰大学,新西兰) RIKEN AIP, Tokyo, Japan(日本东京理化学研究所AIP)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15249 2025-07-22 cs.CV 85%

FreeCus: Free Lunch Subject-driven Customization in Diffusion Transformers

Yanbing Zhang, Zhe Wang, Qin Zhou, Mengping Yang

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);inpainting(abstract);分类 cs.CV

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13401 2025-07-21 cs.CV cs.LG 85%

MADI: Masking-Augmented Diffusion with Inference-Time Scaling for Visual Editing

Shreya Kadambi, Risheek Garrepalli, Shubhankar Borse, Munawar Hyatt, Fatih Porikli

机构 * Qualcomm AI Research(高通人工智能研究)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09626 2025-07-14 cs.CV 85%

FreeScale: Unleashing the Resolution of Diffusion Models via Tuning-Free Scale Fusion

Haonan Qiu, Shiwei Zhang, Yujie Wei, Ruihang Chu, Hangjie Yuan, Xiang Wang, Yingya Zhang, Ziwei Liu

机构 * Nanyang Technological University(南洋理工大学) Alibaba Group(阿里巴巴集团) Fudan University(复旦大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments ICCV 2025, Project Page: http://haonanqiu.com/projects/FreeScale.html, Code Repo: https://github.com/ali-vilab/FreeScale

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06033 2025-07-09 cs.CV cs.AI cs.LG 85%

TextPixs: Glyph-Conditioned Diffusion with Character-Aware Attention and OCR-Guided Supervision

Syeda Anshrah Gillani, Mirza Samad Ahmed Baig, Osama Ahmed Khan, Shahid Munir Shah, Umema Mujeeb, Maheen Ali

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03846 2025-07-08 cs.CV cs.LG 85%

Interpretable Diffusion Models with B-cos Networks

Nicola Bernold, Moritz Vandenhirtz, Alice Bizeul, Julia E. Vogt

机构 * Department of Computer Science, ETH Zürich, Switzerland(苏黎世联邦理工学院计算机科学系)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00992 2025-07-03 cs.CV 85%

UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis

Yuanrui Wang, Cong Han, Yafei Li, Zhipeng Jin, Xiawei Li, SiNan Du, Wen Tao, Yi Yang, Shuanglong Li, Chun Yuan, Liu Lin

机构 * Tsinghua University(清华大学) Baidu Inc.(百度公司)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10105 2025-07-01 cs.CV 85%

High-Precision Dichotomous Image Segmentation via Probing Diffusion Capacity

Qian Yu, Peng-Tao Jiang, Hao Zhang, Jinwei Chen, Bo Li, Lihe Zhang, Huchuan Lu

机构 * Dalian University of Technology(大连理工大学) vivo Mobile Communication Co., Ltd(vivo移动通信有限公司)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Published as a conference paper at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10633 2025-06-13 cs.CV 85%

Anatomy-Grounded Weakly Supervised Prompt Tuning for Chest X-ray Latent Diffusion Models

Konstantinos Vilouras, Ilias Stogiannidis, Junyu Yan, Alison Q. O'Neil, Sotirios A. Tsaftaris

机构 * University of Edinburgh(爱丁堡大学) Canon Medical Research Europe Ltd.(佳能医疗欧洲有限公司)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17493 2025-06-10 cs.CV cs.AI 85%

Model Collapse in the Self-Consuming Chain of Diffusion Finetuning: A Novel Perspective from Quantitative Trait Modeling

Youngseok Yoon, Dainong Hu, Iain Weissburg, Yao Qin, Haewon Jeong

机构 * UCSB California, USA(加州大学圣芭芭拉分校)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments version 3, additional 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23283 2025-05-30 cs.CV 85%

RSFAKE-1M: A Large-Scale Dataset for Detecting Diffusion-Generated Remote Sensing Forgeries

Zhihong Tan, Jiayi Wang, Huiying Shi, Binyuan Huang, Hongchen Wei, Zhenzhong Chen

机构 * Zhihong Tan(谭志宏) Jiayi Wang(王佳毅) Huiying Shi(Shi 希慧) Binyuan Huang(黄彬远) Hongchen Wei(韦宏晨) Zhenzhong Chen(陈振中)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13740 2025-05-27 cs.LG cs.AI cs.CV 85%

Improving Compositional Generation with Diffusion Models Using Lift Scores

Chenning Yu, Sicun Gao

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Journal ref ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18865 2025-05-26 cs.CV cs.AI cs.LG 85%

REG: Rectified Gradient Guidance for Conditional Diffusion Models

Zhengqi Gao, Kaiwen Zha, Tianyuan Zhang, Zihui Xue, Duane S. Boning

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 20 pages, 10 figures; accepted by ICML'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12486 2025-05-20 cs.CV 85%

Guiding Diffusion with Deep Geometric Moments: Balancing Fidelity and Variation

Sangmin Jung, Utkarsh Nath, Yezhou Yang, Giulia Pedrielli, Joydeep Biswas, Amy Zhang, Hassan Ghasemzadeh, Pavan Turaga

机构 * Arizona State University(亚利桑那州立大学) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted in CVPR Workshop GMCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01917 2025-05-20 cs.GR cond-mat.mtrl-sci cs.LG eess.IV 85%

Discrete Spatial Diffusion: Intensity-Preserving Diffusion Modeling

Javier E. Santos, Agnese Marcato, Roman Colman, Nicholas Lubbers, Yen Ting Lin

机构 * Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);image synthesis(abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08817 2025-05-15 cs.CV cs.LG 85%

Towards SFW sampling for diffusion models via external conditioning

Camilo Carvajal Reyes, Joaquín Fontbona, Felipe Tobar

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepcted at IJCNN 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13637 2025-05-12 cs.CV cs.AI cs.LG 85%

Curriculum Direct Preference Optimization for Diffusion and Consistency Models

Florinel-Alin Croitoru, Vlad Hondru, Radu Tudor Ionescu, Nicu Sebe, Mubarak Shah

机构 * University of Bucharest(布加勒斯特大学) University of Trento(特伦托大学) University of Central Florida(中央佛罗里达大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10232 2025-05-01 cs.CV cs.AI 85%

ColorEdit: Training-free Image-Guided Color editing with diffusion model

Xingxi Yin, Zhi Li, Jingfeng Zhang, Chenglin Li, Yin Zhang

机构 * Zhejiang University(浙江大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15397 2025-04-23 cs.CV 85%

MirrorVerse: Pushing Diffusion Models to Realistically Reflect the World

Ankit Dhiman, Manan Shah, R Venkatesh Babu

机构 * Vision and AI Lab, IISc Bangalore(视觉与人工智能实验室,班加罗尔IISc) Samsung R & D Institute India - Bangalore(三星研发研究所-印度班加罗尔)

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);inpainting(abstract);分类 cs.CV

Comments Accepted to CVPR 2025. Project Page: https://mirror-verse.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏