arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86714 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70159 篇

2412.05827 2025-09-29 cs.CV 83%

Self-Guidance: Boosting Flow and Diffusion Generation on Their Own

Tiancheng Li, Weijian Luo, Zhiyang Chen, Liyuan Ma, Guo-Jun Qi

机构 * Zhejiang University(浙江大学) MAPLE Lab, Westlake University(西湖大学MAPLE实验室) Peking University(北京大学) Institute of Advanced Technology, Westlake Institute for Advanced Study(西湖研究院先进技术研究所)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 16 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13674 2025-09-29 cs.CV cs.AI 83%

Diffusion Curriculum: Synthetic-to-Real Data Curriculum via Image-Guided Diffusion

Yijun Liang, Shweta Bhardwaj, Tianyi Zhou

机构 * University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted in ICCV2025. 22 pages, including references and appendix. Code is available at http://github.com/tianyi-lab/DisCL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08074 2025-09-29 cs.LG cs.CR cs.CV 83%

Unstable Unlearning: The Hidden Risk of Concept Resurgence in Diffusion Models

Vinith M. Suriyakumar, Rohan Alur, Ayush Sekhari, Manish Raghavan, Ashia C. Wilson

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 30 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16968 2025-09-24 cs.CV 83%

Penalizing Boundary Activation for Object Completeness in Diffusion Models

Haoyang Xu, Tianhao Zhao, Sibei Yang, Yutian Lin

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03485 2025-09-24 cs.CV 83%

LRQ-DiT: Log-Rotation Post-Training Quantization of Diffusion Transformers for Image and Video Generation

Lianwei Yang, Haokun Lin, Tianchen Zhao, Yichen Wu, Hongyu Zhu, Ruiqi Xie, Zhenan Sun, Yu Wang, Qingyi Gu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) School of Engineering and Applied Sciences, Harvard University(哈佛大学工程与应用科学学院) Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16131 2025-09-23 cs.LG cs.CV 83%

Dynamic Classifier-Free Diffusion Guidance via Online Feedback

Pinelopi Papalampidi, Olivia Wiles, Ira Ktena, Aleksandar Shtedritski, Emanuele Bugliarello, Ivana Kajic, Isabela Albuquerque, Aida Nematzadeh

机构 * Google DeepMind(谷歌DeepMind) Ellison Institute of Technology(埃利森技术研究所) University of Oxford(牛津大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02363 2025-09-23 cs.CV 83%

Optimal Transport for Rectified Flow Image Editing: Unifying Inversion-Based and Direct Methods

Marian Lupascu, Mihai-Sorin Stupariu

机构 * Department of Computer Science, University of Bucharest(计算机科学系,布加勒斯特大学)

专题命中 扩散模型 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments 27 pages, 26 figures, WACV conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12974 2025-09-23 cs.CV 83%

Attentive Eraser: Unleashing Diffusion Model's Object Removal Potential via Self-Attention Redirection Guidance

Wenhao Sun, Benlei Cui, Xue-Mei Dong, Jingqun Tang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted by AAAI 2025(Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15678 2025-09-22 cs.CV 83%

Layout Stroke Imitation: A Layout Guided Handwriting Stroke Generation for Style Imitation with Diffusion Model

Sidra Hanif, Longin Jan Latecki

机构 * Temple University, Philadelphia PA, USA(特拉华大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14780 2025-09-19 cs.CV 83%

Radiology Report Conditional 3D CT Generation with Multi Encoder Latent diffusion Model

Sina Amirrajab, Zohaib Salahuddin, Sheng Kuang, Henry C. Woodruff, Philippe Lambin

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21448 2025-09-19 cs.CV 83%

OmniSync: Towards Universal Lip Synchronization via Diffusion Transformers

Ziqiao Peng, Jiwen Liu, Haoxian Zhang, Xiaoqiang Liu, Songlin Tang, Pengfei Wan, Di Zhang, Hongyan Liu, Jun He

机构 * Renmin University of China(中国人民大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments Accepted as NeurIPS 2025 spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13034 2025-09-18 q-bio.NC cs.CV 83%

Synthesis and Perceptual Scaling of High Resolution Naturalistic Images Using Stable Diffusion

Leonardo Pettini, Carsten Bogler, Christian Doeller, John-Dylan Haynes

机构 * Department of Psychology, Humboldt-Universität zu Berlin(柏林洪堡大学心理学系) Bernstein Center for Computational Neuroscience Berlin and Berlin Center for Advanced Neuroimaging, Charité Universitätsmedizin Berlin(柏林伯恩斯坦计算神经科学中心和柏林先进神经成像中心,查理医学院) Max Planck Institute for Human Cognitive and Brain Sciences, Leipzig, Germany(马克斯·普朗克人类认知与脑科学研究所,莱比锡,德国) Max Planck School of Cognition, Leipzig, Germany(马克斯·普朗克认知学校,莱比锡,德国) Kavli Institute for Systems Neuroscience, Centre for Neural Computation, The Egil and Pauline Braathen and Fred Kavli Centre for Cortical Microcircuits, Jebsen Centre for Alzheimer’s Disease, Norwegian University of Science and Technology, Trondheim, Norway(凯斯琳系统神经科学研究所,神经计算中心,埃吉和保罗·布雷athen及弗雷德·卡维利微电路中心,朱贝森阿尔茨海默病中心,挪威科学与技术大学,特罗姆瑟,挪威) Clinic of Neurology, Charité-Universitätsmedizin Berlin, Berlin, Germany(柏林查理医学院神经科诊所) Berlin Center for Advanced Neuroimaging, Charité-Universitätsmedizin Berlin, Berlin, Germany(柏林先进神经成像中心,查理医学院) Research Cluster of Excellence “Science of Intelligence”, Technische(卓越研究集群“智能科学”,技术)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 80 pages, 26 Figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13936 2025-09-18 cs.CV 83%

Noise-Level Diffusion Guidance: Well Begun is Half Done

Harvey Mannering, Zhiwu Huang, Adam Prugel-Bennett

机构 * Vision, Learning, and Control (VLC) Research Group(视觉、学习与控制研究组)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13336 2025-09-17 cs.CV eess.IV 83%

Gradient-Free Adversarial Purification with Diffusion Models

Xuelong Dai, Dong Wang, Xiuzhen Cheng, Bin Xiao

机构 * School of Artificial Intelligence, Shandong University(人工智能学院,山东大学) Department of Computing, The Hong Kong Polytechnic University(计算机学院,香港理工大学)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19808 2025-09-16 cs.CV 83%

SeeDiff: Off-the-Shelf Seeded Mask Generation from Diffusion Models

Joon Hyun Park, Kumju Jo, Sungyong Baik

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13389 2025-09-16 cs.CV cs.LG 83%

Marigold-DC: Zero-Shot Monocular Depth Completion with Guided Diffusion

Massimiliano Viola, Kevin Qu, Nando Metzger, Bingxin Ke, Alexander Becker, Konrad Schindler, Anton Obukhov

机构 * ETH Zürich(苏黎世联邦理工学院)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07890 2025-09-15 cs.CV 83%

Can Generative Geospatial Diffusion Models Excel as Discriminative Geospatial Foundation Models?

Yuru Jia, Valerio Marsocci, Ziyang Gong, Xue Yang, Maarten Vergauwen, Andrea Nascetti

机构 * KU Leuven(鲁汶大学) KTH(皇家理工学院) European Space Agency(欧洲航天局) Shanghai AI Lab(上海人工智能实验室) SJTU(上海交通大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments ICCV 2025, camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21471 2025-09-15 cs.CV cs.AI 83%

AdvI2I: Adversarial Image Attack on Image-to-Image Diffusion models

Yaopei Zeng, Yuanpu Cao, Bochuan Cao, Yurui Chang, Jinghui Chen, Lu Lin

机构 * College of Information Sciences and Technology, Pennsylvania State University, State College PA, USA(信息科学与技术学院,宾夕法尼亚州立大学,州立学院PA,美国)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09054 2025-09-12 cs.CV 83%

Integrating Anatomical Priors into a Causal Diffusion Model

Binxu Li, Wei Peng, Mingjie Li, Ehsan Adeli, Kilian M. Pohl

机构 * Department of Electrical Engineering, Stanford University, Stanford, CA, USA(电气工程系,斯坦福大学) Department of Psychiatry and Behavioral Sciences, Stanford University, Stanford, CA, USA(精神病学与行为科学系,斯坦福大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06573 2025-09-09 cs.GR 83%

From Rigging to Waving: 3D-Guided Diffusion for Natural Animation of Hand-Drawn Characters

Jie Zhou, Linzi Qu, Miu-Ling Lam, Hongbo Fu

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.03221 2025-09-09 cs.CV eess.IV 83%

ADIR: Adaptive Diffusion for Image Reconstruction

Shady Abu-Hussein, Tom Tirer, Raja Giryes

机构 * Tel Aviv University(特拉维夫大学) Bar Ilan University(巴伊兰大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Project page https://shadyabh.github.io/ADIR/

Journal ref BMVC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16507 2025-09-05 cs.CV cs.LG 83%

Straighter Flow Matching via a Diffusion-Based Coupling Prior

Siyu Xing, Jie Cao, Huaibo Huang, Haichao Shi, Xiao-Yu Zhang

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02161 2025-09-03 cs.CV 83%

Enhancing Zero-Shot Pedestrian Attribute Recognition with Synthetic Data Generation: A Comparative Study with Image-To-Image Diffusion Models

Pablo Ayuso-Albizu, Juan C. SanMiguel, Pablo Carballeira

机构 * Universidad Autónoma de Madrid(西班牙马德里自治大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Paper accepted at AVSS 2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00378 2025-09-03 cs.CV 83%

NoiseCutMix: A Novel Data Augmentation Approach by Mixing Estimated Noise in Diffusion Models

Shumpei Takezaki, Ryoma Bise, Shinnosuke Matsuo

机构 * Kyushu University(九州大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted at ICCV2025 Workshop LIMIT

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20182 2025-08-29 cs.CV 83%

SDiFL: Stable Diffusion-Driven Framework for Image Forgery Localization

Yang Su, Shunquan Tan, Jiwu Huang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14209 2025-08-29 cs.LG cs.CV 83%

Unlearning Concepts from Text-to-Video Diffusion Models

Shiqi Liu, Yihua Tan

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20020 2025-08-28 cs.CV 83%

GS: Generative Segmentation via Label Diffusion

Yuhao Chen, Shubin Chen, Liang Lin, Guangrun Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 12 pages, 7 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18235 2025-08-26 cs.CV 83%

Sealing The Backdoor: Unlearning Adversarial Text Triggers In Diffusion Models Using Knowledge Distillation

Ashwath Vaithinathan Aravindan, Abha Jha, Matthew Salaway, Atharva Sandeep Bhide, Duygu Nur Yaldiz

机构 * University of Southern California(南加州大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17844 2025-08-26 cs.CV cs.LG 83%

Diffusion-Based Data Augmentation for Medical Image Segmentation

Maham Nazir, Muhammad Aqeel, Francesco Setti

机构 * School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) Dept. of Engineering for Innovation Medicine, University of Verona(威尼斯大学创新医学工程系)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments Accepted to CVAMD Workshop at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17614 2025-08-26 cs.CV 83%

JCo-MVTON: Jointly Controllable Multi-Modal Diffusion Transformer for Mask-Free Virtual Try-on

Aowen Wang, Wei Li, Hao Luo, Mengxing Ao, Chenyu Zhu, Xinyang Li, Fan Wang

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团) Hupan Lab(汇安实验室) Zhejiang University(浙江大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏