arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86585 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70051 篇

2507.23058 2025-08-01 cs.CV cs.AI 88%

Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation

Alexandru Buburuzan

机构 * Department of Computer Science(计算机科学系)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments A dissertation submitted to The University of Manchester for the degree of Bachelor of Science in Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21690 2025-07-30 cs.CV cs.AI 88%

APT: Improving Diffusion Models for High Resolution Image Generation with Adaptive Path Tracing

Sangmin Han, Jinho Jeong, Jinwoo Kim, Seon Joo Kim

机构 * Yonsei University(延世大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21627 2025-07-30 cs.CV 88%

GuidPaint: Class-Guided Image Inpainting with Diffusion Models

Qimin Wang, Xinda Liu, Guohua Geng

机构 * Northwest University(西北大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01189 2025-07-29 eess.IV cs.AI cs.CV cs.IT eess.SP math.IT 88%

Compressed Image Generation with Denoising Diffusion Codebook Models

Guy Ohayon, Hila Manor, Tomer Michaeli, Michael Elad

机构 * Faculty of Computer Science, Technion -- Israel Institute of Technology, Haifa, Israel(计算机科学系,技术离子理工学院——以色列理工学院,海法,以色列) Faculty of Electrical and Computer Engineering, Technion -- Israel Institute of Technology, Haifa, Israel(电气与计算机工程系,技术离子理工学院——以色列理工学院,海法,以色列)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Published in the International Conference on Machine Learning (ICML) 2025. Code and demo are available at https://ddcm-2025.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18830 2025-07-28 eess.IV cs.CV cs.LG 88%

RealDeal: Enhancing Realism and Details in Brain Image Generation via Image-to-Image Diffusion Models

Shen Zhu, Yinzhu Jin, Tyler Spears, Ifrah Zawar, P. Thomas Fletcher

机构 * University of Virginia(弗吉尼亚大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments 19 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17911 2025-07-25 eess.IV cs.CV 88%

Hierarchical Diffusion Framework for Pseudo-Healthy Brain MRI Inpainting with Enhanced 3D Consistency

Dou Hoon Kwark, Shirui Luo, Xiyue Zhu, Yudu Li, Zhi-Pei Liang, Volodymyr Kindratenko

机构 * The Grainger College of Engineering(格拉inger工程学院) National Center for Supercomputing Applications(国家超级计算应用中心) University of Illinois Urbana‑Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments 11 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03584 2025-07-24 cs.CV 88%

Context Diffusion: In-Context Aware Image Generation

Ivona Najdenkoska, Animesh Sinha, Abhimanyu Dubey, Dhruv Mahajan, Vignesh Ramanathan, Filip Radenovic

机构 * Meta GenAI(Meta 生成式人工智能) University of Amsterdam(阿姆斯特丹大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Journal ref European Conference on Computer Vision (ECCV) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16732 2025-07-23 cs.CV 88%

HarmonPaint: Harmonized Training-Free Diffusion Inpainting

Ying Li, Xinzhe Li, Yong Du, Yangyang Xu, Junyu Dong, Shengfeng He

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00377 2025-07-02 cs.CV 88%

MedDiff-FT: Data-Efficient Diffusion Model Fine-tuning with Structural Guidance for Controllable Medical Image Synthesis

Jianhao Xie, Ziang Zhang, Zhenyu Weng, Yuesheng Zhu, Guibo Luo

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology, Peking University Shenzhen Graduate School South China University of Technology, China

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title);image generation(abstract);分类 cs.CV

Comments 11 pages,3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23641 2025-07-01 cs.CV cs.AI 88%

VAP-Diffusion: Enriching Descriptions with MLLMs for Enhanced Medical Image Generation

Peng Huang, Junhu Fu, Bowen Guo, Zeju Li, Yuanyuan Wang, Yi Guo

机构 * College of Biomedical Engineering, Fudan University, Shanghai 200433, China(复旦大学生物医学工程学院) Key Laboratory of Medical Imaging Computing and Computer Assisted Intervention of Shanghai, Shanghai 200032, China(上海医学影像计算与计算机辅助干预重点实验室)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23482 2025-07-01 cs.CV 88%

MTADiffusion: Mask Text Alignment Diffusion Model for Object Inpainting

Jun Huang, Ting Liu, Yihang Wu, Xiaochao Qu, Luoqi Liu, Xiaolin Hu

机构 * MT Lab, Meitu Inc(美图实验室,美图公司) National University of Singapore(新加坡国立大学) Department of Computer Science and Technology, BNRist, IDG/McGovern Institute for Brain Research, Tsinghua University(计算机科学与技术系,BNRist,IDG/McGovern脑科学研究院,清华大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23038 2025-07-01 cs.CV 88%

Inpainting is All You Need: A Diffusion-based Augmentation Method for Semi-supervised Medical Image Segmentation

Xinrong Hu, Yiyu Shi

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20452 2025-06-26 cs.CV cs.LG 88%

HiWave: Training-Free High-Resolution Image Generation via Wavelet-Based Diffusion Sampling

Tobias Vontobel, Seyedmorteza Sadat, Farnood Salehi, Romann M. Weber

机构 * ETH Zurich(苏黎世联邦理工学院) Disney Research|Studios(迪士尼研究与工作室)

专题命中 扩散模型 :diffusion(title,abstract);image generation(title);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09306 2025-06-25 cs.CV 88%

TD-Paint: Faster Diffusion Inpainting Through Time Aware Pixel Conditioning

Tsiry Mayet, Pourya Shamsolmoali, Simon Bernard, Eric Granger, Romain Hérault, Clement Chatelain

机构 * INSA Rouen Normandie, LITIS UR 4108(法国 Rouen 规划大学) University of York(约克大学) East China Normal University(华东师范大学) Université Rouen Normandie, LITIS UR 4108(法国 Rouen 规划大学) LIVIA, Dept. of Systems Engineering, ETS Montreal(蒙特利尔工程学院) Université Caen Normandie, CNRS, GREYC UMR6072(法国 Caen 规划大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13754 2025-06-18 cs.LG cs.AI cs.CV 88%

VideoPDE: Unified Generative PDE Solving via Video Inpainting Diffusion Models

Edward Li, Zichen Wang, Jiahe Huang, Jeong Joon Park

机构 * University of Michigan(密歇根大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments Project page: https://videopde.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07999 2025-06-10 cs.CV cs.LG 88%

MADFormer: Mixed Autoregressive and Diffusion Transformers for Continuous Image Generation

Junhao Chen, Yulia Tsvetkov, Xiaochuang Han

机构 * Tsinghua University(清华大学) University of Washington(华盛顿大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02560 2025-06-04 cs.CV 88%

DCI: Dual-Conditional Inversion for Boosting Diffusion-Based Image Editing

Zixiang Li, Haoyu Wang, Wei Wang, Chuangchuang Tan, Yunchao Wei, Yao Zhao

机构 * Institute of Information Science, Beijing Jiaotong University(信息科学学院,北京交通大学) Visual Intelligence +X International Cooperation Joint Laboratory of MOE(视觉智能+X国际合作联合实验室)

专题命中 扩散模型 :diffusion(title,abstract);image editing(title);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19365 2025-06-03 cs.CV cs.AI 88%

Conditional Image Synthesis with Diffusion Models: A Survey

Zheyuan Zhan, Defang Chen, Jian-Ping Mei, Zhenghe Zhao, Jiawei Chen, Chun Chen, Siwei Lyu, Can Wang

机构 * State Key Laboratory of Blockchain and Data Security, Zhejiang University College of Computer Science, Zhejiang University(区块链与数据安全国家重点实验室,浙江大学计算机科学学院,浙江大学) University at Buffalo, State University of New York(纽约州立大学布法罗分校) College of Computer Science, Zhejiang University of Technology(浙江工业大学计算机科学学院) State Key Laboratory of Blockchain and Data Security, Zhejiang University Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(区块链与数据安全国家重点实验室,浙江大学杭州高科技区(滨江)区块链与数据安全研究院) College of Computer Science, Zhejiang University(浙江大学计算机科学学院)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24222 2025-06-02 cs.CV cs.LG 88%

Unleashing High-Quality Image Generation in Diffusion Sampling Using Second-Order Levenberg-Marquardt-Langevin

Fangyikang Wang, Hubery Yin, Lei Qian, Yinan Li, Shaobin Zhuang, Huminhao Zhu, Yilin Zhang, Yanlong Tang, Chao Zhang, Hanbin Zhao, Hui Qian, Chen Li

机构 * Zhejiang University(浙江大学) WeChat Vision, Tencent Inc(腾讯公司) Shanghai Jiao Tong University(上海交通大学) Tencent Lightspeed Studio(腾讯光年工作室)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08528 2025-05-28 astro-ph.GA cs.CV 88%

BCDDM: Branch-Corrected Denoising Diffusion Model for Black Hole Image Generation

Ao liu, Zelin Zhang, Songbai Chen, Cuihong Wen, Jieci Wang

机构 * College of information science and engineering, Hunan Normal University(信息科学与工程学院,湖南师范大学) Department of Physics, Institute of Interdisciplinary Studies, Key Laboratory of Low Dimensional Quantum Structures and Quantum Control of Ministry of Education, Synergetic Innovation Center for Quantum Effects and Applications, Hunan Normal University(物理系,跨学科研究所,教育部低维量子结构与量子控制重点实验室,量子效应与应用协同创新中心,湖南师范大学) Center for Gravitation and Cosmology, College of Physical Science and Technology, Yangzhou University(引力与宇宙学中心,物理科学与技术学院,扬州大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments 20 pages, 10figures

Journal ref Astrophysical Journal Supplement Series, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20297 2025-05-27 cs.CV cs.CL 88%

DiSA: Diffusion Step Annealing in Autoregressive Image Generation

Qinyu Zhao, Jaskirat Singh, Ming Xu, Akshay Asthana, Stephen Gould, Liang Zheng

机构 * Australian National University(澳大利亚国立大学) Seeing Machines Ltd(Seeing Machines有限公司)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Our code is available at https://github.com/Qinyu-Allen-Zhao/DiSA

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19425 2025-05-27 cs.CV cs.CR cs.LG 88%

Structure Disruption: Subverting Malicious Diffusion-Based Inpainting via Self-Attention Query Perturbation

Yuhao He, Jinyu Tian, Haiwei Wu, Jianqing Li

机构 * Faculty of Innovation Engineering(创新工程学院) Macau University of Science and Technology(澳门科学技术大学) School of Computer Science and Engineering(计算机科学与工程学院) University of Electronic Science and Technology of China(电子科技大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14933 2025-05-23 cs.CV 88%

TWIG: Two-Step Image Generation using Segmentation Masks in Diffusion Models

Mazharul Islam Rakib, Showrin Rahman, Joyanta Jyoti Mondal, Xi Xiao, David Lewis, Alessandra Mileo, Meem Arafat Manab

机构 * BRAC University(布拉克大学) University of Delaware(德雷塞尔大学) University of Alabama at Birmingham(阿拉巴马大学伯明翰分校) ADAPT SFI Research Center(ADAPT SFI研究中心) Insight SFI Research Center for Data Analytics(Insight SFI数据分析研究中心) Dublin City University(都柏林城市大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments 16 pages, 9 figures, published to IFIP International Summer School on Privacy and Identity Management

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12427 2025-05-21 cs.CV 88%

DragLoRA: Online Optimization of LoRA Adapters for Drag-based Image Editing in Diffusion Model

Siwei Xia, Li Sun, Tiantian Sun, Qingli Li

机构 * Siwei Xia Li Sun Tiantian Sun Qingli Li

专题命中 扩散模型 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

Comments Accepted by ICML2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15661 2025-05-20 cs.CV 88%

DiTPainter: Efficient Video Inpainting with Diffusion Transformers

Xian Wu, Chang Liu

机构 * ByteDance(字节跳动)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03471 2025-05-06 cs.CV 88%

Dynamic Importance in Diffusion U-Net for Enhanced Image Synthesis

Xi Wang, Ziqi He, Yang Zhou

机构 * CSSE, Shenzhen University(深圳大学计算机科学与工程学院)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title);image generation(abstract);分类 cs.CV

Comments Accepted to ICME 2025. Appendix & Code: https://github.com/Hytidel/UNetReweighting

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13509 2025-04-30 cs.CV 88%

Dual-Interrelated Diffusion Model for Few-Shot Anomaly Image Generation

Ying Jin, Jinlong Peng, Qingdong He, Teng Hu, Jiafu Wu, Hao Chen, Haoxuan Wang, Wenbing Zhu, Mingmin Chi, Jun Liu, Yabiao Wang

机构 * Fudan University(复旦大学) Youtu Lab, Tencent(腾讯优图实验室) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01348 2025-04-29 cs.CV cs.CE cs.LG 88%

PatternPaint: Practical Layout Pattern Generation Using Diffusion-Based Inpainting

Guanglei Zhou, Bhargav Korrapati, Gaurav Rajavendra Reddy, Chen-Chia Chang, Jingyu Pan, Jiang Hu, Yiran Chen, Dipto G. Thakurta

机构 * Dept. of Electrical & Computer Engineering, Duke University(杜克大学电气与计算机工程系) Intel Corporation(英特尔公司) Dept. of Electrical & Computer Engineering, TAMU, College Station(塔拉斯大学电气与计算机工程系)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments DAC 2025 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01090 2025-04-29 cs.CV 88%

Infusion: internal diffusion for inpainting of dynamic textures and complex motion

Nicolas Cherel, Andrés Almansa, Yann Gousseau, Alasdair Newson

机构 * LTCI, Télécom Paris, Institut Polytechnique de Paris, France(法国巴黎高等理工学院LTCI研究中心,Telecom Paris,巴黎理工学院) MAP5, CNRS & Université Paris Cité, France(法国国家科学研究中心MAP5研究所,巴黎城市大学) ISIR, Sorbonne Université, France(法国索邦大学ISIR研究所)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments 14 pages, 11 figures. Published in Eurographics 2025

Journal ref Computer Graphics Forum e70070 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17524 2025-04-25 cs.CV 88%

ESDiff: Encoding Strategy-inspired Diffusion Model with Few-shot Learning for Color Image Inpainting

Junyan Zhang, Yan Li, Mengxiao Geng, Liu Shi, Qiegen Liu

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments 11 pages,10 figures,Submit to tcsvt

详情

展开后加载摘要…

URL PDF HTML 收藏