arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86585 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70051 篇

2601.19795 2026-01-28 cs.CV 88%

Diffusion for De-Occlusion: Accessory-Aware Diffusion Inpainting for Robust Ear Biometric Recognition

扩散用于去遮挡:面向鲁棒耳生物识别的辅助意识扩散修复

Deeksha Arun, Kevin W. Bowyer, Patrick Flynn

机构 * Department of Computer Science and Engineering, University of Notre Dame(计算机科学与工程系,圣母大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

AI总结 本文提出了一种基于扩散的耳部修复方法,用于缓解耳饰遮挡问题,提升基于耳部的生物识别系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19498 2026-01-28 cs.CV cs.AI cs.LG 88%

Cortex-Grounded Diffusion Models for Brain Image Generation

基于皮层的扩散模型用于脑图像生成

Fabian Bongratz, Yitong Li, Sama Elbaroudy, Christian Wachinger

机构 * Lab for AI in Medical Imaging, Technical University of Munich, Germany(慕尼黑技术大学医学影像人工智能实验室) Munich Center for Machine Learning, Germany(慕尼黑机器学习中心)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 Cor2Vox通过结合皮层结构先验,实现了高精度的脑MRI合成,能生成解剖学一致且生物合理的图像,适用于多种脑部疾病模拟和数据集和谐化任务。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13683 2026-01-21 cs.CV 88%

Dynamic Differential Linear Attention: Enhancing Linear Diffusion Transformer for High-Quality Image Generation

动态微分线性注意力:增强线性扩散变换器以实现高质量图像生成

Boyuan Cao, Xingbo Yao, Chenhui Wang, Jiaxin Ye, Yujie Wei, Hongming Shan

机构 * Fudan University(复旦大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 本文提出动态微分线性注意力机制,通过缓解过度平滑问题提升线性扩散变换器的生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14866 2026-01-21 cs.CV 88%

Controllable Localized Face Anonymization Via Diffusion Inpainting

可控的局部化面部匿名化通过扩散修复

Ali Salar, Qing Liu, Guoying Zhao

机构 * Center for Machine Vision and Signal Analysis (CMVS)(机器视觉与信号分析中心) University of Oulu(奥卢大学) ELLIS Institute Finland(芬兰ELLIS研究所) The Machine Learning Group(机器学习小组) UiT The Arctic University of Norway(挪威北冰洋大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

AI总结 本文提出了一种可控的局部化面部匿名化方法,利用扩散修复生成逼真的匿名图像,通过自适应属性引导模块实现精准控制,无需额外训练即可优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14833 2026-01-21 cs.CV cs.AI 88%

Paired Image Generation with Diffusion-Guided Diffusion Models

配对图像生成与扩散引导扩散模型

Haoxuan Zhang, Wenju Cui, Yuzhu Cao, Tao Tan, Jie Liu, Yunsong Peng, Jian Zheng

机构 * University of Science and Technology of China(科学技术大学) Suzhou Institute of Biomedical Engineering and Technology(生物医学工程与技术研究所) Macao Polytechnic University(澳门 polytechnic 大学) Suzhou Municipal Hospital(苏州 municipal 医院) Guizhou Provincial People's Hospital(贵州省人民医院)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种无需外部条件的配对图像生成方法,通过训练额外的扩散引导器提升生成质量并缓解标注数据不足问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02098 2026-01-06 cs.CV 88%

InpaintHuman: Reconstructing Occluded Humans with Multi-Scale UV Mapping and Identity-Preserving Diffusion Inpainting

InpaintHuman: 通过多尺度UV映射和身份保持扩散修复重建被遮挡的人类

Jinlong Fan, Shanshan Zhao, Liang Zheng, Jing Zhang, Yuxiang Yang, Mingming Gong

机构 * Hangzhou Dianzi University(杭州电子科技大学) Alibaba International Digital Commerce Group(阿里巴巴国际数字商业集团) Wuhan University(武汉大学) University of Melbourne(墨尔本大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

AI总结 InpaintHuman通过多尺度UV映射和身份保持扩散修复技术,从被遮挡的单目视频中生成高保真、完整且可动画的3D人类化身。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19700 2025-12-30 cs.CV 88%

Language-Informed Hyperspectral Image Synthesis for Imbalanced-Small Sample Classification via Semi-Supervised Conditional Diffusion Model

基于语言引导的高光谱图像合成用于不平衡小样本分类的半监督条件扩散模型

Yimin Zhu, Lincoln Linlin Xu

机构 * Department of Geomatics Engineering, University of Calgary(测绘工程系,卡尔加里大学)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title,abstract);分类 cs.CV

AI总结 本文提出 Txt2HSI-LDM(VAE) 模型,通过语言引导的扩散模型生成高光谱图像样本,解决 HSIC 中的 ISSD 问题,优于传统模型和半监督方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21865 2025-12-29 cs.CV 88%

EasyOmnimatte: Taming Pretrained Inpainting Diffusion Models for End-to-End Video Layered Decomposition

EasyOmnimatte:驯服预训练的修复扩散模型以实现端到端的视频分层分解

Yihan Hu, Xuelin Chen, Xiaodong Cun

机构 * GVC Lab, Great Bay University(大西洋湾大学GVC实验室) Adobe Research(Adobe研究院)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

AI总结 EasyOmnimatte通过双专家策略实现端到端视频分层分解,利用Effect Expert和Quality Expert提升分解质量与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06055 2025-12-09 cs.CV 88%

RepLDM: Reprogramming Pretrained Latent Diffusion Models for High-Quality, High-Efficiency, High-Resolution Image Generation

RepLDM: 重编程预训练的潜在扩散模型以实现高质量、高效、高分辨率图像生成

Boyuan Cao, Jiaxin Ye, Yujie Wei, Hongming Shan

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 RepLDM通过重编程预训练的潜在扩散模型,实现高质量、高效、高分辨率的图像生成,优于现有方法。

Comments NeurIPS 2025 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05152 2025-12-08 cs.CV 88%

EFDiT: Efficient Fine-grained Image Generation Using Diffusion Transformer Models

EFDiT:利用扩散变换器模型实现高效的细粒度图像生成

Kun Wang, Donglin Di, Tonghua Su, Lei Fan

机构 * Harbin Institute of Technology(哈尔滨工业大学) Chongqing Research Institute of HIT(重庆HIT研究所) Li Auto(利汽车) University of New South Wales(新南威尔士大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 EFDiT通过引入分层嵌入器和ProAttention机制,提升细粒度图像生成的语义信息融合和细节表现,优于现有微调方法。

Comments 6pages, 5figures, published to 2025 IEEE International Conference on Multimedia and Expo (ICME), Nantes, France, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13059 2025-12-02 eess.IV cs.CV 88%

3D MedDiffusion: A 3D Medical Latent Diffusion Model for Controllable and High-quality Medical Image Generation

3D MedDiffusion:一种用于可控和高质量医学图像生成的3D医学潜在扩散模型

Haoshen Wang, Zhentao Liu, Kaicong Sun, Xiaodong Wang, Dinggang Shen, Zhiming Cui

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 3D MedDiffusion通过高效补丁-体积自编码器和新型噪声估计器,实现可控且高质量的3D医学图像生成,适用于多种医学下游任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00557 2025-12-02 cs.CV cs.AI cs.LG 88%

Blind Inverse Problem Solving Made Easy by Text-to-Image Latent Diffusion

通过文本到图像潜在扩散模型简化盲逆问题求解

Michail Dontas, Yutong He, Naoki Murata, Yuki Mitsufuji, J. Zico Kolter, Ruslan Salakhutdinov

机构 * Carnegie Mellon University(卡内基梅隆大学) Sony AI(索尼人工智能) Sony Group Corporation(索尼集团) Bosch Center for AI(博世人工智能中心)

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 LADiBI通过文本到图像潜在扩散模型无需训练解决多种盲逆问题,利用贝叶斯框架和新型后验采样算法实现灵活且高效的图像恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21215 2025-11-27 cs.CV cs.LG 88%

From Diffusion to One-Step Generation: A Comparative Study of Flow-Based Models with Application to Image Inpainting

从扩散到一步生成:基于流模型的比较研究及其在图像修复中的应用

Umang Agarwal, Rudraksh Sangore, Sumit Laddha

机构 * Department of Electrical Engineering IIT Bombay(电子工程系 印度理工学院 巴米扬)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

AI总结 本文比较了三种生成模型在图像修复中的应用,展示了CFM和MeanFlow在生成质量和效率上的优势,特别是在单步生成和修复任务中的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10382 2025-11-27 cs.CV 88%

Towards Spatially Consistent Image Generation: On Incorporating Intrinsic Scene Properties into Diffusion Models

迈向空间一致的图像生成:将内在场景属性纳入扩散模型

Hyundo Lee, Suhyung Choi, Inwoo Hwang, Byoung-Tak Zhang

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种基于内在场景属性的图像生成方法,通过同时生成图像和其内在属性,提升生成图像的空间一致性和真实感。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15092 2025-11-20 cs.CV 88%

Jointly Conditioned Diffusion Model for Multi-View Pose-Guided Person Image Synthesis

Chengyu Xie, Zhi Gong, Junchi Ren, Linkun Yu, Si Shen, Fei Shen, Xiaoyu Du

机构 * Nanjing University of Science and Technology, China(南京理工大学,中国) NExT++ Research Centre, National University of Singapore, Singapore(NExT++研究中心,新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08273 2025-10-28 cs.CV 88%

One Stone with Two Birds: A Null-Text-Null Frequency-Aware Diffusion Models for Text-Guided Image Inpainting

Haipeng Liu, Yang Wang, Meng Wang

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments 27 pages, 11 figures, to appear at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08625 2025-10-13 cs.CV 88%

Adjusting Initial Noise to Mitigate Memorization in Text-to-Image Diffusion Models

Hyeonggeun Han, Sehwan Kim, Hyungjun Joo, Sangwoo Hong, Jungwoo Lee

机构 * Seoul National University(首尔国立大学) CSE, Konkuk University(计算机科学与工程系,konkuk大学) Hodoo AI Labs(Hodoo AI实验室)

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06995 2025-10-01 cs.CV 88%

KDC-Diff: A Latent-Aware Diffusion Model with Knowledge Retention for Memory-Efficient Image Generation

Md. Naimur Asif Borno, Md Sakib Hossain Shovon, Asmaa Soliman Al-Moisheer, Mohammad Ali Moni

机构 * The University of Queensland(昆士兰大学) Rajshahi University of Engineering & Technology(拉贾沙希工程与技术大学) Imam Mohammad Ibn Saud Islamic University (IMSIU)(伊玛姆穆罕默德·本·沙特伊斯兰大学) Charles Sturt University(查尔斯·斯特劳特大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(title);text-to-image(abstract);分类 cs.CV

Comments Currently Under Review at IEEE open journal for Computer Society

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24875 2025-09-30 cs.CV cs.LG 88%

Environment-Aware Satellite Image Generation with Diffusion Models

Nikos Kostagiolas, Pantelis Georgiades, Yannis Panagakis, Mihalis A. Nicolaou

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08567 2025-09-22 cs.CV 88%

Diffusion-Based Depth Inpainting for Transparent and Reflective Objects

Tianyu Sun, Dingchang Hu, Yixiang Dai, Guijin Wang

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11638 2025-09-16 cs.CV 88%

IS-Diff: Improving Diffusion-Based Inpainting with Better Initial Seed

Yongzhe Lyu, Yu Wu, Yutian Lin, Bo Du

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17784 2025-09-08 cs.CV 88%

HypDAE: Hyperbolic Diffusion Autoencoders for Hierarchical Few-shot Image Generation

Lingxiao Li, Kaixuan Fan, Boqing Gong, Xiangyu Yue

机构 * MMLab, The Chinese University of Hong Kong(香港中文大学) Boston University(波士顿大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments ICCV 2025, Code is available at: https://github.com/lingxiao-li/HypDAE

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06119 2025-09-05 cs.CV cs.LG 88%

Hardware-Friendly Diffusion Models with Fixed-Size Reusable Structures for On-Device Image Generation

Sanchar Palit, Sathya Veera Reddy Dendi, Mallikarjuna Talluri, Raj Narayana Gadde

机构 * IIT Bombay(博伊斯姆理工大学) Samsung(三星)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments presented at IJCNN 2025 poster track

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16217 2025-08-25 cs.CV 88%

PromptFlare: Prompt-Generalized Defense via Cross-Attention Decoy in Diffusion-Based Inpainting

Hohyun Na, Seunghoo Hong, Simon S. Woo

机构 * Sungkyunkwan University(成均馆大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments Accepted to ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15020 2025-08-22 cs.CV cs.AI 88%

TAIGen: Training-Free Adversarial Image Generation via Diffusion Models

Susim Roy, Anubhooti Jain, Mayank Vatsa, Richa Singh

机构 * University at Buffalo(布法罗大学) IIT Jodhpur(印度理工学院乔浦尔)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted at ICCVW-CV4BIOM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14802 2025-08-22 eess.IV cs.CV 88%

Fast-DDPM: Fast Denoising Diffusion Probabilistic Models for Medical Image-to-Image Generation

Hongxu Jiang, Muhammad Imran, Teng Zhang, Yuyin Zhou, Muxuan Liang, Kuang Gong, Wei Shao

机构 * University of Florida College of Medicine(佛罗里达大学医学院) University of Florida(佛罗里达大学) University of California, Santa Cruz(加州大学圣克鲁兹分校)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02601 2025-08-20 cs.CV eess.IV 88%

Hyperspectral Image Generation with Unmixing Guided Diffusion Model

Shiyu Shen, Bin Pan, Ziye Zhang, Zhenwei Shi

机构 * School of Statistics and Data Science, KLMDASR, LEBPS, and LPMC, Nankai University(统计与数据科学学院,KLMDASR,LEBPS和LPMC,南开大学) Image Processing Center, School of Astronautics, Beihang University(图像处理中心,航天学院,北航大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12853 2025-08-19 cs.CV 88%

EraserDiT: Fast Video Inpainting with Diffusion Transformer Model

Jie Liu, Zheng Hui

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

Comments technical report project page:https://jieliu95.github.io/EraserDiT_demo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07519 2025-08-12 cs.CV 88%

Exploring Multimodal Diffusion Transformers for Enhanced Prompt-based Image Editing

Joonghyuk Shin, Alchan Hwang, Yujin Kim, Daneul Kim, Jaesik Park

机构 * Seoul National University(首尔国立大学)

专题命中 扩散模型 :diffusion(title,abstract);image editing(title,abstract);分类 cs.CV

Comments ICCV 2025. Project webpage: https://joonghyuk.com/exploring-mmdit-web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03859 2025-08-07 cs.CV 88%

CreatiLayout: Siamese Multimodal Diffusion Transformer for Creative Layout-to-Image Generation

Hui Zhang, Dexiang Hong, Yitong Wang, Jie Shao, Xinglong Wu, Zuxuan Wu, Yu-Gang Jiang

机构 * Institute of Trustworthy Embodied AI(可信具身人工智能研究院) Fudan University(复旦大学) Shanghai Collaborative Innovation Center of Intelligent Visual Computing(上海智能视觉计算协同创新中心) Bytedance Intelligent Creation(字节跳动智能创作)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏