arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86714 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70159 篇

2412.21044 2025-03-11 cs.CV 83%

E2ED^2:Direct Mapping from Noise to Data for Enhanced Diffusion Models

Zhiyu Tan, WenXu Qian, Hesen Chen, Mengping Yang, Lei Chen, Hao Li

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09151 2025-03-11 cs.CV eess.IV 83%

Timestep-Aware Diffusion Model for Extreme Image Rescaling

Ce Wang, Zhenyu Hu, Wanjie Sun, Zhenzhong Chen

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05595 2025-03-10 cs.CV 83%

Anti-Diffusion: Preventing Abuse of Modifications of Diffusion-Based Models

Zheng Li, Liangbin Xie, Jiantao Zhou, Xintao Wang, Haiwei Wu, Jinyu Tian

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04871 2025-03-10 cs.CV cs.LG eess.IV 83%

Toward Lightweight and Fast Decoders for Diffusion Models in Image and Video Generation

Alexey Buzovkin, Evgeny Shilov

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 11 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00156 2025-03-10 cs.CV cs.AI cs.LG stat.ML 83%

VISION-XL: High Definition Video Inverse Problem Solver using Latent Image Diffusion Models

Taesung Kwon, Jong Chul Ye

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments Project page: https://vision-xl.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03944 2025-03-07 cs.CV 83%

GuardDoor: Safeguarding Against Malicious Diffusion Editing via Protective Backdoors

Yaopei Zeng, Yuanpu Cao, Lu Lin

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03090 2025-03-06 cs.GR 83%

From Architectural Sketch to Conceptual Representation: Using Structure-Aware Diffusion Model to Generate Renderings of School Buildings

Zhengyang Wang, Hao Jin, Xusheng Du, Yuxiao Ren, Ye Zhang, Haoran Xie

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.GR

Comments 10 pages, 5 figures, in Proceedings of CAADRIA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02577 2025-03-05 cs.CV 83%

SPG: Improving Motion Diffusion by Smooth Perturbation Guidance

Boseong Jeon

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19754 2025-03-05 cs.CV 83%

Finding Local Diffusion Schrödinger Bridge using Kolmogorov-Arnold Network

Xingyu Qiu, Mengying Yang, Xinghua Ma, Fanding Li, Dong Liang, Gongning Luo, Wei Wang, Kuanquan Wang, Shuo Li

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 16 pages, 10 figures, accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08180 2025-03-05 cs.CV cs.LG 83%

D$^2$-DPM: Dual Denoising for Quantized Diffusion Probabilistic Models

Qian Zeng, Jie Song, Han Zheng, Hao Jiang, Mingli Song

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 9 pages, 4 figures, acceptted by AAAI2025, the code is available at https://github.com/taylorjocelyn/d2-dpm

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05591 2025-03-05 cs.CV 83%

TweedieMix: Improving Multi-Concept Fusion for Diffusion-based Image/Video Generation

Gihyun Kwon, Jong Chul Ye

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Github Page: https://github.com/KwonGihyun/TweedieMix

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14028 2025-03-05 cs.LG cs.AI cs.CV 83%

Continual Learning of Diffusion Models with Generative Distillation

Sergi Masip, Pau Rodriguez, Tinne Tuytelaars, Gido M. van de Ven

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments To appear in the Proceedings of the Third Conference on Lifelong Learning Agents (CoLLAs), 2024

Journal ref Proceedings of The 3rd Conference on Lifelong Learning Agents, PMLR 274: 431-456, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01323 2025-03-04 cs.CV cs.AI 83%

CacheQuant: Comprehensively Accelerated Diffusion Models

Xuewen Liu, Zhikai Li, Qingyi Gu

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03190 2025-03-04 cs.CV 83%

Tuning Timestep-Distilled Diffusion Model Using Pairwise Sample Optimization

Zichen Miao, Zhengyuan Yang, Kevin Lin, Ze Wang, Zicheng Liu, Lijuan Wang, Qiang Qiu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.11219 2025-03-04 cs.CV cs.LG 83%

Score Forgetting Distillation: A Swift, Data-Free Method for Machine Unlearning in Diffusion Models

Tianqi Chen, Shujian Zhang, Mingyuan Zhou

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00266 2025-03-04 cs.CV eess.IV 83%

Flow Matching for Medical Image Synthesis: Bridging the Gap Between Speed and Quality

Milad Yazdani, Yasamin Medghalchi, Pooria Ashrafian, Ilker Hacihaliloglu, Dena Shahriari

专题命中 扩散模型 :image synthesis(title);image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15878 2025-03-04 cs.CV cs.LG 83%

Slot-Guided Adaptation of Pre-trained Diffusion Models for Object-Centric Learning and Compositional Generation

Adil Kaan Akan, Yucel Yemez

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted to ICLR2025. Project page: https://kaanakan.github.io/SlotAdapt/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.20164 2025-03-04 cs.CV 83%

Erase, then Redraw: A Novel Data Augmentation Approach for Free Space Detection Using Diffusion Model

Fulong Ma, Weiqing Qi, Guoyang Zhao, Ming Liu, Jun Ma

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20679 2025-03-03 cs.CV 83%

Diffusion Restoration Adapter for Real-World Image Restoration

Hanbang Liang, Zhen Wang, Weihui Deng

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20126 2025-02-28 cs.LG cs.CV 83%

FlexiDiT: Your Diffusion Transformer Can Easily Generate High-Quality Samples with Less Compute

Sotiris Anagnostidis, Gregor Bachmann, Yeongmin Kim, Jonas Kohler, Markos Georgopoulos, Artsiom Sanakoyeu, Yuming Du, Albert Pumarola, Ali Thabet, Edgar Schönfeld

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02574 2025-02-28 cs.CV cs.AI stat.ML 83%

Solving Video Inverse Problems Using Image Diffusion Models

Taesung Kwon, Jong Chul Ye

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments ICLR 2025; 25 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11835 2025-02-27 cs.CV 83%

Aligned Datasets Improve Detection of Latent Diffusion-Generated Images

Anirudh Sundara Rajan, Utkarsh Ojha, Jedidiah Schloesser, Yong Jae Lee

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14195 2025-02-26 cs.CV 83%

VideoShield: Regulating Diffusion-based Video Generation Models via Watermarking

Runyi Hu, Jie Zhang, Yiming Li, Jiwei Li, Qing Guo, Han Qiu, Tianwei Zhang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments International Conference on Learning Representations (ICLR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02929 2025-02-25 cs.CV cs.AI 83%

Panoptic Diffusion Models: co-generation of images and segmentation maps

Yinghan Long, Kaushik Roy

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17465 2025-02-24 cs.CV cs.AI 83%

LaRE$^2$: Latent Reconstruction Error Based Method for Diffusion-Generated Image Detection

Yunpeng Luo, Junlong Du, Ke Yan, Shouhong Ding

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments CVPR 2024. Code is available at https://github.com/luo3300612/LaRE

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06527 2025-02-21 cs.CV 83%

CustomVideoX: 3D Reference Attention Driven Dynamic Adaptation for Zero-Shot Customized Video Diffusion Transformers

D. She, Mushui Liu, Jingxuan Pang, Jin Wang, Zhen Yang, Wanggui He, Guanghao Zhang, Yi Wang, Qihan Huang, Haobin Tang, Yunlong Yu, Siming Fu

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Section 4 in CustomVideoX Entity Region-Aware Enhancement has description errors. The compared methods data of Table I lacks other metrics

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18974 2025-02-21 cs.CV cs.AI 83%

3D-Adapter: Geometry-Consistent Multi-View Diffusion for High-Quality 3D Generation

Hansheng Chen, Bokui Shen, Yulin Liu, Ruoxi Shi, Linqi Zhou, Connor Z. Lin, Jiayuan Gu, Hao Su, Gordon Wetzstein, Leonidas Guibas

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Project page: https://lakonik.github.io/3d-adapter/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08822 2025-02-21 cs.CV 83%

PFDiff: Training-Free Acceleration of Diffusion Models Combining Past and Future Scores

Guangyi Wang, Yuren Cai, Lijiang Li, Wei Peng, Songzhi Su

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12742 2025-02-19 cs.CV 83%

3D Shape-to-Image Brownian Bridge Diffusion for Brain MRI Synthesis from Cortical Surfaces

Fabian Bongratz, Yitong Li, Sama Elbaroudy, Christian Wachinger

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted by Information Processing in Medical Imaging (IPMI) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06355 2025-02-18 cs.CV 83%

DiffQRCoder: Diffusion-based Aesthetic QR Code Generation with Scanning Robustness Guided Iterative Refinement

Jia-Wei Liao, Winston Wang, Tzu-Sian Wang, Li-Xuan Peng, Ju-Hsuan Weng, Cheng-Fu Chou, Jun-Cheng Chen

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏