arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86714 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70159 篇

2502.09963 2025-02-17 cs.CV 83%

Generating on Generated: An Approach Towards Self-Evolving Diffusion Models

Xulu Zhang, Xiaoyong Wei, Jinlin Wu, Jiaxin Wu, Zhaoxiang Zhang, Zhen Lei, Qing Li

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09434 2025-02-14 cs.CV 83%

Redistribute Ensemble Training for Mitigating Memorization in Diffusion Models

Xiaoliu Guan, Yu Wu, Huayang Huang, Xiao Liu, Jiaxu Miao, Yi Yang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 12 pages,9 figures. arXiv admin note: substantial text overlap with arXiv:2407.15328

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08754 2025-02-14 cs.CV cs.AI 83%

HistoSmith: Single-Stage Histology Image-Label Generation via Conditional Latent Diffusion for Enhanced Cell Segmentation and Classification

Valentina Vadori, Jean-Marie Graïc, Antonella Peruffo, Livio Finos, Ujwala Kiran Chaudhari, Enrico Grisan

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15650 2025-02-13 cs.CV 83%

ImPoster: Text and Frequency Guidance for Subject Driven Action Personalization using Diffusion Models

Divya Kothandaraman, Kuldeep Kulkarni, Sumit Shekhar, Balaji Vasan Srinivasan, Dinesh Manocha

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Journal ref COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07751 2025-02-12 cs.CV q-bio.GN 83%

CausalGeD: Blending Causality and Diffusion for Spatial Gene Expression Generation

Rabeya Tus Sadia, Md Atik Ahamed, Qiang Cheng

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08502 2025-02-12 cs.CV 83%

Efficient Image-to-Image Diffusion Classifier for Adversarial Robustness

Hefei Mei, Minjing Dong, Chang Xu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19458 2025-02-12 cs.CV cs.AI 83%

MemControl: Mitigating Memorization in Diffusion Models via Automated Parameter Selection

Raman Dutt, Ondrej Bohdal, Pedro Sanchez, Sotirios A. Tsaftaris, Timothy Hospedales

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted into WACV 2025 (Applications Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05710 2025-02-11 cs.CV 83%

SSDD-GAN: Single-Step Denoising Diffusion GAN for Cochlear Implant Surgical Scene Completion

Yike Zhang, Eduardo Davalos, Jack Noble

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05391 2025-02-11 cs.CV 83%

Beyond and Free from Diffusion: Invertible Guided Consistency Training

Chia-Hong Hsu, Shiu-hong Kao, Randall Balestriero

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02771 2025-02-06 physics.med-ph cs.CV cs.LG eess.IV stat.AP 83%

When are Diffusion Priors Helpful in Sparse Reconstruction? A Study with Sparse-view CT

Matt Y. Cheung, Sophia Zorek, Tucker J. Netherton, Laurence E. Court, Sadeer Al-Kindi, Ashok Veeraraghavan, Guha Balakrishnan

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted at IEEE ISBI 2025, 5 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01572 2025-02-06 cs.CV 83%

MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation

Yiren Song, Cheng Liu, Mike Zheng Shou

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01705 2025-02-03 cs.CV cs.AI 83%

Long Tail Image Generation Through Feature Space Augmentation and Iterated Learning

Rafael Elberg, Denis Parra, Mircea Petrache

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15440 2025-02-03 cs.CV 83%

Dfilled: Repurposing Edge-Enhancing Diffusion for Guided DSM Void Filling

Daniel Panangian, Ksenia Bittner

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments Accepted to IEEE/CVF Winter Conference on Applications of Computer Vision Workshops (WACVW)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18593 2025-01-31 cs.CV cs.AI cs.LG 83%

Diffusion Autoencoders are Scalable Image Tokenizers

Yinbo Chen, Rohit Girdhar, Xiaolong Wang, Sai Saketh Rambhatla, Ishan Misra

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Project page: https://yinboc.github.io/dito/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16330 2025-01-28 cs.CV cs.AI 83%

RelightVid: Temporal-Consistent Diffusion Model for Video Relighting

Ye Fang, Zeyi Sun, Shangzhan Zhang, Tong Wu, Yinghao Xu, Pan Zhang, Jiaqi Wang, Gordon Wetzstein, Dahua Lin

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16488 2025-01-24 eess.IV cs.CV cs.LG q-bio.OT 83%

Diffusion Models to Enhance the Resolution of Microscopy Images: A Tutorial

Harshith Bachimanchi, Giovanni Volpe

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 45 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14477 2025-01-22 cs.LG cs.CV 83%

LiteVAE: Lightweight and Efficient Variational Autoencoders for Latent Diffusion Models

Seyedmorteza Sadat, Jakob Buhmann, Derek Bradley, Otmar Hilliges, Romann M. Weber

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Published as a conference paper at NeurIPS 2024

Journal ref The Thirty-Eighth Annual Conference on Neural Information Processing Systems (NeurIPS 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11211 2025-01-22 cs.AR cs.CV cs.LG 83%

Ditto: Accelerating Diffusion Model via Temporal Value Similarity

Sungbin Kim, Hyunwuk Lee, Wonho Cho, Mincheol Park, Won Woo Ro

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted for publication at the 2025 IEEE International Symposium on High-Performance Computer Architecture (HPCA 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09732 2025-01-17 cs.CV 83%

Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps

Nanye Ma, Shangyuan Tong, Haolin Jia, Hexiang Hu, Yu-Chuan Su, Mingda Zhang, Xuan Yang, Yandong Li, Tommi Jaakkola, Xuhui Jia, Saining Xie

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.05159 2025-01-17 cs.CV cs.AI 83%

Derm-T2IM: Harnessing Synthetic Skin Lesion Data via Stable Diffusion Models for Enhanced Skin Disease Classification using ViT and CNN

Muhammad Ali Farooq, Wang Yao, Michael Schukat, Mark A Little, Peter Corcoran

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Paper is submitted in EMBC 2024 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09008 2025-01-16 cs.CV 83%

SimGen: A Diffusion-Based Framework for Simultaneous Surgical Image and Segmentation Mask Generation

Aditya Bhat, Rupak Bose, Chinedu Innocent Nwoye, Nicolas Padoy

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 12 pages, 17 figures, 4 tables, project page at https://camma-public.github.io/endogen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08900 2025-01-16 cs.CV 83%

Enhanced Multi-Scale Cross-Attention for Person Image Generation

Hao Tang, Ling Shao, Nicu Sebe, Luc Van Gool

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to TPAMI, an extended version of a paper published in ECCV2020. arXiv admin note: substantial text overlap with arXiv:2007.09278

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08604 2025-01-16 cs.CV 83%

Watermarking in Diffusion Model: Gaussian Shading with Exact Diffusion Inversion via Coupled Transformations (EDICT)

Krishna Panthi

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07070 2025-01-14 cs.CV 83%

Enhancing Image Generation Fidelity via Progressive Prompts

Zhen Xiong, Yuqi Li, Chuanguang Yang, Tiao Tan, Zhihong Zhu, Siyuan Li, Yue Ma

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by ICASSP 2025, Github: https://github.com/ZhenXiong-dl/ICASSP2025-RCAC

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06655 2025-01-14 cs.LG cs.CV 83%

Personalized Preference Fine-tuning of Diffusion Models

Meihua Dang, Anikait Singh, Linqi Zhou, Stefano Ermon, Jiaming Song

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00944 2025-01-14 cs.CV eess.IV 83%

Diffusion Prism: Enhancing Diversity and Morphology Consistency in Mask-to-Image Diffusion

Hao Wang, Xiwen Chen, Ashish Bastola, Jiayou Qin, Abolfazl Razi

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05427 2025-01-10 cs.CV 83%

Zero-1-to-G: Taming Pretrained 2D Diffusion Model for Direct 3D Generation

Xuyi Meng, Chen Wang, Jiahui Lei, Kostas Daniilidis, Jiatao Gu, Lingjie Liu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04012 2025-01-09 cs.MM cs.LG 83%

FlexCache: Flexible Approximate Cache System for Video Diffusion

Desen Sun, Henry Tian, Tim Lu, Sihang Liu

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05781 2025-01-09 cs.CV cs.AI cs.LG 83%

Open-Source Acceleration of Stable-Diffusion.cpp Deployable on All Devices

Jingxu Ng, Cheng Lv, Pu Zhao, Wei Niu, Juyi Lin, Minzhou Pan, Yun Liang, Yanzhi Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02447 2025-01-07 cs.CV cs.LG eess.IV 83%

MedSegDiffNCA: Diffusion Models With Neural Cellular Automata for Skin Lesion Segmentation

Avni Mittal, John Kalkhof, Anirban Mukhopadhyay, Arnav Bhavsar

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏