arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2506.01511 2025-06-03 cs.CV 79%

Enhancing Diffusion-based Unrestricted Adversarial Attacks via Adversary Preferences Alignment

Kaixun Jiang, Zhaoyu Chen, Haijing Guo, Jinglun Li, Jiyuan Fu, Pinxue Guo, Hao Tang, Bo Li, Wenqiang Zhang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(智能机器人与先进制造学院,复旦大学) Shanghai Key Lab of Intelligent Information Processing, College of Computer Science and Artificial Intelligence, Fudan University(上海智能信息处理重点实验室,计算机科学与人工智能学院,复旦大学) Peking University(北京大学) vivo Mobile Communication Co., Ltd(vivo移动通信有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01454 2025-06-03 cs.CV 79%

DiffuseSlide: Training-Free High Frame Rate Video Generation Diffusion

Geunmin Hwang, Hyun-kyu Ko, Younghyun Kim, Seungryong Lee, Eunbyung Park

机构 * RECON Labs Inc.(RECON实验室公司) Department of Artificial Intelligence, Yonsei University(延世大学人工智能系) Department of Artificial Intelligence, Sungkyunkwan University(成均馆大学人工智能系) Department of Electrical and Computer Engineering, Sungkyunkwan University(成均馆大学电气与计算机工程系)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01368 2025-06-03 cs.CV 79%

Synthetic Data Augmentation using Pre-trained Diffusion Models for Long-tailed Food Image Classification

GaYeon Koh, Hyun-Jic Oh, Jeonghyun Noh, Won-Ki Jeong

机构 * Korea University(韩国大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00830 2025-06-03 cs.CV 79%

SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers

Zhengcong Fei, Hao Jiang, Di Qiu, Baoxuan Gu, Youqiang Zhang, Jiahua Wang, Jialin Bai, Debang Li, Mingyuan Fan, Guibin Chen, Yahui Zhou

机构 * Kunlun Inc.(昆仑公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19110 2025-06-03 cs.CV cs.AI cs.LG 79%

An Interpretable Representation Learning Approach for Diffusion Tensor Imaging

Vishwa Mohan Singh, Alberto Gaston Villagran Asiares, Luisa Sophie Schuhmacher, Kate Rendall, Simon Weißbrod, David Rügamer, Inga Körte

机构 * Department of Statistics, Ludwig-Maximilians-Universität München(统计系,路德维希-马克西米利安大学慕尼黑) cBRAIN, Department of Child and Adolescent Psychiatry, Psychosomatics, and Psychotherapy, Ludwig-Maximilians-Universität München(cBRAIN,儿童与青少年精神病学、精神病学与心理治疗系,路德维希-马克西米利安大学慕尼黑) Munich Center for Machine Learning(慕尼黑机器学习中心) Psychiatry Neuroimaging Laboratory, Mass General Brigham Academic Medical Centers, Psychiatry Department(精神病影像实验室,马萨诸塞总医院学术医疗中心,精神病科) Harvard Medical School(哈佛医学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted for publication at MIDL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02640 2025-06-03 cs.MM 79%

RoSMM: A Robust and Secure Multi-Modal Watermarking Framework for Diffusion Models

ZhongLi Fang, Yu Xie, Ping Chen

专题命中 扩散模型 :diffusion(title);image generation(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20418 2025-06-03 cs.CV 79%

ITA-MDT: Image-Timestep-Adaptive Masked Diffusion Transformer Framework for Image-Based Virtual Try-On

Ji Woo Hong, Tri Ton, Trung X. Pham, Gwanhyeong Koo, Sunjae Yoon, Chang D. Yoo

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国高级科学技术研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025, Project Page: https://jiwoohong93.github.io/ita-mdt/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03860 2025-06-03 cs.CV 79%

MDMP: Multi-modal Diffusion for supervised Motion Predictions with uncertainty

Leo Bringer, Joey Wilson, Kira Barton, Maani Ghaffari

机构 * University of Michigan(密歇根大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to CVPR 2025 - HuMoGen. Minor revisions made based on reviewer feedback

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01723 2025-06-03 cs.CV 79%

HarmoniCa: Harmonizing Training and Inference for Better Feature Caching in Diffusion Transformer Acceleration

Yushi Huang, Zining Wang, Ruihao Gong, Jing Liu, Xinjie Zhang, Jinyang Guo, Xianglong Liu, Jun Zhang

机构 * iComAI Lab, Hong Kong University of Science and Technology(香港科技大学iComAI实验室) SenseTime Research(商汤科技研究院) SCSE, Beihang University(北京航空航天大学SCSE) IAI, Beihang University(北京航空航天大学IAI) SKLCCSE, Beihang University(北京航空航天大学SKLCCSE) ZIP Lab, Monash University(墨尔本大学ZIP实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09724 2025-06-03 cs.CV 79%

MFCLIP: Multi-modal Fine-grained CLIP for Generalizable Diffusion Face Forgery Detection

Yaning Zhang, Tianyi Wang, Zitong Yu, Zan Gao, Linlin Shen, Shengyong Chen

机构 * Faculty of Computer Science and Technology, Qilu University of Technology (Shandong Academy of Sciences)(计算机科学与技术学院,齐鲁工业大学(山东科学院)) School of Computing, National University of Singapore(computing 学院,新加坡国立大学) School of Computing and Information Technology, Great Bay University(computing 与信息学院,大湾大学) National Engineering Laboratory for Big Data System Computing Technology, Shenzhen University(大数据系统计算技术国家工程实验室,深圳大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by IEEE Transactions on Information Forensics and Security 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09672 2025-06-03 cs.CV 79%

Mixed-View Panorama Synthesis using Geospatially Guided Diffusion

Zhexiao Xiong, Xin Xing, Scott Workman, Subash Khanal, Nathan Jacobs

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by Transactions on Machine Learning Research (TMLR) Project page: https://mixed-view.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01387 2025-06-03 cs.CV 79%

DiffAugment: Diffusion based Long-Tailed Visual Relationship Recognition

Parul Gupta, Tuan Nguyen, Abhinav Dhall, Munawar Hayat, Trung Le, Thanh-Toan Do

机构 * Monash University(墨尔本大学) Indian Institute of Technology Ropar(印度理工学院罗帕尔分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00327 2025-06-03 cs.CV cs.AI 79%

Latent Guidance in Diffusion Models for Perceptual Evaluations

Shreshth Saini, Ru-Ling Liao, Yan Ye, Alan C. Bovik

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 24 Pages, 7 figures, 10 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00325 2025-06-03 cs.CV 79%

Towards Effective and Efficient Adversarial Defense with Diffusion Models for Robust Visual Tracking

Long Xu, Peng Gao, Wen-Jia Tang, Fei Wang, Ru-Yue Yuan

机构 * Qufu Normal University(曲阜师范大学) Harbin Institute of Technology(哈尔滨工业大学) Shenzhen(深圳)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24877 2025-06-02 cs.CV 79%

AdaHuman: Animatable Detailed 3D Human Generation with Compositional Multiview Diffusion

Yangyi Huang, Ye Yuan, Xueting Li, Jan Kautz, Umar Iqbal

机构 * NVIDIA

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Website: https://nvlabs.github.io/AdaHuman

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24521 2025-06-02 cs.CV 79%

UniGeo: Taming Video Diffusion for Unified Consistent Geometry Estimation

Yang-Tian Sun, Xin Yu, Zehuan Huang, Yi-Hua Huang, Yuan-Chen Guo, Ziyi Yang, Yan-Pei Cao, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) Beihang University(北京航空航天大学) VAST

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project page: https://sunyangtian.github.io/UniGeo-web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24406 2025-06-02 cs.CV 79%

IRBridge: Solving Image Restoration Bridge with Pre-trained Generative Diffusion Models

Hanting Wang, Tao Jin, Wang Lin, Shulei Wang, Hai Huang, Shengpeng Ji, Zhou Zhao

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24245 2025-06-02 cs.CV cs.AI 79%

LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework

Xin Kang, Zihan Zheng, Lei Chu, Yue Gao, Jiahao Li, Hao Pan, Xuejin Chen, Yan Lu

机构 * University of Science and Technology of China(中国科学技术大学) Microsoft Research Asia(微软亚洲研究院) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22111 2025-06-02 cs.CV 79%

Autoregression-free video prediction using diffusion model for mitigating error propagation

Woonho Ko, Jin Bok Park, Il Yong Chun

机构 * IEEE

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 6 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06516 2025-06-02 cs.LG cs.AI cs.CV stat.ML 79%

Boost-and-Skip: A Simple Guidance-Free Diffusion for Minority Generation

Soobin Um, Beomsu Kim, Jong Chul Ye

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICML 2025, 29 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.15818 2025-06-02 cs.CV 79%

Show-1: Marrying Pixel and Latent Diffusion Models for Text-to-Video Generation

David Junhao Zhang, Jay Zhangjie Wu, Jia-Wei Liu, Rui Zhao, Lingmin Ran, Yuchao Gu, Difei Gao, Mike Zheng Shou

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments project page is https://showlab.github.io/Show-1

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00287 2025-06-02 cs.CV 79%

Fast Diffusion EM: a diffusion model for blind inverse problems with application to deconvolution

Charles Laroche, Andrés Almansa, Eva Coupete

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Journal ref 2024 IEEE/CVF Winter Conference on Applications of Computer Vision (WACV), Waikoloa, HI, USA, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.04542 2025-06-02 cs.LG cs.AI cs.CV 79%

On the Design Fundamentals of Diffusion Models: A Survey

Ziyi Chang, George Alex Koulieris, Hyung Jin Chang, Hubert P. H. Shum

机构 * Department of Computer Science, Durham University(计算机科学系,杜伦大学) School of Computer Science, University of Birmingham(计算机科学学院,伯明翰大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted in Pattern Recognition

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23743 2025-05-30 cs.CV eess.IV 79%

DarkDiff: Advancing Low-Light Raw Enhancement by Retasking Diffusion Models for Camera ISP

Amber Yijia Zheng, Yu Zhang, Jun Hu, Raymond A. Yeh, Chen Chen

机构 * Department of Computer Science, Purdue University(普渡大学计算机科学系) Apple Inc(苹果公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23675 2025-05-30 eess.IV cs.CV 79%

ImmunoDiff: A Diffusion Model for Immunotherapy Response Prediction in Lung Cancer

Moinak Bhattacharya, Judy Huang, Amna F. Sher, Gagandeep Singh, Chao Chen, Prateek Prasanna

机构 * Stony Brook University(石溪大学) Columbia University(哥伦比亚大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23660 2025-05-30 cs.CV 79%

D-AR: Diffusion via Autoregressive Models

Ziteng Gao, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23119 2025-05-30 cs.CV 79%

TextSR: Diffusion Super-Resolution with Multilingual OCR Guidance

Keren Ye, Ignacio Garcia Dorado, Michalis Raptis, Mauricio Delbracio, Irene Zhu, Peyman Milanfar, Hossein Talebi

机构 * Google(谷歌)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23085 2025-05-30 cs.CV cs.AI eess.IV 79%

GeoMan: Temporally Consistent Human Geometry Estimation using Image-to-Video Diffusion

Gwanghyun Kim, Xueting Li, Ye Yuan, Koki Nagano, Tianye Li, Jan Kautz, Se Young Chun, Umar Iqbal

机构 * NVIDIA Seoul National University(首尔国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project page: https://research.nvidia.com/labs/dair/geoman

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22926 2025-05-30 cs.CV 79%

Leveraging Diffusion Models for Synthetic Data Augmentation in Protein Subcellular Localization Classification

Sylvey Lin, Zhi-Yi Cao

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22869 2025-05-30 cs.CV cs.LG q-bio.BM 79%

CFP-Gen: Combinatorial Functional Protein Generation via Diffusion Language Models

Junbo Yin, Chao Zha, Wenjia He, Chencheng Xu, Xin Gao

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted at ICML 2025. Code is available at https://github.com/yinjunbo/cfpgen

详情

展开后加载摘要…

URL PDF HTML 收藏