arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70196 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70196 篇

2510.09056 2025-10-13 cs.CV 79%

Lesion-Aware Post-Training of Latent Diffusion Models for Synthesizing Diffusion MRI from CT Perfusion

Junhyeok Lee, Hyunwoong Kim, Hyungjin Chung, Heeseong Eom, Joon Jang, Chul-Ho Sohn, Kyu Sung Choi

机构 * College of Medicine, Seoul National University, Seoul, Republic of Korea(首尔国立大学医学院) Department of Radiology, Seoul National University Hospital(首尔国立大学医院放射科) Department of Biomedical Sciences, Seoul National University(首尔国立大学生物医学科学系)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments MICCAI 2025, Lecture Notes in Computer Science Vol. 15961

Journal ref Med Image Comput Comput Assist Interv. LNCS 15961, 282-291, Springer, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08669 2025-10-13 cs.LG cs.AI cs.CV 79%

FreqCa: Accelerating Diffusion Models via Frequency-Aware Caching

Jiacheng Liu, Peiliang Cai, Qinming Zhou, Yuqi Lin, Deyang Kong, Benhao Huang, Yupei Pan, Haowen Xu, Chang Zou, Junshu Tang, Shikang Zheng, Linfeng Zhang

机构 * EPIC Lab,STJU(EPIC实验室,STJU) Tencent Hunyuan(腾讯文言) SDU THU(清华大学) JLU(吉林大学) CMU(卡内基梅隆大学) UESTC SCUT(华南理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 15 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21787 2025-10-13 cs.CV cs.CL 79%

DeHate: A Stable Diffusion-based Multimodal Approach to Mitigate Hate Speech in Images

Dwip Dalal, Gautam Vashishtha, Anku Rani, Aishwarya Reganti, Parth Patwa, Mohd Sarique, Chandan Gupta, Keshav Nath, Viswanatha Reddy, Vinija Jain, Aman Chadha, Amitava Das, Amit Sheth, Asif Ekbal

机构 * MIT Media Lab, USA(麻省理工学院媒体实验室) Stanford University, USA(斯坦福大学) Amazon GenAI, USA(亚马逊生成人工智能) University of South Carolina, USA(南卡罗来纳大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Defactify 3 workshop at AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03517 2025-10-13 cs.CV 79%

DenseDPO: Fine-Grained Temporal Preference Optimization for Video Diffusion Models

Ziyi Wu, Anil Kag, Ivan Skorokhodov, Willi Menapace, Ashkan Mirzaei, Igor Gilitschenski, Sergey Tulyakov, Aliaksandr Siarohin

机构 * Snap Research University of Toronto(多伦多大学) Vector Institute(向量研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments NeurIPS 2025 Spotlight. Project page: https://snap-research.github.io/DenseDPO/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08425 2025-10-10 cs.LG cs.CV 79%

Reinforcing Diffusion Models by Direct Group Preference Optimization

Yihong Luo, Tianyang Hu, Jing Tang

机构 * HKUST(香港科技大学) CUHK (SZ)(香港大学(深圳)) HKUST (GZ)(香港科技大学(广州))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08363 2025-10-10 cs.CV 79%

Hyperspectral data augmentation with transformer-based diffusion models

Mattia Ferrari, Lorenzo Bruzzone

机构 * University of Trento(特伦托大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 10 pages, 2 figures, accepted at SPIE REMOTE SENSING conference 16-20 September 2024 Edinburgh, United Kingdom

Journal ref Proceedings Volume 13196, Artificial Intelligence and Image and Signal Processing for Remote Sensing XXX (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16767 2025-10-10 cs.CV 79%

DiffEye: Diffusion-Based Continuous Eye-Tracking Data Generation Conditioned on Natural Images

Ozgur Kara, Harris Nisar, James M. Rehg

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21975 2025-10-10 cs.CV 79%

DvD: Unleashing a Generative Paradigm for Document Dewarping via Coordinates-based Diffusion Model

Weiguang Zhang, Huangcheng Lu, Maizhen Ning, Xiaowei Huang, Wei Wang, Kaizhu Huang, Qiufeng Wang

机构 * Xi'an Jiaotong-Liverpool University(西安交通大学利物浦大学) University of Liverpool(利物浦大学) Duke Kunshan University(duke 昆山大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15742 2025-10-10 cs.CV 79%

Uncertainty-Aware Diffusion Guided Refinement of 3D Scenes

Sarosij Bose, Arindam Dutta, Sayak Nag, Junge Zhang, Jiachen Li, Konstantinos Karydis, Amit K. Roy Chowdhury

机构 * University of California, Riverside, USA(加州大学河滨分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07206 2025-10-09 cs.CV 79%

EigenScore: OOD Detection using Covariance in Diffusion Models

Shirin Shoushtari, Yi Wang, Xiao Shi, M. Salman Asif, Ulugbek S. Kamilov

机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校) University of California, Riverside(加州大学河滨分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07190 2025-10-09 cs.CV 79%

MV-Performer: Taming Video Diffusion Model for Faithful and Synchronized Multi-view Performer Synthesis

Yihao Zhi, Chenghong Li, Hongjie Liao, Xihe Yang, Zhengwentai Sun, Jiahao Chang, Xiaodong Cun, Wensen Feng, Xiaoguang Han

机构 * Great Bay University(大亚湾大学) School of Artificial Intelligence, Shenzhen University(深圳大学人工智能学院) Guangdong Provincial Key Laboratory of Future Networks of Intelligence(广东省未来网络智能化重点实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by SIGGRAPH Asia 2025 conference track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06988 2025-10-09 cs.CV 79%

No MoCap Needed: Post-Training Motion Diffusion Models with Reinforcement Learning using Only Textual Prompts

Girolamo Macaluso, Lorenzo Mandelli, Mirko Bicchierai, Stefano Berretti, Andrew D. Bagdanov

机构 * University of Florence(佛罗伦萨大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12009 2025-10-09 cs.CV 79%

CaRDiff: Video Salient Object Ranking Chain of Thought Reasoning for Saliency Prediction with Diffusion

Yolo Yunlong Tang, Gen Zhan, Li Yang, Yiting Liao, Chenliang Xu

机构 * ByteDance(字节跳动)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06516 2025-10-09 cs.CV 79%

Limited-Angle Tomography Reconstruction via Projector Guided 3D Diffusion

Zhantao Deng, Mériem Er-Rafik, Anna Sushko, Cécile Hébert, Pascal Fua

机构 * School of Computer and Communication Sciences, École Polytechnique Fédérale de Lausanne(计算机与通信科学学院,瑞士联邦理工学院) School of Basic Sciences, École Polytechnique Fédérale de Lausanne(基础科学学院,瑞士联邦理工学院) The School of Life Sciences, École Polytechnique Fédérale de Lausanne(生命科学学院,瑞士联邦理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 10 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06460 2025-10-09 cs.CV 79%

TDiff: Thermal Plug-And-Play Prior with Patch-Based Diffusion

Piyush Dashpute, Niki Nezakati, Wolfgang Heidrich, Vishwanath Saragadam

机构 * University of California, Riverside(加州大学河滨分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06335 2025-10-09 eess.IV cs.CV cs.LG 79%

Conditional Denoising Diffusion Model-Based Robust MR Image Reconstruction from Highly Undersampled Data

Mohammed Alsubaie, Wenxi Liu, Linxia Gu, Ovidiu C. Andronesi, Sirani M. Perera, Xianqi Li

机构 * Department of Mathematics and Systems Engineering(数学与系统工程系) Department of Biomedical Engineering & Science(生物医学工程与科学系) Florida Institute of Technology(佛罗里达理工学院) A. A. Martinos Center for Biomedical Imaging(A.A. Martinos生物医学成像中心) Massachusetts General Hospital/Harvard Medical School(麻省总医院/哈佛医学院) Department of Radiology(放射科) Embry-Riddle Aeronautical University(艾姆伯-里尔航空大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06283 2025-10-09 eess.IV cs.AI cs.CV 79%

SER-Diff: Synthetic Error Replay Diffusion for Incremental Brain Tumor Segmentation

Sashank Makanaboyina

机构 * DePaul University(德保罗大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07344 2025-10-09 cs.CV cs.AI 79%

Generative Pre-trained Autoregressive Diffusion Transformer

Yuan Zhang, Jiacheng Jiang, Guoqing Ma, Zhiying Lu, Haoyang Huang, Jianlong Yuan, Nan Duan, Daxin Jiang

机构 * University of Science and Technology of China(中国科学技术大学) StepFun, China(StepFun)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03881 2025-10-09 cs.CV cs.AI cs.LG 79%

Unlocking Dataset Distillation with Diffusion Models

Brian B. Moser, Federico Raue, Sebastian Palacio, Stanislav Frolov, Andreas Dengel

机构 * University of Kaiserslautern-Landau(凯撒斯劳滕-兰道大学) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心) ABB AG(ABB公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06131 2025-10-08 cs.CV cs.AI 79%

Discrete Diffusion Models with MLLMs for Unified Medical Multimodal Generation

Jiawei Mao, Yuhan Wang, Lifeng Chen, Can Zhao, Yucheng Tang, Dong Yang, Liangqiong Qu, Daguang Xu, Yuyin Zhou

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 16 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05976 2025-10-08 cs.CV cs.AI cs.LG 79%

Diffusion Models for Low-Light Image Enhancement: A Multi-Perspective Taxonomy and Performance Analysis

Eashan Adhikarla, Yixin Liu, Brian D. Davison

机构 * Lehigh University(莱维大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20722 2025-10-08 cs.CV cs.LG 79%

A weakly-supervised deep learning model for fast localisation and delineation of the skeleton, internal organs, and spinal canal on Whole-Body Diffusion-Weighted MRI (WB-DWI)

A. Candito, A. Dragan, R. Holbrey, A. Ribeiro, R. Donners, C. Messiou, N. Tunariu, D. -M. Koh, M. D. Blackledge

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05715 2025-10-08 cs.CV 79%

AgeBooth: Controllable Facial Aging and Rejuvenation via Diffusion Models

Shihao Zhu, Bohan Cao, Ziheng Ouyang, Zhen Li, Peng-Tao Jiang, Qibin Hou

机构 * VCIP, School of Computer Science, Nankai University(VCIP,计算机学院,南开大学) The Chinese University of Hong Kong(香港中文大学) vivo Mobile Communication Co., Ltd(vivo移动通信有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21653 2025-10-08 cs.CV 79%

Think Before You Diffuse: Infusing Physical Rules into Video Diffusion

Ke Zhang, Cihan Xiao, Jiacong Xu, Yiqun Mei, Vishal M. Patel

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 19 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13860 2025-10-08 cs.CV eess.IV 79%

DiffCom: Decoupled Sparse Priors Guided Diffusion Compression for Point Clouds

Xiaoge Zhang, Zijie Wu, Mehwish Nasim, Mingtao Feng, Saeed Anwar, Ajmal Mian

机构 * University of Western Australia(西澳大学) Xidian University(西安电子科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04947 2025-10-07 cs.CV cs.AI 79%

Bidirectional Mammogram View Translation with Column-Aware and Implicit 3D Conditional Diffusion

Xin Li, Kaixiang Yang, Qiang Li, Zhiwei Wang

机构 * Wuhan National Laboratory for Optoelectronics, Huazhong University of Science and Technology(光学电子国家重点实验室,华中科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments BIBM2025 accept, 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04706 2025-10-07 cs.CV 79%

ID-Consistent, Precise Expression Generation with Blendshape-Guided Diffusion

Foivos Paraperas Papantoniou, Stefanos Zafeiriou

机构 * Imperial College London(伦敦帝国学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICCVW 2025, Code: https://github.com/foivospar/Arc2Face

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05993 2025-10-07 cs.CV cs.AI eess.IV 79%

A Modular Conditional Diffusion Framework for Image Reconstruction

Magauiya Zhussip, Iaroslav Koshelev, Stamatis Lefkimmiatis

机构 * MTS AI

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04365 2025-10-07 cs.CV 79%

Diffusion^2: Dual Diffusion Model with Uncertainty-Aware Adaptive Noise for Momentary Trajectory Prediction

Yuhao Luo, Yuang Zhang, Kehua Chen, Xinyu Zheng, Shucheng Zhang, Sikai Chen, Yinhai Wang

机构 * Civil and Environmental Engineering Department, University of Wisconsin-Madison(威斯康星大学麦迪逊分校土木与环境工程系) Civil and Environmental Engineering Department, University of Washington(华盛顿大学土木与环境工程系) College of Transportation, Tongji University(同济大学交通运输学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 13 pages, 7 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04188 2025-10-07 cs.CV 79%

Let Features Decide Their Own Solvers: Hybrid Feature Caching for Diffusion Transformers

Shikang Zheng, Guantao Chen, Qinming Zhou, Yuqi Lin, Lixuan He, Chang Zou, Peiliang Cai, Jiacheng Liu, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) South China University of Technology(南方科技大学) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏