arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2502.09873 2025-07-15 cs.CV 79%

Compression-Aware One-Step Diffusion Model for JPEG Artifact Removal

Jinpei Guo, Zheng Chen, Wenbo Li, Yong Guo, Yulun Zhang

机构 * Carnegie Mellon University(卡内基梅隆大学) Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Max Planck Institute for Informatics(马克斯·普朗克信息研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03328 2025-07-15 cs.CV cs.AI 79%

Enhancing Spatiotemporal Disease Progression Models via Latent Diffusion and Prior Knowledge

Lemuel Puglisi, Daniel C. Alexander, Daniele Ravì

机构 * Dept. of Math and Computer Science, University of Catania, Italy(数学与计算机科学系,卡塔尼亚大学,意大利) Centre for Medical Image Computing, University College London, UK(医学影像计算中心,伦敦大学学院,英国) School of Physics, Engineering and CS, University of Hertfordshire, UK(物理、工程与计算机科学学院,赫特福德大学,英国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02827 2025-07-14 cs.CV cs.AI 79%

USAD: End-to-End Human Activity Recognition via Diffusion Model with Spatiotemporal Attention

Hang Xiao, Ying Yu, Jiarui Li, Zhifan Yang, Haotian Tang, Hanyu Liu, Chao Li

机构 * Northeastern University(东北大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11992 2025-07-14 cs.CV 79%

SpatialCrafter: Unleashing the Imagination of Video Diffusion Models for Scene Reconstruction from Limited Observations

Songchun Zhang, Huiyao Xu, Sitong Guo, Zhongwei Xie, Hujun Bao, Weiwei Xu, Changqing Zou

机构 * ZJU(浙江大学) HKUST(香港科技大学) Zhejiang Lab(浙江实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICCV 2025. 12 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08163 2025-07-14 cs.CV cs.CR cs.LG 79%

Adaptive Diffusion Denoised Smoothing : Certified Robustness via Randomized Smoothing with Differentially Private Guided Denoising Diffusion

Frederick Shpilevskiy, Saiyue Lyu, Krishnamurthy Dj Dvijotham, Mathias Lécuyer, Pierre-André Noël

机构 * University of British Columbia, Vancouver, Canada(不列颠哥伦比亚大学) ServiceNow Research(ServiceNow研究)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07982 2025-07-11 cs.CV cs.AI 79%

Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling

Haoyu Wu, Diankun Wu, Tianyu He, Junliang Guo, Yang Ye, Yueqi Duan, Jiang Bian

机构 * Microsoft Research(微软研究院) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 18 pages, project page: https://GeometryForcing.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05317 2025-07-11 eess.IV cs.AI cs.CV 79%

PWD: Prior-Guided and Wavelet-Enhanced Diffusion Model for Limited-Angle CT

Yi Liu, Yiyang Wen, Zekun Zhou, Junqi Ma, Linghang Wang, Yucheng Yao, Liu Shi, Qiegen Liu

机构 * School of Information Engineering(信息工程学院) School of Mathematics and Computer Sciences(数学与计算机科学学院) YOFO Medical Technology Co., Ltd.(YOFO医疗科技有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23664 2025-07-11 eess.IV cs.CV 79%

Diffusion Model-based Data Augmentation Method for Fetal Head Ultrasound Segmentation

Fangyijie Wang, Kevin Whelan, Félix Balado, Kathleen M. Curran, Guénolé Silvestre

机构 * Research Ireland Centre for Research Training in Machine Learning(爱尔兰研究机器学习研究中心) School of Medicine, University College Dublin(都柏林大学医学院) School of Computer Science, University College Dublin(都柏林大学计算机科学学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted at Irish Machine Vision and Image Processing Conference (IMVIP) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13272 2025-07-11 cs.CV 79%

AniFaceDiff: Animating Stylized Avatars via Parametric Conditioned Diffusion Models

Ken Chen, Sachith Seneviratne, Wei Wang, Dongting Hu, Sanjay Saha, Md. Tarek Hasan, Sanka Rasnayaka, Tamasha Malepathirana, Mingming Gong, Saman Halgamuge

机构 * University of Melbourne(墨尔本大学) National University of Singapore(新加坡国立大学) United International University(国际大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Journal ref Pattern Recognition 170 (2026) 112017

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06738 2025-07-10 cs.CV cs.AI 79%

DIFFUMA: High-Fidelity Spatio-Temporal Video Prediction via Dual-Path Mamba and Diffusion Enhancement

Xinyu Xie, Weifeng Cao, Jun Shi, Yangyang Hu, Hui Liang, Wanyong Liang, Xiaoliang Qian

机构 * College of Electric and Information Engineering, Zhengzhou University of Light Industry(电子信息工程学院,郑州轻工业大学) Guangli Ruihong Electronic Technology Co., Ltd(广利润红电子科技有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06651 2025-07-10 cs.CV 79%

Diff$^2$I2P: Differentiable Image-to-Point Cloud Registration with Diffusion Prior

Juncheng Mu, Chengwei Ren, Weixiang Zhang, Liang Pan, Xiao-Ping Zhang, Yue Gao

机构 * Tsinghua University(清华大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06590 2025-07-10 cs.CV 79%

MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction

Yin Wang, Mu li, Zhiying Leng, Frederick W. B. Li, Xiaohui Liang

机构 * State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(虚拟现实技术与系统国家重点实验室,北京航空航天大学) Department of Computer Science, University of Durham(计算机科学系,达勒姆大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05963 2025-07-10 cs.CV 79%

Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation

Zhenghao Zhang, Junchao Liao, Xiangyu Meng, Long Qin, Weizhi Wang

机构 * Alibaba Group(阿里巴巴集团)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ACM MM25 Conference Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15670 2025-07-10 eess.IV cs.CV 79%

BS-LDM: Effective Bone Suppression in High-Resolution Chest X-Ray Images with Conditional Latent Diffusion Models

Yifei Sun, Zhanghao Chen, Hao Zheng, Wenming Deng, Jin Liu, Wenwen Min, Ahmed Elazab, Xiang Wan, Changmiao Wang, Ruiquan Ge

机构 * Hangzhou Dianzi University(杭州电子科技大学) National Cancer Center/National Clinical Research Center for Cancer/Cancer Hospital&Shenzhen Hospital, Chinese Academy of Medical Sciences and Peking Union Medical College(中国医学科学院国家癌症中心/国家临床医学研究中心/癌症医院及深圳医院) Central South University(中南大学) Yunnan University(云南大学) School of Biomedical Engineering, Shenzhen University(深圳大学生物医学工程学院) Shenzhen Research Institute of Big Data(深圳大数据研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 12 pages, 8 figures, accepted by IEEE Journal of Biomedical and Health Informatics (JBHI) on July 4, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16575 2025-07-10 cs.CV 79%

Rethinking Diffusion for Text-Driven Human Motion Generation: Redundant Representations, Evaluation, and Masked Autoregression

Zichong Meng, Yiming Xie, Xiaogang Peng, Zeyu Han, Huaizu Jiang

机构 * Northeastern University(东北大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13846 2025-07-10 cs.CV cs.LG 79%

Multi-Modality Conditioned Variational U-Net for Field-of-View Extension in Brain Diffusion MRI

Zhiyuan Li, Chenyu Gao, Praitayini Kanakaraj, Shunxing Bao, Lianrui Zuo, Michael E. Kim, Nancy R. Newlin, Gaurav Rudravaram, Nazirah M. Khairi, Yuankai Huo, Kurt G. Schilling, Walter A. Kukull, Arthur W. Toga, Derek B. Archer, Timothy J. Hohman, Bennett A. Landman

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06146 2025-07-09 cs.CV 79%

Prompt-Free Conditional Diffusion for Multi-object Image Augmentation

Haoyu Wang, Lei Zhang, Wei Wei, Chen Ding, Yanning Zhang

机构 * Northwestern Polytechnical University(西北工业大学) Xi’an University of Posts & Telecommunications(西安邮电大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted at IJCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05678 2025-07-09 cs.CV 79%

LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion

Yisu Zhang, Chenjie Cao, Chaohui Yu, Jianke Zhu

机构 * Zhejiang University(浙江大学) DAMO Academy, Alibaba Group(阿里巴巴集团达摩院) Hupan Lab(虎扑实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05670 2025-07-09 cs.CV 79%

Modeling and Reversing Brain Lesions Using Diffusion Models

Omar Zamzam, Haleh Akrami, Anand Joshi, Richard Leahy

机构 * Ming Hsieh Department of Electrical and Computer Engineering University of Southern California(明希部门电子与计算机工程系美国南加州大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05666 2025-07-09 cs.CV eess.IV 79%

Knowledge-guided Complex Diffusion Model for PolSAR Image Classification in Contourlet Domain

Junfei Shi, Yu Cheng, Haiyan Jin, Junhuai Li, Zhaolin Xiao, Maoguo Gong, Weisi Lin

机构 * Department of Computer Science and Technology, Shaanxi Key Laboratory for Network Computing and Security Technology, Xi’an University of Technology(计算机科学与技术系,陕西省网络计算与安全技术重点实验室,西安理工大学) School of Computer Science and Technology, China University of Mining and Technology(计算机科学与技术学院,中国矿业大学) School of Computer Science and Engineering, Nanyang Technological University(计算机科学与工程学院,南洋理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05588 2025-07-09 cs.CV 79%

Semi-Supervised Defect Detection via Conditional Diffusion and CLIP-Guided Noise Filtering

Shuai Li, Shihan Chen, Wanru Geng, Zhaohua Xu, Xiaolu Liu, Can Dong, Zhen Tian, Changlin Chen

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05499 2025-07-09 cs.CV 79%

LoomNet: Enhancing Multi-View Image Generation via Latent Space Weaving

Giulio Federico, Fabio Carrara, Claudio Gennaro, Giuseppe Amato, Marco Di Benedetto

机构 * University of Pisa(比萨大学) CNR-ISTI(意大利国家研究委员会-ISTI研究所)

专题命中 扩散模型 :image generation(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02995 2025-07-09 cs.CV cs.CR 79%

FreqCross: A Multi-Modal Frequency-Spatial Fusion Network for Robust Detection of Stable Diffusion 3.5 Generated Images

Guang Yang

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17695 2025-07-09 cs.CV 79%

MotionDiff: Training-free Zero-shot Interactive Motion Editing via Flow-assisted Multi-view Diffusion

Yikun Ma, Yiqing Li, Jiawei Wu, Xing Luo, Zhi Jin

机构 * Sun Yat-sen University(中山大学) Department of Frontier Research, Peng Cheng Laboratory(前沿研究部,鹏城实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Journal ref ICCV, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12632 2025-07-09 cs.CV cs.LG 79%

MALT Diffusion: Memory-Augmented Latent Transformers for Any-Length Video Generation

Sihyun Yu, Meera Hahn, Dan Kondratyuk, Jinwoo Shin, Agrim Gupta, José Lezama, Irfan Essa, David Ross, Jonathan Huang

机构 * KAIST(韩国科学技术院) Google DeepMind(谷歌DeepMind) Georgia Tech(佐治亚理工学院) Luma AI Google Research(谷歌研究)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025 Workshop on AI for Content Creation (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06035 2025-07-09 cs.CV 79%

Nonisotropic Gaussian Diffusion for Realistic 3D Human Motion Prediction

Cecilia Curreli, Dominik Muhle, Abhishek Saroha, Zhenzhang Ye, Riccardo Marin, Daniel Cremers

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025. Code availabe at https://ceveloper.github.io/publications/skeletondiffusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05092 2025-07-08 cs.CV 79%

MoDiT: Learning Highly Consistent 3D Motion Coefficients with Diffusion Transformer for Talking Head Generation

Yucheng Wang, Dan Xu

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04984 2025-07-08 cs.CV 79%

TLB-VFI: Temporal-Aware Latent Brownian Bridge Diffusion for Video Frame Interpolation

Zonglin Lyu, Chen Chen

机构 * Center for Research in Computer Vision, University of Central Florida(计算机视觉研究中心,中央佛罗里达大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04978 2025-07-08 cs.CV 79%

Parameterized Diffusion Optimization enabled Autoregressive Ordinal Regression for Diabetic Retinopathy Grading

Qinkai Yu, Wei Zhou, Hantao Liu, Yanyu Xu, Meng Wang, Yitian Zhao, Huazhu Fu, Xujiong Ye, Yalin Zheng, Yanda Meng

机构 * University of Exeter(埃克塞特大学) University of Cardiff(卡的夫大学) Shandong University(山东大学) National University of Singapore(新加坡国立大学) Chinese Academy of Sciences(中国科学院) Agency for Science, Technology and Research(科技研究局) University of Liverpool(利物浦大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments MICCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17721 2025-07-08 cs.CV 79%

SeaLion: Semantic Part-Aware Latent Point Diffusion Models for 3D Generation

Dekai Zhu, Yan Di, Stefan Gavranovic, Slobodan Ilic

机构 * Technical University of Munich(慕尼黑技术大学) Siemens AG(西门子股份公司) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏