arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70196 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70196 篇

2509.11661 2025-09-16 cs.CV cs.AI 79%

DTGen: Generative Diffusion-Based Few-Shot Data Augmentation for Fine-Grained Dirty Tableware Recognition

Lifei Hao, Yue Cheng, Baoqi Huang, Bing Jia, Xuandong Zhao

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11628 2025-09-16 cs.LG cs.AI cs.CV 79%

SpeCa: Accelerating Diffusion Transformers with Speculative Feature Caching

Jiacheng Liu, Chang Zou, Yuanhuiyi Lyu, Fei Ren, Shaobo Wang, Kaixin Li, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Shandong University(山东大学) University of Electronic Science and Technology of China(电子科学与技术大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Tsinghua University(清华大学) National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 15 pages, 9 figures, ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10913 2025-09-16 cs.LG cs.CV 79%

Robustifying Diffusion-Denoised Smoothing Against Covariate Shift

Ali Hedayatnia, Mostafa Tavassolipour, Babak Nadjar Araabi, Abdol-Hossein Vahabie

机构 * Department of Electrical and Computer Engineering, University of Tehran, Tehran, Iran(电子与计算机工程系,德黑兰大学,德黑兰,伊朗)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10845 2025-09-16 cs.CL cs.MM 79%

Text2Sign Diffusion: A Generative Approach for Gloss-Free Sign Language Production

Liqian Feng, Lintao Wang, Kun Hu, Dehui Kong, Zhiyong Wang

机构 * School of Computer Science(计算机科学学院) School of Science(科学学院) Faculty of Information Technology(信息技术学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10824 2025-09-16 cs.CV 79%

Multi-Task Diffusion Approach For Prediction of Glioma Tumor Progression

Aghiles Kebaili, Romain Modzelewski, Jérôme Lapuyade-Lahorgue, Maxime Fontanilles, Sébastien Thureau, Su Ruan

机构 * AIMS Lab, Quantif, University of Rouen-Normandy(AIMS实验室、Quantif、鲁昂-诺曼底大学) LITIS Lab UR 4108, University of Rouen-Normandy(LITIS实验室UR 4108、鲁昂-诺曼底大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13776 2025-09-16 eess.IV cs.AI cs.CV 79%

Comparing Conditional Diffusion Models for Synthesizing Contrast-Enhanced Breast MRI from Pre-Contrast Images

Sebastian Ibarra, Javier del Riego, Alessandro Catanese, Julian Cuba, Julian Cardona, Nataly Leon, Jonathan Infante, Karim Lekadir, Oliver Diaz, Richard Osuala

机构 * Departament de Matemàtiques i Informàtica, Universitat de Barcelona, Spain(巴塞罗那大学数学与计算机系) Parc Taulí Hospital Universitari, Spain(帕尔克·塔利大学医院) Hospital Germans Trias i Pujol, Spain(加泰罗尼亚Trias i Pujol医院) Siemens Healthineers, America, LAM(西门子医疗) Institució Catalana de Recerca i Estudis Avançats (ICREA), Barcelona, Spain(加泰罗尼亚高级研究与教育研究所) Computer Vision Center, Bellaterra, Spain(计算机视觉中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 13 pages, 5 figures, submitted and accepted to MICCAI Deepbreath workshop 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09880 2025-09-15 eess.IV cs.AI cs.CV cs.LG physics.med-ph 79%

Automated Tuning for Diffusion Inverse Problem Solvers without Generative Prior Retraining

Yaşar Utku Alçalar, Junno Yun, Mehmet Akçakaya

机构 * Department of Electrical \& Computer Engineering, University of Minnesota, MN, USA Center for Magnetic Resonance Research, University of Minnesota, MN, USA

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments IEEE International Workshop on Computational Advances in Multi-Sensor Adaptive Processing (CAMSAP), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09547 2025-09-12 cs.CV cs.AI 79%

Improving Video Diffusion Transformer Training by Multi-Feature Fusion and Alignment from Self-Supervised Vision Encoders

Dohun Lee, Hyeonho Jeong, Jiwook Kim, Duygu Ceylan, Jong Chul Ye

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 17 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09456 2025-09-12 cs.CV 79%

FlexiD-Fuse: Flexible number of inputs multi-modal medical image fusion based on diffusion model

Yushen Xu, Xiaosong Li, Yuchun Wang, Xiaoqi Cheng, Huafeng Li, Haishu Tan

机构 * School of Physics(物理学院) Optoelectronic Engineering, Foshan University(光电工程学院,佛山大学) Guangdong-HongKong-Macao Joint Laboratory for Intelligent Micro-Nano Optoelectronic Technology(粤港澳联合智能微纳光电技术实验室) Guangdong Provincial Key Laboratory of Industrial Intelligent Inspection Technology(广东省工业智能检测技术重点实验室) School of Information Engineering(信息工程学院) Automation, Kunming University of Science(自动化系,昆明理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Journal ref Expert Systems with Applications, 2025: 128895

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09365 2025-09-12 cs.CV 79%

Plug-and-play Diffusion Models for Image Compressive Sensing with Data Consistency Projection

Xiaodong Wang, Ping Wang, Zhangyuan Li, Xin Yuan

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23538 2025-09-12 cs.CV cs.AI cs.LG 79%

Uncertainty-aware Diffusion and Reinforcement Learning for Joint Plane Localization and Anomaly Diagnosis in 3D Ultrasound

Yuhao Huang, Yueyue Xu, Haoran Dou, Jiaxiao Deng, Xin Yang, Hongyu Zheng, Dong Ni

机构 * Medical Ultrasound Image Computing (MUSIC) Lab, School of Biomedical Engineering, Medical School, Shenzhen University, Shenzhen, China The People’s Hospital of Guangxi Zhuang Autonomous Region, Nanning, China Centre for CIMIM, Manchester University, Manchester, UK School of Artificial Intelligence, Shenzhen University, Shenzhen, China National Engineering Laboratory for Big Data System Computing Technology, Shenzhen University, Shenzhen, China School of Biomedical Engineering Informatics, Nanjing Medical University, Nanjing, China

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by MICCAI 2025;10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08442 2025-09-11 cs.CV cs.AI cs.LG q-bio.NC 79%

Spherical Brownian Bridge Diffusion Models for Conditional Cortical Thickness Forecasting

Ivan Stoyanov, Fabian Bongratz, Christian Wachinger

机构 * Lab for AI in Medical Imaging, Technical University of Munich, Munich, Germany(人工智能医学影像实验室,慕尼黑技术大学,慕尼黑,德国) Munich Center for Machine Learning, Munich, Germany(慕尼黑机器学习中心,慕尼黑,德国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08376 2025-09-11 cs.CV 79%

Bitrate-Controlled Diffusion for Disentangling Motion and Content in Video

Xiao Li, Qi Chen, Xiulian Peng, Kai Yu, Xie Chen, Yan Lu

机构 * Microsoft Research Asia(微软亚洲研究院) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06932 2025-09-11 cs.RO cs.CV 79%

LLaDA-VLA: Vision Language Diffusion Action Models

Yuqing Wen, Hebei Li, Kefan Gu, Yucheng Zhao, Tiancai Wang, Xiaoyan Sun

机构 * University of Science and Technology of China(中国科学技术大学) Nanjing University(南京大学) Dexmal Project Page(Dexmal项目页)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01137 2025-09-11 cs.CV 79%

TextSSR: Diffusion-based Data Synthesis for Scene Text Recognition

Xingsong Ye, Yongkun Du, Yunbo Tao, Zhineng Chen

机构 * College of Computer Science and Artificial Intelligence, Fudan University, China(计算机科学与人工智能学院,复旦大学) Institute of Trustworthy Embodied AI, Fudan University, China(可信具身人工智能研究院,复旦大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07920 2025-09-10 cs.CV 79%

ScoreHOI: Physically Plausible Reconstruction of Human-Object Interaction via Score-Guided Diffusion

Ao Li, Jinpeng Liu, Yixuan Zhu, Yansong Tang

机构 * Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07484 2025-09-10 cs.CV 79%

LINR Bridge: Vector Graphic Animation via Neural Implicits and Video Diffusion Priors

Wenshuo Gao, Xicheng Lan, Luyao Zhang, Shuai Yang

机构 * Wangxuan Institute of Computer Technology, State Key Laboratory of Multimedia Information Processing, \ University, Beijing, China Wangxuan Institute of Computer Technology, State Key Laboratory of Multimedia Information Processing, Peking University, Beijing, China

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 5 pages, ICIPW 2025, Website: https://gaowenshuo.github.io/LINR-bridge/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07277 2025-09-10 cs.CV cs.AI 79%

Breast Cancer Detection in Thermographic Images via Diffusion-Based Augmentation and Nonlinear Feature Fusion

Sepehr Salem, M. Moein Esfahani, Jingyu Liu, Vince Calhoun

机构 * Computer Science Department Center for Translational Research in Neuroimaging(计算机科学系转化神经影像与数据科学中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to IEEE-EMBS International Conference on Biomedical and Health Informatics (BHI 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05323 2025-09-10 cs.AI cs.MM 79%

Attention of a Kiss: Exploring Attention Maps in Video Diffusion for XAIxArts

Adam Cole, Mick Grierson

机构 * University of the Arts London(伦敦艺术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.MM

Comments 3rd international workshop on eXplainable AI for the Arts (XAIxArts) at the ACM Creativity and Cognition Conference June 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10803 2025-09-10 cs.RO cs.CV cs.LG 79%

Generalizable Humanoid Manipulation with 3D Diffusion Policies

Yanjie Ze, Zixuan Chen, Wenhao Wang, Tianyi Chen, Xialin He, Ying Yuan, Xue Bin Peng, Jiajun Wu

机构 * Stanford University(斯坦福大学) Simon Fraser University(西蒙 Fraser大学) UPenn(宾夕法尼亚大学) UIUC(伊利诺伊大学香槟分校) CMU(卡内基梅隆大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments IROS 2025. Project website: https://humanoid-manipulation.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08883 2025-09-10 cs.CV 79%

TractGraphFormer: Anatomically Informed Hybrid Graph CNN-Transformer Network for Interpretable Sex and Age Prediction from Diffusion MRI Tractography

Yuqian Chen, Fan Zhang, Meng Wang, Leo R. Zekelman, Suheyla Cetin-Karayumak, Tengfei Xue, Chaoyi Zhang, Yang Song, Jarrett Rushmore, Nikos Makris, Yogesh Rathi, Weidong Cai, Lauren J. O'Donnell

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 27 pages, 5 figures

Journal ref Medical Image Analysis (2025): 103476

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02346 2025-09-10 cs.CV cs.LG 79%

Closed-Loop Unsupervised Representation Disentanglement with $β$-VAE Distillation and Diffusion Probabilistic Feedback

Xin Jin, Bohan Li, BAAO Xie, Wenyao Zhang, Jinming Liu, Ziqiang Li, Tao Yang, Wenjun Zeng

机构 * Ningbo Institute of Digital Twin, Eastern Institute of Technology(宁波数字孪生研究所、东部技术研究所) Shanghai Jiao Tong University(上海交通大学) Xi’an Jiaotong University(西安交通大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00247 2025-09-10 cs.CV eess.IV 79%

Probing the Limits and Capabilities of Diffusion Models for the Anatomic Editing of Digital Twins

Karim Kadry, Shreya Gupta, Farhad R. Nezami, Elazer R. Edelman

机构 * MIT(麻省理工学院) Brigham and Women’s Hospital(布里奇沃特医院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06693 2025-09-09 cs.CV 79%

STAGE: Segmentation-oriented Industrial Anomaly Synthesis via Graded Diffusion with Explicit Mask Alignment

Xichen Xu, Yanshu Wang, Jinbao Wang, Qunyi Zhang, Xiaoning Lei, Guoyang Xie, Guannan Jiang, Zhichao Lu

机构 * Global Institute of Future Technology, Shanghai Jiao Tong University(未来技术全球研究院,上海交通大学) School of Artificial Intelligence, Shenzhen University(人工智能学院,深圳大学) Department of Intelligent Manufacturing, CATL(智能制造部门,CATL) Department of Computer Science, City University of Hong Kong(计算机科学系,香港城市大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06579 2025-09-09 cs.CV 79%

CausNVS: Autoregressive Multi-view Diffusion for Flexible 3D Novel View Synthesis

Xin Kong, Daniel Watson, Yannick Strümpler, Michael Niemeyer, Federico Tombari

机构 * Imperial College London(伦敦帝国学院) Google DeepMind(谷歌DeepMind) Google(谷歌) Technical University of Munich(慕尼黑技术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13087 2025-09-09 cs.CV 79%

DiffOSeg: Omni Medical Image Segmentation via Multi-Expert Collaboration Diffusion Model

Han Zhang, Xiangde Luo, Yong Chen, Kang Li

机构 * West China Biomedical Big Data Center(西昌生物医学大数据中心) West China Hospital(西昌医院) Sichuan University(四川大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16714 2025-09-09 cs.CV cs.AI 79%

Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models

Huijie Liu, Jingyun Wang, Shuai Ma, Jie Hu, Xiaoming Wei, Guoliang Kang

机构 * Beihang University(北航大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 8 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03355 2025-09-09 cs.CV 79%

TASR: Timestep-Aware Diffusion Model for Image Super-Resolution

Qinwei Lin, Xiaopeng Sun, Yu Gao, Yujie Zhong, Dengjie Li, Zheng Zhao, Haoqian Wang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Meituan Inc.(美团公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to ACM MM2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19508 2025-09-09 eess.IV cs.CV cs.LG 79%

Fairness-Aware Data Augmentation for Cardiac MRI using Text-Conditioned Diffusion Models

Grzegorz Skorupko, Richard Osuala, Zuzanna Szafranowska, Kaisar Kushibar, Vien Ngoc Dang, Nay Aung, Steffen E Petersen, Karim Lekadir, Polyxeni Gkontra

机构 * Barcelona Artificial Intelligence in Medicine Lab (BCN-AIM)(巴塞罗那人工智能在医学实验室(BCN-AIM)) Departament de Matemàtiques i Informàtica, Universitat de Barcelona, Spain(数学与计算机科学系,巴塞罗那大学,西班牙) Helmholtz Center Munich(海德堡研究中心慕尼黑) Technical University of Munich(慕尼黑技术大学) William Harvey Research Institute, NIHR Barts Biomedical Research Centre, Queen Mary University London, Charterhouse Square, London, UK(威廉·哈维研究所,英国国家健康研究院巴特研究所,伦敦女王玛丽大学,查尔斯广场,伦敦,英国) Barts Heart Centre, St Bartholomew’s Hospital, Barts Health NHS Trust, West Smithfield, London, UK(巴特心脏中心,圣巴塞洛缪医院,巴特健康国家卫生信托,西史密斯菲尔德,伦敦,英国) Institució Catalana de Recerca i Estudis Avançats (ICREA)(加泰罗尼亚高级研究与教育研究所(ICREA))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05321 2025-09-09 cs.CV cs.AI 79%

A Dataset Generation Scheme Based on Video2EEG-SPGN-Diffusion for SEED-VD

Yunfei Guo, Tao Zhang, Wu Huang, Yao Song

机构 * Chengdu Techman Software Co., Ltd.(成都技漫软件有限公司) Sichuan University(四川大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏