arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2506.19935 2025-06-26 cs.LG cs.CV stat.ML 79%

Any-Order GPT as Masked Diffusion Model: Decoupling Formulation and Architecture

Shuchen Xue, Tianyu Xie, Tianyang Hu, Zijin Feng, Jiacheng Sun, Kenji Kawaguchi, Zhenguo Li, Zhi-Ming Ma

机构 * University of Chinese Academy of Sciences(中国科学院大学) Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院) School of Mathematical Sciences, Peking University(北京大学数学科学学院) National University of Singapore(新加坡国立大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18270 2025-06-25 eess.IV cs.CV 79%

Adaptive Mask-guided K-space Diffusion for Accelerated MRI Reconstruction

Qinrong Cai, Yu Guan, Zhibo Chen, Dong Liang, Qiuyun Fan, Qiegen Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 10 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15742 2025-06-25 cs.GR 79%

FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space

Black Forest Labs, Stephen Batifol, Andreas Blattmann, Frederic Boesel, Saksham Consul, Cyril Diagne, Tim Dockhorn, Jack English, Zion English, Patrick Esser, Sumith Kulal, Kyle Lacey, Yam Levi, Cheng Li, Dominik Lorenz, Jonas Müller, Dustin Podell, Robin Rombach, Harry Saini, Axel Sauer, Luke Smith

专题命中 扩散模型 :image generation(title,abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18792 2025-06-24 cs.CV 79%

ViDAR: Video Diffusion-Aware 4D Reconstruction From Monocular Inputs

Michal Nazarczuk, Sibi Catley-Chandar, Thomas Tanay, Zhensong Zhang, Gregory Slabaugh, Eduardo Pérez-Pellitero

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) Queen Mary University of London(伦敦大学女王学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18134 2025-06-24 cs.CV 79%

Targeted False Positive Synthesis via Detector-guided Adversarial Diffusion Attacker for Robust Polyp Detection

Quan Zhou, Gan Luo, Qiang Hu, Qingyong Zhang, Jinhua Zhang, Yinjiao Tian, Qiang Li, Zhiwei Wang

机构 * Wuhan University of Technology(武汉理工大学) Huazhong University of Science(华中科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Early Accepted by MICCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17220 2025-06-24 cs.CV 79%

Emergent Temporal Correspondences from Video Diffusion Transformers

Jisu Nam, Soowon Son, Dahyun Chung, Jiyoung Kim, Siyoon Jin, Junhwa Hur, Seungryong Kim

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project page is available at https://cvlab-kaist.github.io/DiffTrack

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16733 2025-06-24 eess.IV cs.CV 79%

A Prior-Guided Joint Diffusion Model in Projection Domain for PET Tracer Conversion

Fang Chen, Weifeng Zhang, Xingyu Ai, BingXuan Li, An Li, Qiegen Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05112 2025-06-24 eess.IV cs.CV 79%

MDAA-Diff: CT-Guided Multi-Dose Adaptive Attention Diffusion Model for PET Denoising

Xiaolong Niu, Zanting Ye, Xu Han, Yanchao Huang, Hao Sun, Hubing Wu, Lijun Lu

机构 * School of Biomedical Engineering, Southern Medical University(南方医科大学生物医学工程学院) School of Biomedical Engineering, Shanghai Jiao Tong University(上海交通大学生物医学工程学院) Nanfang PET Center, Nanfang Hospital Southern Medical University(南方医科大学南芳医院PET中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10631 2025-06-24 cs.CV cs.RO 79%

HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model

Jiaming Liu, Hao Chen, Pengju An, Zhuoyang Liu, Renrui Zhang, Chenyang Gu, Xiaoqi Li, Ziyu Guo, Sixiang Chen, Mengzhen Liu, Chengkai Hou, Mengdi Zhao, KC alex Zhou, Pheng-Ann Heng, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机学院,北京大学) Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院) CUHK(香港中文大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12557 2025-06-24 cs.LG cs.CV 79%

One Step Diffusion via Shortcut Models

Kevin Frans, Danijar Hafner, Sergey Levine, Pieter Abbeel

机构 * UC Berkeley(伯克利大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17140 2025-06-23 eess.IV cs.AI cs.CV 79%

MeDi: Metadata-Guided Diffusion Models for Mitigating Biases in Tumor Classification

David Jacob Drexlin, Jonas Dippel, Julius Hense, Niklas Prenißl, Grégoire Montavon, Frederick Klauschen, Klaus-Robert Müller

机构 * Machine Learning Group, Technische Universität Berlin, Germany The Konrad Zuse School of Excellence in Learning Intelligent Systems (ELIZA), Germany BIFOLD – Berlin Institute for the Foundations of Learning

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17074 2025-06-23 cs.CV 79%

Assembler: Scalable 3D Part Assembly via Anchor Point Diffusion

Wang Zhao, Yan-Pei Cao, Jiale Xu, Yuejiang Dong, Ying Shan

机构 * Tencent ARC Lab(腾讯ARC实验室) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Technical Report. Project page: https://assembler3d.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16934 2025-06-23 eess.IV cs.CV 79%

PET Tracer Separation Using Conditional Diffusion Transformer with Multi-latent Space Learning

Bin Huang, Feihong Xu, Xinchong Shi, Shan Huang, Binxuan Li, Fei Li, Qiegen Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23623 2025-06-23 cs.CV 79%

On Learning Multi-Modal Forgery Representation for Diffusion Generated Video Detection

Xiufeng Song, Xiao Guo, Jiache Zhang, Qirui Li, Lei Bai, Xiaoming Liu, Guangtao Zhai, Xiaohong Liu

机构 * Shanghai Jiao Tong University(上海交通大学) Michigan State University(密歇根州立大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 10 pages, 9 figures, published in NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15748 2025-06-23 eess.IV cs.CV 79%

Diffusion-based Counterfactual Augmentation: Towards Robust and Interpretable Knee Osteoarthritis Grading

Zhe Wang, Yuhua Ru, Aladine Chetouani, Tina Shiang, Fang Chen, Fabian Bauer, Liping Zhang, Didier Hans, Rachid Jennane, William Ewing Palmer, Mohamed Jarraya, Yung Hsin Chen

机构 * Department of Radiology, Harvard Medical School(哈佛医学院放射科) Jiangsu Institute of Hematology, The First Affiliated Hospital of Soochow University(苏州大学第一附属医院江苏血液研究所) L2TI Laboratory, University Sorbonne Paris Nord(巴黎-萨克雷大学L2TI实验室) department of Medical School, Henan University of Chinese Medicine(河南中医药大学医学院) Institute for Diagnostic and Interventional Radiology, Faculty of Medicine and University Hospital Cologne, University of Cologne(科隆大学医学院和科隆大学医院诊断与介入放射学研究所) Department of Electrical and Electronic Engineering, University of Hong Kong(香港大学电子与电气工程系) Nuclear Medicine Division, Geneva University Hospital(日内瓦大学医院核医学科) IDP Institute, UMR CNRS 7013, University of Orleans(奥尔良大学IDP研究所,CNRS UMR 7013)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15218 2025-06-19 cs.CV 79%

DM-FNet: Unified multimodal medical image fusion via diffusion process-trained encoder-decoder

Dan He, Weisheng Li, Guofen Wang, Yuping Huang, Shiqiang Liu

机构 * School of Computer Science and Technology, Chongqing University of Posts and Telecommunications(重庆邮电大学计算机科学与技术学院) Chongqing Key Laboratory of Image Recognition, Chongqing University of Posts and Telecommunications(重庆邮电大学图像识别重点实验室) Key Laboratory of Cyberspace Big Data Intelligent Security (Chongqing University of Posts and Telecommunications), Ministry of Education(教育部重庆邮电大学网络大数据智能安全重点实验室) College of Computer and Information Science, Chongqing Normal University(重庆师范大学计算机与信息科学学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments This paper has been accepted by IEEE Transactions on Multimedia (TMM) in March 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15166 2025-06-19 cs.CV 79%

Echo-DND: A dual noise diffusion model for robust and precise left ventricle segmentation in echocardiography

Abdur Rahman, Keerthiveena Balraj, Manojkumar Ramteke, Anurag Singh Rathore

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Version of record published in Discover Applied Sciences (Springer Nature). The definitive article is available at https://doi.org/10.1007/s42452-025-07055-5

Journal ref Discov Appl Sci 7, 514 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06940 2025-06-19 cs.CV cs.LG 79%

Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think

Sihyun Yu, Sangkyung Kwak, Huiwon Jang, Jongheon Jeong, Jonathan Huang, Jinwoo Shin, Saining Xie

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICLR 2025 (Oral). Project page: https://sihyun.me/REPA

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14322 2025-06-18 cs.CV cs.LG 79%

FRIDU: Functional Map Refinement with Guided Image Diffusion

Avigail Cohen Rimon, Mirela Ben-Chen, Or Litany

机构 * Technion - Israel Institute of Technology(技术学院-以色列理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to SGP 2025 (Symposium on Geometry Processing)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14181 2025-06-18 cs.CV 79%

Meta-SurDiff: Classification Diffusion Model Optimized by Meta Learning is Reliable for Online Surgical Phase Recognition

Yufei Li, Jirui Wu, Long Tian, Liming Wang, Xiaonan Liu, Zijun Liu, Xiyang Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07819 2025-06-18 cs.RO cs.AI cs.CV 79%

H$^3$DP: Triply-Hierarchical Diffusion Policy for Visuomotor Learning

Yiyang Lu, Yufeng Tian, Zhecheng Yuan, Xianbang Wang, Pu Hua, Zhengrong Xue, Huazhe Xu

机构 * Tsinghua University IIIS(清华大学IIIS) Shanghai Qi Zhi Institute(上海启智研究院) Shanghai AI Lab(上海人工智能实验室) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05657 2025-06-18 eess.AS cs.LG cs.MM cs.SD eess.SP 79%

ArrayDPS: Unsupervised Blind Speech Separation with a Diffusion Prior

Zhongweiyang Xu, Xulin Fan, Zhong-Qiu Wang, Xilin Jiang, Romit Roy Choudhury

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Columbia University(哥伦比亚大学) Southern University of Science and Technology(南方科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.MM

Comments Paper Accepted at ICML2025 Demo: https://arraydps.github.io/ArrayDPSDemo/ Code: https://github.com/ArrayDPS/ArrayDPS

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18562 2025-06-18 cs.RO cs.CV cs.LG 79%

DexHandDiff: Interaction-aware Diffusion Planning for Adaptive Dexterous Manipulation

Zhixuan Liang, Yao Mu, Yixiao Wang, Tianxing Chen, Wenqi Shao, Wei Zhan, Masayoshi Tomizuka, Ping Luo, Mingyu Ding

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2025. Camera ready version. Previous DexDiffuser. Project page: https://dexdiffuser.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13667 2025-06-17 eess.IV cs.CV 79%

MultiViT2: A Data-augmented Multimodal Neuroimaging Prediction Framework via Latent Diffusion Model

Bi Yuda, Jia Sihan, Gao Yutong, Abrol Anees, Fu Zening, Calhoun Vince

机构 * Tri-Institutional Center for Translational Research in Neuroimaging and Data Science (TReNDS)(跨机构神经影像与数据科学转化研究中心(TReNDS))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13391 2025-06-17 cs.CV eess.IV 79%

Zero-Shot Solving of Imaging Inverse Problems via Noise-Refined Likelihood Guided Diffusion Models

Zhen Wang, Hongyi Liu, Zhihui Wei

机构 * School of Mathematics and Statistics(数学与统计学学院) Nanjing University of Science and Technology(南京理工大学) School of Computer Science and Engineering(计算机科学与工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12719 2025-06-17 eess.IV cs.CV 79%

GM-LDM: Latent Diffusion Model for Brain Biomarker Identification through Functional Data-Driven Gray Matter Synthesis

Hu Xu, Yang Jingling, Jia Sihan, Bi Yuda, Calhoun Vince

机构 * Anhui University, Hefei, China(安徽大学) TReNDS Center (GSU, Gatech, Emory), Atlanta, GA, USA(TReNDS中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13545 2025-06-17 cs.CV 79%

Limited-Angle CBCT Reconstruction via Geometry-Integrated Cycle-domain Denoising Diffusion Probabilistic Models

Yuan Gao, Shaoyan Pan, Mingzhe Hu, Huiqiao Xie, Jill Remick, Chih-Wei Chang, Justin Roper, Zhen Tian, Xiaofeng Yang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13156 2025-06-17 cs.CV 79%

StgcDiff: Spatial-Temporal Graph Condition Diffusion for Sign Language Transition Generation

Jiashu He, Jiayi He, Shengeng Tang, Huixia Ben, Lechao Cheng, Richang Hong

机构 * Hefei University of Technology(合肥工业大学) Anhui University of Science and Technology(安徽理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06999 2025-06-17 cs.LG cs.AI cs.CV stat.ML 79%

Towards Physics-informed Diffusion for Anomaly Detection in Trajectories

Arun Sharma, Mingzhou Yang, Majid Farhadloo, Subhankar Ghosh, Bharat Jayaprakash, Shashi Shekhar

机构 * University of Minnesota(明尼苏达大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17097 2025-06-17 cs.CV 79%

R2LDM: An Efficient 4D Radar Super-Resolution Framework Leveraging Diffusion Model

Boyuan Zheng, Shouyi Lu, Renbo Huang, Minqing Huang, Fan Lu, Wei Tian, Guirong Zhuo, Lu Xiong

机构 * School of Automotive Studies, Tongji University(汽车学院,同济大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 8 pages, 9 figures, accepted to IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏