arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86872 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2509.06579 2025-09-09 cs.CV 79%

CausNVS: Autoregressive Multi-view Diffusion for Flexible 3D Novel View Synthesis

Xin Kong, Daniel Watson, Yannick Strümpler, Michael Niemeyer, Federico Tombari

机构 * Imperial College London(伦敦帝国学院) Google DeepMind(谷歌DeepMind) Google(谷歌) Technical University of Munich(慕尼黑技术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13087 2025-09-09 cs.CV 79%

DiffOSeg: Omni Medical Image Segmentation via Multi-Expert Collaboration Diffusion Model

Han Zhang, Xiangde Luo, Yong Chen, Kang Li

机构 * West China Biomedical Big Data Center(西昌生物医学大数据中心) West China Hospital(西昌医院) Sichuan University(四川大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16714 2025-09-09 cs.CV cs.AI 79%

Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models

Huijie Liu, Jingyun Wang, Shuai Ma, Jie Hu, Xiaoming Wei, Guoliang Kang

机构 * Beihang University(北航大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 8 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03355 2025-09-09 cs.CV 79%

TASR: Timestep-Aware Diffusion Model for Image Super-Resolution

Qinwei Lin, Xiaopeng Sun, Yu Gao, Yujie Zhong, Dengjie Li, Zheng Zhao, Haoqian Wang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Meituan Inc.(美团公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to ACM MM2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19508 2025-09-09 eess.IV cs.CV cs.LG 79%

Fairness-Aware Data Augmentation for Cardiac MRI using Text-Conditioned Diffusion Models

Grzegorz Skorupko, Richard Osuala, Zuzanna Szafranowska, Kaisar Kushibar, Vien Ngoc Dang, Nay Aung, Steffen E Petersen, Karim Lekadir, Polyxeni Gkontra

机构 * Barcelona Artificial Intelligence in Medicine Lab (BCN-AIM)(巴塞罗那人工智能在医学实验室(BCN-AIM)) Departament de Matemàtiques i Informàtica, Universitat de Barcelona, Spain(数学与计算机科学系,巴塞罗那大学,西班牙) Helmholtz Center Munich(海德堡研究中心慕尼黑) Technical University of Munich(慕尼黑技术大学) William Harvey Research Institute, NIHR Barts Biomedical Research Centre, Queen Mary University London, Charterhouse Square, London, UK(威廉·哈维研究所,英国国家健康研究院巴特研究所,伦敦女王玛丽大学,查尔斯广场,伦敦,英国) Barts Heart Centre, St Bartholomew’s Hospital, Barts Health NHS Trust, West Smithfield, London, UK(巴特心脏中心,圣巴塞洛缪医院,巴特健康国家卫生信托,西史密斯菲尔德,伦敦,英国) Institució Catalana de Recerca i Estudis Avançats (ICREA)(加泰罗尼亚高级研究与教育研究所(ICREA))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05321 2025-09-09 cs.CV cs.AI 79%

A Dataset Generation Scheme Based on Video2EEG-SPGN-Diffusion for SEED-VD

Yunfei Guo, Tao Zhang, Wu Huang, Yao Song

机构 * Chengdu Techman Software Co., Ltd.(成都技漫软件有限公司) Sichuan University(四川大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01837 2025-09-09 cs.CV 79%

PractiLight: Practical Light Control Using Foundational Diffusion Models

Yotam Erel, Rishabh Dabral, Vladislav Golyanik, Amit H. Bermano, Christian Theobalt

机构 * Tel Aviv University(特拉维夫大学) Max Planck Institute for Informatics(马克斯·普朗克信息研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project page: https://yoterel.github.io/PractiLight-project-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12103 2025-09-09 cs.CV cs.CY 79%

DeepShade: Enable Shade Simulation by Text-conditioned Image Generation

Longchao Da, Xiangrui Liu, Mithun Shivakoti, Thirulogasankar Pranav Kutralingam, Yezhou Yang, Hua Wei

机构 * Arizona State University(亚利桑那州立大学)

专题命中 扩散模型 :image generation(title);diffusion(abstract);分类 cs.CV

Comments 7pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19757 2025-09-09 cs.RO cs.CV 79%

Dita: Scaling Diffusion Transformer for Generalist Vision-Language-Action Policy

Zhi Hou, Tianyi Zhang, Yuwen Xiong, Haonan Duan, Hengjun Pu, Ronglei Tong, Chengyang Zhao, Xizhou Zhu, Yu Qiao, Jifeng Dai, Yuntao Chen

机构 * Shanghai AI Lab(上海人工智能实验室) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab) Peking University(北京大学) SenseTime Research(商汤科技研究院) Tsinghua University(清华大学) HKISI, CAS(中国科学院香港中文大学研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Preprint; https://robodita.github.io; To appear in ICCV2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16897 2025-09-08 eess.IV cs.CV physics.med-ph 79%

Generating Synthetic Contrast-Enhanced Chest CT Images from Non-Contrast Scans Using Slice-Consistent Brownian Bridge Diffusion Network

Pouya Shiri, Xin Yi, Neel P. Mistry, Samaneh Javadinia, Mohammad Chegini, Seok-Bum Ko, Amirali Baniasadi, Scott J. Adams

机构 * Department of Medical Imaging, University of Saskatchewan(医学成像系,萨斯喀彻温大学) Department of Electrical and Computer Engineering, University of Saskatchewan(电气与计算机工程系,萨斯喀彻温大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04193 2025-09-05 cs.CV cs.LG 79%

DUDE: Diffusion-Based Unsupervised Cross-Domain Image Retrieval

Ruohong Yang, Peng Hu, Yunfan Li, Xi Peng

专题命中 扩散模型 :diffusion(title);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03794 2025-09-05 cs.CV 79%

Fitting Image Diffusion Models on Video Datasets

Juhun Lee, Simon S. Woo

机构 * Dept. of Artificial Intelligence(人工智能系) Sungkyungwan University(顺天妇女大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICCV25 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20789 2025-09-05 cs.CV cs.LG 79%

Integrating Intermediate Layer Optimization and Projected Gradient Descent for Solving Inverse Problems with Diffusion Models

Yang Zheng, Wen Li, Zhaoqiang Liu

机构 * uestc(电子科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09885 2025-09-05 cs.SD cs.CV eess.AS 79%

Separate to Collaborate: Dual-Stream Diffusion Model for Coordinated Piano Hand Motion Synthesis

Zihao Liu, Mingwen Ou, Zunnan Xu, Jiaqi Huang, Haonan Han, Ronghui Li, Xiu Li

机构 * Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 15 pages, 7 figures, Accepted to ACMMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14891 2025-09-05 cs.CV cs.AI 79%

CoDiff: Conditional Diffusion Model for Collaborative 3D Object Detection

Zhe Huang, Shuo Wang, Yongcai Wang, Lei Wang

机构 * School of future Transportation, Chang’an University(未来交通学院,长安大学) School of information, Renmin University of China(信息学院,中国人民大学) Hangzhou International Innovation Institute, Beihang University(杭州国际创新研究院,北航) University of Wollongong(沃林戈大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01919 2025-09-04 cs.CV cs.PF 79%

A Diffusion-Based Framework for Configurable and Realistic Multi-Storage Trace Generation

Seohyun Kim, Junyoung Lee, Jongho Park, Jinhyung Koo, Sungjin Lee, Yeseong Kim

机构 * DGIST POSTECH

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03324 2025-09-04 cs.CV 79%

InfraDiffusion: zero-shot depth map restoration with diffusion models and prompted segmentation from sparse infrastructure point clouds

Yixiong Jing, Cheng Zhang, Haibing Wu, Guangming Wang, Olaf Wysocki, Brian Sheil

机构 * Construction Engineering, University of Cambridge(剑桥大学建筑工程系) College of Civil Engineering, Hunan University(湖南大学土木工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03267 2025-09-04 cs.CV 79%

SynBT: High-quality Tumor Synthesis for Breast Tumor Segmentation by 3D Diffusion Model

Hongxu Yang, Edina Timko, Levente Lippenszky, Vanda Czipczer, Lehel Ferenczi

机构 * Science \& Technology Org. AI \& ML, GE HealthCare, Eindhoven, Netherlands Science \& Technology Org. AI \& ML, GE HealthCare, Budapest, Hungary

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by MICCAI 2025 Deep-Breath Workshop. Supported by IHI SYNTHIA project

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03141 2025-09-04 cs.CV cs.LG 79%

Temporally-Aware Diffusion Model for Brain Progression Modelling with Bidirectional Temporal Regularisation

Mattia Litrico, Francesco Guarnera, Mario Valerio Giuffrida, Daniele Ravì, Sebastiano Battiato

机构 * University of Catania(卡塔尼亚大学) University of Nottingham(诺丁汉大学) University of Messina(梅萨尼亚大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03114 2025-09-04 cs.CV 79%

Towards Realistic Hand-Object Interaction with Gravity-Field Based Diffusion Bridge

Miao Xu, Xiangyu Zhu, Xusheng Liang, Zidu Wang, Jinlin Wu, Zhen Lei

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Centre for Artificial Intelligence and Robotics, Hong Kong Institute of Science(香港科学院人工智能与机器人中心) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) China Mobile Financial Technology Co., Ltd.(中国移动金融科技有限公司) School of Computer Science and Engineering, the Faculty of Innovation Engineering, M.U.S.T(澳门科技大学计算机科学与工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06656 2025-09-04 cs.CV cs.LG 79%

Enhancing Diffusion Model Stability for Image Restoration via Gradient Management

Hongjie Wu, Mingqin Zhang, Linchao He, Ji-Zhe Zhou, Jiancheng Lv

机构 * College of Computer Science, Sichuan University(四川大学计算机学院) National Key Laboratory of Fundamental Science on Synthetic Vision, Sichuan University(合成视觉基础科学国家重点实验室(四川大学)) Engineering Research Center of Machine Learning(机器学习工程研究中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02357 2025-09-03 cs.CV 79%

Category-Aware 3D Object Composition with Disentangled Texture and Shape Multi-view Diffusion

Zeren Xiong, Zikun Chen, Zedong Zhang, Xiang Li, Ying Tai, Jian Yang, Jun Li

机构 * Nanjing University of Science and Technology(南京理工大学) Nankai University(南开大学) Nanjing University(南京大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02099 2025-09-03 cs.CV 79%

A Data-Centric Approach to Pedestrian Attribute Recognition: Synthetic Augmentation via Prompt-driven Diffusion Models

Alejandro Alonso, Sawaiz A. Chaudhry, Juan C. SanMiguel, Álvaro García-Martín, Pablo Ayuso-Albizu, Pablo Carballeira

机构 * Autonomous University of Madrid(马德里自主大学) University of Bordeaux(波尔多大学) Pázmány Péter Catholic University(帕兹曼·彼得天主教大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Paper Acepted at AVSS 2025 conference. Best paper award

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01864 2025-09-03 cs.CV 79%

Latent Gene Diffusion for Spatial Transcriptomics Completion

Paula Cárdenas, Leonardo Manrique, Daniela Vega, Daniela Ruiz, Pablo Arbeláez

机构 * Center for Research and Formation in Artificial Intelligence(人工智能研究与培训中心) Universidad de los Andes(andes大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 10 pages, 8 figures. Accepted to CVAMD Workshop, ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01177 2025-09-03 cs.CV cs.AI cs.HC eess.SP 79%

DynaMind: Reconstructing Dynamic Visual Scenes from EEG by Aligning Temporal Dynamics and Multimodal Semantics to Guided Diffusion

Junxiang Liu, Junming Lin, Jiangtong Li, Jie Li

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22459 2025-09-03 cs.CV 79%

Exploiting Diffusion Prior for Task-driven Image Restoration

Jaeha Kim, Junghun Oh, Kyoung Mu Lee

机构 * Dept. of ECE&ASRI(电子工程与先进科学研究院部) IPAI(人工智能研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to ICCV 2025. Code is available at https://github.com/JaehaKim97/EDTR

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21541 2025-09-03 cs.CV cs.AI 79%

DiffDecompose: Layer-Wise Decomposition of Alpha-Composited Images via Diffusion Transformers

Zitong Wang, Hang Zhao, Qianyu Zhou, Xuequan Lu, Xiangtai Li, Yiren Song

机构 * Jilin University(吉林大学) University of Western Australia(西澳大学) Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12470 2025-09-03 cs.CV 79%

SC-Diff: 3D Shape Completion with Latent Diffusion Models

Simon Schaefer, Juan D. Galvis, Xingxing Zuo, Stefan Leutengger

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) ETH Zurich(苏黎世联邦理工学院) MBZUAI(穆桑比克大学人工智能研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00843 2025-09-03 cs.CV cs.AI 79%

Look Beyond: Two-Stage Scene View Generation via Panorama and Video Diffusion

Xueyang Kang, Zhengkang Xiang, Zezheng Zhang, Kourosh Khoshelham

机构 * University of Melbourne(墨尔本大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 26 pages, 30 figures, 2025 ACM Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00395 2025-09-03 cs.CV 79%

Double-Constraint Diffusion Model with Nuclear Regularization for Ultra-low-dose PET Reconstruction

Mengxiao Geng, Ran Hong, Bingxuan Li, Qiegen Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏