arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2405.15364 2025-04-03 cs.CV 79%

NVS-Solver: Video Diffusion Model as Zero-Shot Novel View Synthesizer

Meng You, Zhiyu Zhu, Hui Liu, Junhui Hou

机构 * City University of Hong Kong(香港城市大学) Saint Francis University(圣弗朗西斯大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01019 2025-04-02 cs.CV 79%

MixerMDM: Learnable Composition of Human Motion Diffusion Models

Pablo Ruiz-Ponce, German Barquero, Cristina Palmero, Sergio Escalera, José García-Rodríguez

机构 * Universidad de Alicante(阿利坎特大学) Universitat de Barcelona(巴塞罗那大学) Computer Vision Center(计算机视觉中心) King’s College London(伦敦国王学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025 Accepted - Project Page: https://pabloruizponce.com/papers/MixerMDM

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00952 2025-04-02 cs.LG cs.AI cs.CV 79%

Personalized Federated Training of Diffusion Models with Privacy Guarantees

Kumar Kshitij Patel, Weitong Zhang, Lingxiao Wang

机构 * TTIC(芝加哥丰田技术学院) UNC Chapel Hill(北卡罗来纳大学教堂山分校) NJIT(新泽西理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00562 2025-04-02 cs.MM 79%

Diffusion Model-Based Size Variable Virtual Try-On Technology and Evaluation Method

Shufang Zhang, Hang Qian, Minxue Ni, Yaxuan Li, Wenxin Ding, Jun Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00430 2025-04-02 cs.CV 79%

Data Synthesis with Diverse Styles for Face Recognition via 3DMM-Guided Diffusion

Yuxi Mi, Zhizhou Zhong, Yuge Huang, Qiuyang Yuan, Xuan Zhao, Jianqing Xu, Shouhong Ding, ShaoMing Wang, Rizen Guo, Shuigeng Zhou

机构 * Fudan University(复旦大学) Tencent(腾讯)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00380 2025-04-02 cs.CV 79%

Hierarchical Flow Diffusion for Efficient Frame Interpolation

Yang Hai, Guo Wang, Tan Su, Wenjie Jiang, Yinlin Hu

机构 * Insta360 Research(影石创新研究院) MagicLeap(魔力跳跃公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00264 2025-04-02 eess.IV cs.CV stat.ML 79%

DiffDenoise: Self-Supervised Medical Image Denoising with Conditional Diffusion Models

Basar Demir, Yikang Liu, Xiao Chen, Eric Z. Chen, Lin Zhao, Boris Mailhe, Terrence Chen, Shanhui Sun

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) United Imaging Intelligence(联影智能)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00191 2025-04-02 cs.CV 79%

Leveraging Diffusion Model and Image Foundation Model for Improved Correspondence Matching in Coronary Angiography

Lin Zhao, Xin Yu, Yikang Liu, Xiao Chen, Eric Z. Chen, Terrence Chen, Shanhui Sun

机构 * United Imaging Intelligence(联影智能) Vanderbilt University(范德堡大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00026 2025-04-02 eess.IV cs.AI cs.CV 79%

Diffusion models applied to skin and oral cancer classification

José J. M. Uliana, Renato A. Krohling

机构 * Federal University of Espírito Santo(圣埃斯皮里图联邦大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23796 2025-04-02 cs.CV 79%

On-device Sora: Enabling Training-Free Diffusion-based Text-to-Video Generation for Mobile Devices

Bosung Kim, Kyuhwan Lee, Isu Jeong, Jungmin Cheon, Yeojin Lee, Seulki Lee

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Replicated Submission. arXiv:2502.04363 submitted as second version of the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03397 2025-04-02 cs.CV 79%

DoubleDiffusion: Combining Heat Diffusion with Denoising Diffusion for Texture Generation on 3D Meshes

Xuyang Wang, Ziang Cheng, Zhenyu Li, Jiayu Yang, Haorui Ji, Pan Ji, Mehrtash Harandi, Richard Hartley, Hongdong Li

机构 * The Australian National University(澳大利亚国立大学) Tencent XR Lab(腾讯XR实验室) King Abdullah University of Science and Technology(阿卜杜拉国王科技大学) Monash University(莫纳什大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Codes: https://github.com/Wxyxixixi/DoubleDiffusion_3D_Mesh

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16308 2025-04-02 cs.CV 79%

An End-to-End Robust Point Cloud Semantic Segmentation Network with Single-Step Conditional Diffusion Models

Wentao Qu, Jing Wang, YongShun Gong, Xiaoshui Huang, Liang Xiao

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04738 2025-04-02 cs.CV 79%

Diffusion Models in 3D Vision: A Survey

Zhen Wang, Dongyuan Li, Yaozu Wu, Tianyu He, Jiang Bian, Renhe Jiang

机构 * Centre for Spatial Information Science, University of Tokyo(东京大学空间信息科学中心) Microsoft Research Asia (MSRA)(微软亚洲研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03463 2025-04-02 cs.LG cs.AI cs.CV 79%

Diffusion State-Guided Projected Gradient for Inverse Problems

Rayhan Zirvi, Bahareh Tolooshams, Anima Anandkumar

机构 * California Institute of Technology(加州理工学院) Computing and Mathematical Sciences(计算与数学科学学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Published as a conference paper at ICLR 2025. RZ and BT have equal contributions

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23893 2025-04-01 cs.LG cs.AI cs.CV eess.IV 79%

DiffScale: Continuous Downscaling and Bias Correction of Subseasonal Wind Speed Forecasts using Diffusion Models

Maximilian Springenberg, Noelia Otero, Yuxin Xue, Jackie Ma

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 28 pages, 18 figures, preprint under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23888 2025-04-01 cs.CV cs.AI 79%

MuseFace: Text-driven Face Editing via Diffusion-based Mask Generation Approach

Xin Zhang, Siting Huang, Xiangyang Luo, Yifan Xie, Weijiang Yu, Heng Chang, Fei Ma, Fei Yu

机构 * Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳)) Sun Yat-sen University(中山大学) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 6 pages, 5 figures,IEEE International Conference on Multimedia & Expo 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18589 2025-04-01 cs.CV 79%

Unified Uncertainty-Aware Diffusion for Multi-Agent Trajectory Modeling

Guillem Capellera, Antonio Rubio, Luis Ferraz, Antonio Agudo

机构 * Institut de Robòtica i Informàtica Industrial, CSIC-UPC(机器人与工业自动化研究所(西班牙国家研究委员会-加泰罗尼亚理工大学)) Kognia Sports Intelligence(Kognia体育智能公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to CVPR 2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04363 2025-04-01 cs.CV 79%

On-device Sora: Enabling Training-Free Diffusion-based Text-to-Video Generation for Mobile Devices

Bosung Kim, Kyuhwan Lee, Isu Jeong, Jungmin Cheon, Yeojin Lee, Seulki Lee

机构 * Ulsan National Institute of Science and Technology(蔚山科学技术院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11903 2025-04-01 cs.CV 79%

DiHuR: Diffusion-Guided Generalizable Human Reconstruction

Jinnan Chen, Chen Li, Gim Hee Lee

机构 * National University of Singapore(新加坡国立大学) Agency for Science, Technology and Research(新加坡科技研究局)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to WACV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18456 2025-04-01 physics.optics cs.CV 79%

Diffusion-driven lensless fiber endomicroscopic quantitative phase imaging towards digital pathology

Zhaoqing Chen, Jiawei Sun, Xibin Yang, Xinyi Ye, Bin Zhao, Xuelong Li, Juergen Czarske

机构 * Shanghai Research Institute for Intelligent Autonomous Systems, Tongji University(同济大学上海智能自主系统研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Suzhou Institute of Biomedical Engineering and Technology, Chinese Academy of Sciences(中国科学院苏州生物医学工程技术研究所) School of Artificial Intelligence, OPtics and ElectroNics (iOPEN), Northwestern Polytechnical University(西北工业大学人工智能与光电子学院) Institute of Artificial Intelligence (TeleAI), China Telecom Corp Ltd(中国电信股份有限公司人工智能研究院) Competence Center for Biomedical Computational Laser Systems (BIOLAS), TU Dresden(德累斯顿工业大学生物医学计算激光系统能力中心) Laboratory of Measurement and Sensor System Technique (MST), TU Dresden(德累斯顿工业大学测量与传感器系统技术实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11923 2025-04-01 cs.CV 79%

IPAD: Iterative, Parallel, and Diffusion-based Network for Scene Text Recognition

Xiaomeng Yang, Zhi Qiao, Yu Zhou

机构 * Nankai University(南开大学) Tomorrow Advancing Life

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by IJCV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22563 2025-03-31 eess.IV cs.CV 79%

RELD: Regularization by Latent Diffusion Models for Image Restoration

Pasquale Cascarano, Lorenzo Stacchio, Andrea Sebastiani, Alessandro Benfenati, Ulugbek S. Kamilov, Gustavo Marfia

机构 * University of Bologna(博洛尼亚大学) University of Macerata(马切拉塔大学) University of Modena and Reggio Emilia(摩德纳大学与雷焦艾米利亚大学) University of Milan(米兰大学) Washington University in St. Louis(圣路易斯华盛顿大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22138 2025-03-31 cs.SD cs.CV eess.AS 79%

Enhancing Dance-to-Music Generation via Negative Conditioning Latent Diffusion Model

Changchang Sun, Gaowen Liu, Charles Fleming, Yan Yan

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) Cisco Research(思科研究)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22019 2025-03-31 cs.CV 79%

AGILE: A Diffusion-Based Attention-Guided Image and Label Translation for Efficient Cross-Domain Plant Trait Identification

Earl Ranario, Lars Lundqvist, Heesup Yun, Brian N. Bailey, J. Mason Earles

机构 * University of California, Davis(加利福尼亚大学戴维斯分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21907 2025-03-31 cs.CV 79%

KernelFusion: Assumption-Free Blind Super-Resolution via Patch Diffusion

Oliver Heinimann, Assaf Shocher, Tal Zimbalist, Michal Irani

机构 * Weizmann Institute of Science(魏茨曼科学研究所) NVIDIA Research(英伟达研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21823 2025-03-31 cs.CV 79%

Low-Rank Adaptation of Pre-Trained Stable Diffusion for Rigid-Body Target ISAR Imaging

Boan Zhang, Hang Dong, Jiongge Zhang, Long Tian, Rongrong Wang, Zhenhua Wu, Xiyang Liu, Hongwei Liu

机构 * Xidian University(西安电子科技大学) Anhui University(安徽大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 4 pages, IGARSS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17221 2025-03-31 cs.CV 79%

UniCon: Unidirectional Information Flow for Effective Control of Large-Scale Diffusion Models

Fanghua Yu, Jinjin Gu, Jinfan Hu, Zheyuan Li, Chao Dong

机构 * Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Shenzhen University of Advanced Technology(深圳理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments This work has been accepted for publication at the International Conference on Learning Representations (ICLR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05226 2025-03-31 cs.CV cs.LG 79%

Light Transport-aware Diffusion Posterior Sampling for Single-View Reconstruction of 3D Volumes

Ludwic Leonard, Nils Thuerey, Ruediger Westermann

机构 * Technical University of Munich(慕尼黑工业大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21581 2025-03-28 cs.CV cs.AI 79%

AlignDiff: Learning Physically-Grounded Camera Alignment via Diffusion

Liuyue Xie, Jiancong Guo, Ozan Cakmakci, Andre Araujo, Laszlo A. Jeni, Zhiheng Jia

机构 * Carnegie Mellon University(卡内基梅隆大学) Google(谷歌) Google DeepMind(谷歌DeepMind)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21410 2025-03-28 cs.CV 79%

Diffusion Image Prior

Hamadi Chihaoui, Paolo Favaro

机构 * University of Bern(伯尔尼大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏