arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2506.11496 2025-06-16 eess.IV cs.CV 79%

Taming Stable Diffusion for Computed Tomography Blind Super-Resolution

Chunlei Li, Yilei Shi, Haoxi Hu, Jingliang Hu, Xiao Xiang Zhu, Lichao Mou

机构 * MedAI Technology (Wuxi) Co. Ltd.(MedAI技术(无锡)有限公司) Northeastern University(东北大学) Technical University of Munich(慕尼黑技术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11454 2025-06-16 eess.IV cs.CV 79%

FAD-Net: Frequency-Domain Attention-Guided Diffusion Network for Coronary Artery Segmentation using Invasive Coronary Angiography

Nan Mu, Ruiqi Song, Xiaoning Li, Zhihui Xu, Jingfeng Jiang, Chen Zhao

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 35 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11444 2025-06-16 cs.CR cs.CV 79%

GaussMarker: Robust Dual-Domain Watermark for Diffusion Models

Kecen Li, Zhicong Huang, Xinwen Hou, Cheng Hong

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted at ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11183 2025-06-16 eess.IV cs.CV 79%

DiffPR: Diffusion-Based Phase Reconstruction via Frequency-Decoupled Learning

Yi Zhang

机构 * Institude of Data Science, University of Hong Kong(数据科学研究所,香港大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10955 2025-06-13 cs.LG cs.AI cs.CV 79%

ReGuidance: A Simple Diffusion Wrapper for Boosting Sample Quality on Hard Inverse Problems

Aayush Karan, Kulin Shah, Sitan Chen

机构 * Harvard SEAS(哈佛大学SEAS) UT Austin(得克萨斯大学奥斯汀分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 38 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10712 2025-06-13 cs.CV 79%

Uncertainty-Masked Bernoulli Diffusion for Camouflaged Object Detection Refinement

Yuqi Shen, Fengyang Xiao, Sujie Hu, Youwei Pang, Yifan Pu, Chengyu Fang, Xiu Li, Chunming He

机构 * Tsinghua University(清华大学) Duke University(杜克大学) Dalian University of Technology(大连理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10576 2025-06-13 cs.CV 79%

Harmonizing Geometry and Uncertainty: Diffusion with Hyperspheres

Muskan Dosi, Chiranjeev Chiranjeev, Kartik Thakral, Mayank Vatsa, Richa Singh

机构 * Department of Computer Science and Engineering, Indian Institute of Technology Jodhpur, India(计算机科学与工程系,印度理工学院贾尔普尔)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10391 2025-06-13 cs.CV 79%

ReconMOST: Multi-Layer Sea Temperature Reconstruction with Observations-Guided Diffusion

Yuanyi Song, Pumeng Lyu, Ben Fei, Fenghua Ling, Wanli Ouyang, Lei Bai

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16057 2025-06-13 cs.CV cs.AI cs.LG 79%

Expert Race: A Flexible Routing Strategy for Scaling Diffusion Transformer with Mixture of Experts

Yike Yuan, Ziyu Wang, Zihao Huang, Defa Zhu, Xun Zhou, Jingyi Yu, Qiyang Min

机构 * ShanghaiTech University(上海科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09955 2025-06-12 cs.LG cs.CV 79%

Canonical Latent Representations in Conditional Diffusion Models

Yitao Xu, Tong Zhang, Ehsan Pajouheshgar, Sabine Süsstrunk

机构 * Image and Visual Representation Lab(图像与视觉表示实验室) École polytechnique fédérale de Lausanne(洛桑联邦理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 45 pages,41 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22685 2025-06-12 eess.IV cs.AI cs.CV 79%

DeepMultiConnectome: Deep Multi-Task Prediction of Structural Connectomes Directly from Diffusion MRI Tractography

Marcus J. Vroemen, Yuqian Chen, Yui Lo, Tengfei Xue, Weidong Cai, Fan Zhang, Josien P. W. Pluim, Lauren J. O'Donnell

机构 * Eindhoven University of Technology(埃因霍温理工大学) Brigham and Women’s Hospital(布莱尔妇女医院) Harvard Medical School(哈佛医学院) The University of Sydney(悉尼大学) University of Electronic Science and Technology of China(电子科技大学) Harvard-MIT Health Sciences and Technology(哈佛-麻省理工健康科学与技术)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08529 2025-06-11 cs.CV 79%

LiftVSR: Lifting Image Diffusion to Video Super-Resolution via Hybrid Temporal Modeling with Only 4$\times$RTX 4090s

Xijun Wang, Xin Li, Bingchen Li, Zhibo Chen

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project page: https://kopperx.github.io/projects/liftvsr

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08351 2025-06-11 cs.CV cs.AI cs.CL 79%

How Much To Guide: Revisiting Adaptive Guidance in Classifier-Free Guidance Text-to-Vision Diffusion Models

Huixuan Zhang, Junzhe Zhang, Xiaojun Wan

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王玄计算技术研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07280 2025-06-11 cs.CV cs.AI 79%

From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models

Pablo Acuaviva, Aram Davtyan, Mariam Hassan, Sebastian Stapf, Ahmad Rahimi, Alexandre Alahi, Paolo Favaro

机构 * University of Bern(伯恩大学) EPFL(瑞士联邦理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 27 pages, 23 figures, 9 tables. Project page: https://pabloacuaviva.github.io/Gen2Gen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07549 2025-06-11 cs.CV 79%

STeP: A Framework for Solving Scientific Video Inverse Problems with Spatiotemporal Diffusion Priors

Bingliang Zhang, Zihui Wu, Berthy T. Feng, Yang Song, Yisong Yue, Katherine L. Bouman

机构 * California Institute of Technology(加利福尼亚理工学院) OpenAI

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19339 2025-06-11 cs.LG cs.AI cs.CV 79%

Towards a Mechanistic Explanation of Diffusion Model Generalization

Matthew Niedoba, Berend Zwartsenberg, Kevin Murphy, Frank Wood

机构 * University of British Columbia(不列颠哥伦比亚大学) Alberta Machine Intelligence Institute(阿尔伯塔机器智能研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICML 2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07841 2025-06-10 cs.CV cs.AI 79%

Diffusion models under low-noise regime

Elizabeth Pavlova, Xue-Xin Wei

机构 * Department of Computer Science The University of Texas at Austin(计算机科学系 德克萨斯大学奥斯汀分校) Department of Neuroscience The University of Texas at Austin(神经科学系 德克萨斯大学奥斯汀分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07698 2025-06-10 cs.CV cs.AI 79%

NOVA3D: Normal Aligned Video Diffusion Model for Single Image to 3D Generation

Yuxiao Yang, Peihao Li, Yuhong Zhang, Junzhe Lu, Xianglong He, Minghan Qin, Weitao Wang, Haoqian Wang

机构 * Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 8 pages, 7 figures, accepted by ICME 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07489 2025-06-10 cs.CV 79%

Drive Any Mesh: 4D Latent Diffusion for Mesh Deformation from Video

Yahao Shi, Yang Liu, Yanmin Wu, Xing Liu, Chen Zhao, Jie Luo, Bin Zhou

机构 * State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(虚拟现实技术与系统国家重点实验室,北京航空航天大学) School of Electronic and Computer Engineering, Peking University(电子与计算机工程学院,北京大学) Baidu VIS(百度VIS)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04116 2025-06-10 eess.IV cs.AI cs.CV 79%

A Diffusion-Driven Temporal Super-Resolution and Spatial Consistency Enhancement Framework for 4D MRI imaging

Xuanru Zhou, Jiarun Liu, Shoujun Yu, Hao Yang, Cheng Li, Tao Tan, Shanshan Wang

机构 * Paul C. Lauterbur Research Center for Biomedical Imaging(保罗·C·劳特伯生物医学成像研究中心) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Pengcheng Laboratory(鹏城实验室) Faculty of Applied Sciences, Macao Polytechnic University(澳门理工学院应用科学学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05153 2025-06-10 cs.CV 79%

Hummingbird: High Fidelity Image Generation via Multimodal Context Alignment

Minh-Quan Le, Gaurav Mittal, Tianjian Meng, A S M Iftekhar, Vishwas Suryanarayanan, Barun Patra, Dimitris Samaras, Mei Chen

机构 * Microsoft(微软公司) Stony Brook University(史蒂文尼森布鲁克大学)

专题命中 扩散模型 :image generation(title);diffusion(abstract);分类 cs.CV

Comments Accepted to ICLR 2025. Project page with code release: https://roar-ai.github.io/hummingbird

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00603 2025-06-10 cs.CV cs.LG 79%

DiC: Rethinking Conv3x3 Designs in Diffusion Models

Yuchuan Tian, Jing Han, Chengcheng Wang, Yuchen Liang, Chao Xu, Hanting Chen

机构 * State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(通用人工智能国家重点实验室,智能科学与技术学院,北京大学) School of Artificial Intelligence, Beijing University of Posts and Telecommunications(人工智能学院,北京邮电大学) Huawei Noah’s Ark Lab(华为诺亚实验室) School of Mathematical Sciences, Peking University(数学科学学院,北京大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21842 2025-06-10 cs.CV cs.AI 79%

Diffusion as Reasoning: Enhancing Object Navigation via Diffusion Model Conditioned on LLM-based Object-Room Knowledge

Yiming Ji, Kaijie Yun, Yang Liu, Zhengpu Wang, Boyu Ma, Zongwu Xie, Hong Liu

机构 * State Key Laboratory of Robotics and Systems, Harbin Institute of Technology, Harbin 150001, China(机器人系统国家重点实验室,哈尔滨工业大学,哈尔滨) School of Mechanical and Aerospace Engineering, Nanyang Technological University, Singapore 639798, Singapore(机械与航空航天工程学院,南洋理工大学,新加坡)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03283 2025-06-10 cs.CR cs.AI cs.CV 79%

Black-Box Forgery Attacks on Semantic Watermarks for Diffusion Models

Andreas Müller, Denis Lukovnikov, Jonas Thietke, Asja Fischer, Erwin Quiring

机构 * Ruhr University Bochum(博尔塔尔大学博德姆)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025

Journal ref Proc. IEEE/CVF Conf. on Computer Vision and Pattern Recognition (CVPR), 2025, pp. 20937-20946

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00228 2025-06-10 cs.CV 79%

Synthetic Face Datasets Generation via Latent Space Exploration from Brownian Identity Diffusion

David Geissbühler, Hatef Otroshi Shahreza, Sébastien Marcel

机构 * Idiap Research Institute, Martigny, Switzerland \' E cole Polytechnique F\' e d\' e rale de Lausanne (EPFL), Lausanne, Switzerland

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted in ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.12940 2025-06-10 stat.ML cs.CV cs.LG 79%

Neural Flow Diffusion Models: Learnable Forward Process for Improved Diffusion Modelling

Grigory Bartosh, Dmitry Vetrov, Christian A. Naesseth

机构 * University of Amsterdam(阿姆斯特丹大学) Constructor University(Constructor大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06018 2025-06-09 cs.MM cs.AI cs.CR 79%

Optimization-Free Universal Watermark Forgery with Regenerative Diffusion Models

Chaoyi Zhu, Zaitang Li, Renyi Yang, Robert Birke, Pin-Yu Chen, Tsung-Yi Ho, Lydia Y. Chen

机构 * Delft University of Technology(代尔夫特理工大学) The Chinese University of Hong Kong(香港中文大学) University of Neuchâtel(Neuchâtel大学) University of Turin(都灵大学) IBM Research(IBM研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05806 2025-06-09 cs.CV 79%

LLIA -- Enabling Low-Latency Interactive Avatars: Real-Time Audio-Driven Portrait Video Generation with Diffusion Models

Haojie Yu, Zhaonian Wang, Yihan Pan, Meng Cheng, Hao Yang, Chao Wang, Tao Xie, Xiaoming Xu, Xiaoming Wei, Xunliang Cai

机构 * Meituan Inc.(美团公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21577 2025-06-09 cs.MM 79%

Latent Feature-Guided Conditional Diffusion for Generative Image Semantic Communication

Zehao Chen, Xinfeng Wei, Haonan Tong, Zhaohui Yang, Changchuan Yin

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.MM

Comments 6 pages, 6 figures, update title

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06805 2025-06-09 cs.LG cs.GR 79%

Efficient Diffusion Models: A Survey

Hui Shen, Jingxuan Zhang, Boning Xiong, Rui Hu, Shoufa Chen, Zhongwei Wan, Xin Wang, Yu Zhang, Zixuan Gong, Guangyin Bao, Chaofan Tao, Yongfeng Huang, Ye Yuan, Mi Zhang

机构 * The Ohio State University(俄亥俄州立大学) Indiana University(印第安纳大学) Fudan University(复旦大学) Hangzhou City University(杭州城市大学) The University of Hong Kong(香港大学) Tongji University(同济大学) The Chinese University of Hong Kong(香港中文大学) Peking University(北京大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

Comments Published in Transactions on Machine Learning Research (TMLR-2025)

详情

展开后加载摘要…

URL PDF HTML 收藏