arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2503.05082 2025-03-10 cs.CV 79%

Taming Video Diffusion Prior with Scene-Grounding Guidance for 3D Gaussian Splatting from Sparse Inputs

Yingji Zhong, Zhihao Li, Dave Zhenyu Chen, Lanqing Hong, Dan Xu

机构 * The Hong Kong University of Science and Technology(香港科技大学) Huawei Noah’s Ark Lab(华为诺亚方舟实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR2025. The project page is available at https://zhongyingji.github.io/guidevd-3dgs/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.21314 2025-03-10 cs.CV 79%

Raccoon: Multi-stage Diffusion Training with Coarse-to-Fine Curating Videos

Zhiyu Tan, Junyan Wang, Hao Yang, Luozheng Qin, Hesen Chen, Qiang Zhou, Hao Li

机构 * Fudan University(复旦大学) The University of Adelaide(阿德莱德大学) INF Tech(INF科技) Shanghai Academy of Artificial Intelligence for Science(上海科学人工智能研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03790 2025-03-07 q-bio.TO cs.GR eess.IV 79%

DDCSR: A Novel End-to-End Deep Learning Framework for Cortical Surface Reconstruction from Diffusion MRI

Chengjin Li, Yuqian Chen, Nir A. Sochen, Wei Zhang, Carl-Fredrik Westin, Rathi Yogesh, Lauren J. O'Donnell, Ofer Pasternak, Fan Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20637 2025-03-07 cs.CV 79%

TractCloud-FOV: Deep Learning-based Robust Tractography Parcellation in Diffusion MRI with Incomplete Field of View

Yuqian Chen, Leo Zekelman, Yui Lo, Suheyla Cetin-Karayumak, Tengfei Xue, Yogesh Rathi, Nikos Makris, Fan Zhang, Weidong Cai, Lauren J. O'Donnell

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16157 2025-03-07 cs.CV 79%

MVGenMaster: Scaling Multi-View Generation from Any Image via 3D Priors Enhanced Diffusion Model

Chenjie Cao, Chaohui Yu, Shang Liu, Fan Wang, Xiangyang Xue, Yanwei Fu

机构 * Fudan University(复旦大学) DAMO Academy, Alibaba Group(阿里巴巴达摩院) Hupan Lab(湖畔实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR2025. Models and codes will be released at https://github.com/ewrfcas/MVGenMaster/. The project page is at https://ewrfcas.github.io/MVGenMaster/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11505 2025-03-07 cs.CV 79%

LaVin-DiT: Large Vision Diffusion Transformer

Zhaoqing Wang, Xiaobo Xia, Runnan Chen, Dongdong Yu, Changhu Wang, Mingming Gong, Tongliang Liu

机构 * The University of Sydney(悉尼大学) National University of Singapore(新加坡国立大学) The University of Melbourne(墨尔本大学) AIsphere

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 37 pages, 30 figures, 4 tables. Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02942 2025-03-07 cs.LG cs.AI cs.CV 79%

SymmetricDiffusers: Learning Discrete Diffusion on Finite Symmetric Groups

Yongxing Zhang, Donglin Yang, Renjie Liao

机构 * University of Waterloo(滑铁卢大学) University of British Columbia(不列颠哥伦比亚大学) Vector Institute(矢量研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICLR 2025 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18125 2025-03-07 cs.CV cs.AI 79%

Self-supervised pre-training with diffusion model for few-shot landmark detection in x-ray images

Roberto Di Via, Francesca Odone, Vito Paolo Pastore

机构 * University of Genoa(热那亚大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted at WACV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03689 2025-03-06 cs.CV 79%

DualDiff+: Dual-Branch Diffusion for High-Fidelity Video Generation with Reward Guidance

Zhao Yang, Zezhong Qian, Xiaofan Li, Weixiang Xu, Gongpeng Zhao, Ruohong Yu, Lingsi Zhu, Longjun Liu

机构 * College of Optical Science and Engineering, Zhejiang University(浙江大学光电科学与工程学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Science and Technology of China(中国科学技术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03329 2025-03-06 cs.CV physics.med-ph 79%

Deep Learning-Based Diffusion MRI Tractography: Integrating Spatial and Anatomical Information

Yiqiong Yang, Yitian Yuan, Baoxing Ren, Ye Wu, Yanqiu Feng, Xinyuan Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11098 2025-03-06 cs.CV 79%

LAPTOP-Diff: Layer Pruning and Normalized Distillation for Compressing Diffusion Models

Dingkun Zhang, Sijia Li, Chen Chen, Qingsong Xie, Haonan Lu

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) OPPO AI Center(OPPO人工智能中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15050 2025-03-06 cs.CV 79%

Uni-Renderer: Unifying Rendering and Inverse Rendering Via Dual Stream Diffusion

Zhifei Chen, Tianshuo Xu, Wenhang Ge, Leyi Wu, Dongyu Yan, Jing He, Luozhou Wang, Lu Zeng, Shunsi Zhang, Yingcong Chen

机构 * HKUST(GZ)(香港科技大学(广州)) HKUST(香港科技大学) Quwan(曲湾)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02578 2025-03-05 cs.CV cs.RO eess.IV 79%

TS-CGNet: Temporal-Spatial Fusion Meets Centerline-Guided Diffusion for BEV Mapping

Xinying Hong, Siyu Li, Kang Zeng, Hao Shi, Bomin Peng, Kailun Yang, Zhiyong Li

机构 * College of Computer Science and Electronic Engineering, Hunan University(湖南大学计算机与电子工程学院) State Key Laboratory of Extreme Photonics and Instrumentation, Zhejiang University(浙江大学极端光子学与仪器科学国家重点实验室) Hangzhou SurImage Technology Company Ltd.(杭州 SurImage 科技有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments The source code will be publicly available at https://github.com/krabs-H/TS-CGNet

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02345 2025-03-05 quant-ph cs.AI cs.CV cs.LG 79%

CQ CNN: A Hybrid Classical Quantum Convolutional Neural Network for Alzheimer's Disease Detection Using Diffusion Generated and U Net Segmented 3D MRI

Mominul Islam, Mohammad Junayed Hasan, M. R. C. Mahdy

机构 * North South University(北南大学) Johns Hopkins University(约翰斯·霍普金斯大学) Mahdy Research Academy(马赫迪研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Application of hybrid quantum-classical machine learning for (early stage) disease detection

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02261 2025-03-05 eess.IV cs.CV 79%

Volume Tells: Dual Cycle-Consistent Diffusion for 3D Fluorescence Microscopy De-noising and Super-Resolution

Zelin Li, Chenwei Wang, Zhaoke Huang, Yiming MA, Cunmin Zhao, Zhongying Zhao, Hong Yan

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted on CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14801 2025-03-05 cs.CV 79%

AVD2: Accident Video Diffusion for Accident Video Description

Cheng Li, Keyuan Zhou, Tong Liu, Yu Wang, Mingqiao Zhuang, Huan-ang Gao, Bu Jin, Hao Zhao

机构 * Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院(AIR)) Academy of Interdisciplinary Studies, the Hong Kong University of Science and Technology(香港科技大学跨学科研究学院) College of Communication Engineering, Jilin University(吉林大学通信工程学院) School of Cyber Science and Engineering, Nanjing University of Science and Technology(南京理工大学网络空间安全学院) School of Automation, Beijing Institute of Technology(北京理工大学自动化学院) College of Foreign Language and Literature, Fudan University(复旦大学外国语言文学学院) Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院(BAAI)) Lightwheel AI(轻舟智航(Lightwheel AI))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICRA 2025, Project Page: https://an-answer-tree.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11619 2025-03-05 cs.CV 79%

Membership Inference Attacks for Face Images Against Fine-Tuned Latent Diffusion Models

Lauritz Christian Holme, Anton Mosquera Storgaard, Siavash Arjomand Bigdeli

机构 * Technical University of Denmark(丹麦技术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments In Proceedings of the 20th International Joint Conference on Computer Vision, Imaging and Computer Graphics Theory and Applications (VISIGRAPP 2025) - Volume 2: VISAPP, pages 439-446

Journal ref In Proceedings of VISAPP 2025, ISBN 978-989-758-728-3, ISSN 2184-4321, pages 439-446 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03153 2025-03-05 cs.LG cs.CV 79%

An Efficient Framework for Crediting Data Contributors of Diffusion Models

Chris Lin, Mingyu Lu, Chanwoo Kim, Su-In Lee

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01774 2025-03-04 cs.CV 79%

Difix3D+: Improving 3D Reconstructions with Single-Step Diffusion Models

Jay Zhangjie Wu, Yuxuan Zhang, Haithem Turki, Xuanchi Ren, Jun Gao, Mike Zheng Shou, Sanja Fidler, Zan Gojcic, Huan Ling

机构 * NVIDIA(英伟达) National University of Singapore(新加坡国立大学) University of Toronto(多伦多大学) Vector Institute(矢量研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01352 2025-03-04 eess.IV cs.CV 79%

Diffusion-based Virtual Staining from Polarimetric Mueller Matrix Imaging

Xiaoyu Zheng, Jing Wen, Jiaxin Zhuang, Yao Du, Jing Cong, Limei Guo, Chao He, Lin Luo, Hao Chen

机构 * The Hong Kong University of Science and Technology(香港科技大学) Beijing Institute of Collaborative Innovation(北京协同创新研究院) Peking University Health Science Center(北京大学医学部) University of Oxford(牛津大学) Peking University(北京大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01288 2025-03-04 cs.CV 79%

Reconciling Stochastic and Deterministic Strategies for Zero-shot Image Restoration using Diffusion Model in Dual

Chong Wang, Lanqing Guo, Zixuan Fu, Siyuan Yang, Hao Cheng, Alex C. Kot, Bihan Wen

机构 * Nanyang Technological University(南洋理工大学) The University of Texas at Austin(德克萨斯大学奥斯汀分校) Hebei University of Technology(河北工业大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01187 2025-03-04 cs.CV 79%

DifIISR: A Diffusion Model with Gradient Guidance for Infrared Image Super-Resolution

Xingyuan Li, Zirui Wang, Yang Zou, Zhixin Chen, Jun Ma, Zhiying Jiang, Long Ma, Jinyuan Liu

机构 * Dalian University of Technology(大连理工大学) Northwestern Polytechnical University(西北工业大学) Waseda University(早稻田大学) Dalian Maritime University(大连海事大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments This paper was accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00951 2025-03-04 cs.LG cs.CV 79%

Dynamical Diffusion: Learning Temporal Dynamics with Diffusion Models

Xingzhuo Guo, Yu Zhang, Baixu Chen, Haoran Xu, Jianmin Wang, Mingsheng Long

机构 * BNRist, Tsinghua University(清华大学BNRist)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICLR 2025 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20108 2025-03-04 cs.CV cs.RO 79%

VDT-Auto: End-to-end Autonomous Driving with VLM-Guided Diffusion Transformers

Ziang Guo, Konstantin Gubernatorov, Selamawit Asfaw, Zakhar Yagudin, Dzmitry Tsetserukou

机构 * Skolkovo Institute of Science and Technology(斯科尔科沃科学技术研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Submitted paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19454 2025-03-04 cs.GR 79%

TransVDM: Motion-Constrained Video Diffusion Model for Transparent Video Synthesis

Menghao Li, Zhenghao Zhang, Junchao Liao, Long Qin, Weizhi Wang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19047 2025-03-04 cs.CV 79%

A Dual-Purpose Framework for Backdoor Defense and Backdoor Amplification in Diffusion Models

Vu Tuan Truong, Long Bao Le

机构 * INRS, University of Québec(魁北克大学INRS)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03990 2025-03-04 cs.RO cs.CV cs.LG 79%

ET-SEED: Efficient Trajectory-Level SE(3) Equivariant Diffusion Policy

Chenrui Tie, Yue Chen, Ruihai Wu, Boxuan Dong, Zeyi Li, Chongkai Gao, Hao Dong

机构 * Peking University(北京大学) National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accept to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15259 2025-03-04 cs.CV cs.AI 79%

StarVid: Enhancing Semantic Alignment in Video Diffusion Models via Spatial and SynTactic Guided Attention Refocusing

Yuanhang Li, Qi Mao, Lan Chen, Zhen Fang, Lei Tian, Xinyan Xiao, Libiao Jin, Hua Wu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07002 2025-03-04 cs.CV cs.LG 79%

AdvLogo: Adversarial Patch Attack against Object Detectors based on Diffusion Models

Boming Miao, Chunxiao Li, Yao Zhu, Weixiang Sun, Zizhe Wang, Xiaoyi Wang, Chuanlong Xie

机构 * Beijing Normal University(北京师范大学) Tsinghua University(清华大学) Northeastern University(东北大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04465 2025-03-04 cs.CV 79%

FitDiff: Robust monocular 3D facial shape and reflectance estimation using Diffusion Models

Stathis Galanakis, Alexandros Lattas, Stylianos Moschoglou, Stefanos Zafeiriou

机构 * Imperial College London(伦敦帝国学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏