arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70196 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70196 篇

2509.22636 2025-09-29 cs.CV cs.LG 79%

Scale-Wise VAR is Secretly Discrete Diffusion

Amandeep Kumar, Nithin Gopalakrishnan Nair, Vishal M. Patel

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Technical Reports

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22323 2025-09-29 cs.CV 79%

RAPID^3: Tri-Level Reinforced Acceleration Policies for Diffusion Transformer

Wangbo Zhao, Yizeng Han, Zhiwei Tang, Jiasheng Tang, Pengfei Zhou, Kai Wang, Bohan Zhuang, Zhangyang Wang, Fan Wang, Yang You

机构 * National University of Singapore(新加坡国立大学) DAMO Academy, Alibaba Group(阿里巴巴集团达摩院) Hupan Lab(鸿篇实验室) ZIP Lab, Zhejiang University(浙江大学ZIP实验室) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22049 2025-09-29 eess.IV cs.CV cs.LG 79%

Comparative Analysis of GAN and Diffusion for MRI-to-CT translation

Emily Honey, Anders Helbo, Jens Petersen

机构 * Department of Computer Science, University of Copenhagen, Copenhagen, Denmark(哥本哈根大学计算机科学系) Department of Oncology, Rigshospitalet, Copenhagen, Denmark(哥本哈根医院肿瘤科)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21565 2025-09-29 cs.CV cs.AI cs.LG 79%

No Alignment Needed for Generation: Learning Linearly Separable Representations in Diffusion Models

Junno Yun, Yaşar Utku Alçalar, Mehmet Akçakaya

机构 * Department of Electrical & Computer Engineering, University of Minnesota(电气与计算机工程系,明尼苏达大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17427 2025-09-29 cs.CV 79%

Single-Image Depth from Defocus with Coded Aperture and Diffusion Posterior Sampling

Hodaka Kawachi, Jose Reinaldo Cunha Santos A. V. Silva Neto, Yasushi Yagi, Hajime Nagahara, Tomoya Nakamura

机构 * SANKEN, The University of Osaka(SANKEN,大阪大学) The University of Osaka(大阪大学) D3 center, The University of Osaka(D3中心,大阪大学) Graduate School of Engineering Science, The University of Osaka(工程科学研究院,大阪大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17560 2025-09-29 cs.CV 79%

Deeper Diffusion Models Amplify Bias

Shahin Hakemi, Naveed Akhtar, Ghulam Mubashar Hassan, Ajmal Mian

机构 * The University of Western Australia(西澳大学) The University of Melbourne(墨尔本大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00220 2025-09-29 cs.LG cs.AI cs.CV 79%

Can Diffusion Models Disentangle? A Theoretical Perspective

Liming Wang, Muhammad Jehanzeb Mirza, Yishu Gong, Yuan Gong, Jiaqi Zhang, Brian H. Tracey, Katerina Placek, Marco Vilela, James R. Glass

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07385 2025-09-29 cs.CV 79%

LOGen: Toward Lidar Object Generation by Point Diffusion

Ellington Kirby, Mickael Chen, Renaud Marlet, Nermin Samet

机构 * LIGM, Ecole des Ponts, Univ Gustave Eiffel, CNRS(LIGM,巴黎理工学院,埃菲尔大学,CNRS)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments BMVC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10014 2025-09-29 cs.CV eess.IV 79%

Frequency-Domain Refinement with Multiscale Diffusion for Super Resolution

Xingjian Wang, Li Chai, Jiming Chen

机构 * Zhejiang University, College of Control Science and Engineering(浙江大学控制科学与工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20927 2025-09-26 cs.CV 79%

SimDiff: Simulator-constrained Diffusion Model for Physically Plausible Motion Generation

Akihisa Watanabe, Jiawei Ren, Li Siyao, Yichen Peng, Erwin Wu, Edgar Simo-Serra

机构 * Waseda University(早稻田大学) Nanyang Technological University(南洋理工大学) Institute of Science Tokyo(东京科学研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04127 2025-09-26 cs.CV 79%

Diff-Reg v2: Diffusion-Based Matching Matrix Estimation for Image Matching and 3D Registration

Qianliang Wu, Haobo Jiang, Yaqing Ding, Lei Luo, Jun Li, Jin Xie, Xiaojun Wu, Jian Yang

机构 * PCA Lab, Key Lab of Intelligent Perception and Systems for High-Dimensional Information of Ministry of Education, School of Computer Science and Engineering, Nanjing University of Science and Technology(PCA实验室、教育部高维信息智能感知与系统重点实验室、计算机科学与工程学院、南京理工大学) Nanyang Technological University(南洋理工大学) Visual Recognition Group, Faculty of Electrical Engineering, Czech Technical University in Prague(视觉识别组、电气工程学院、布拉格捷克技术大学) School of Artificial Intelligence and Computer Science, Jiangnan University(人工智能与计算机科学学院、江南大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments arXiv admin note: text overlap with arXiv:2403.19919

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20091 2025-09-25 cs.CV 79%

Unleashing the Potential of the Semantic Latent Space in Diffusion Models for Image Dehazing

Zizheng Yang, Hu Yu, Bing Li, Jinghao Zhang, Jie Huang, Feng Zhao

机构 * MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition(脑启发式智能感知与认知联合实验室) University of Science and Technology of China(中国科学技术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19638 2025-09-25 cs.LG cs.CV 79%

TIMED: Adversarial and Autoregressive Refinement of Diffusion-Based Time Series Generation

MohammadReza EskandariNasab, Shah Muhammad Hamdi, Soukaina Filali Boubrahimi

机构 * School of Computing, Utah State University(计算学院,犹他州立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to the IEEE International Conference on Data Mining (ICDM) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07772 2025-09-25 cs.CV 79%

From Slow Bidirectional to Fast Autoregressive Video Diffusion Models

Tianwei Yin, Qiang Zhang, Richard Zhang, William T. Freeman, Fredo Durand, Eli Shechtman, Xun Huang

机构 * MIT(麻省理工学院) Adobe(Adobe公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025. Project Page: https://causvid.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10716 2025-09-24 cs.CV 79%

SpinMeRound: Consistent Multi-View Identity Generation Using Diffusion Models

Stathis Galanakis, Alexandros Lattas, Stylianos Moschoglou, Bernhard Kainz, Stefanos Zafeiriou

机构 * Imperial College London(伦敦帝国学院) FAU Erlangen–Nürnberg(埃森哲-纽伦堡大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18917 2025-09-24 cs.CV cs.AI 79%

LiDAR Point Cloud Image-based Generation Using Denoising Diffusion Probabilistic Models

Amirhesam Aghanouri, Cristina Olaverri-Monreal

机构 * Johannes Kepler University Linz(约翰·凯撒大学林茨) Department Intelligent Transport Systems(智能交通系统部门)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18502 2025-09-24 cs.CV 79%

Source-Free Domain Adaptive Semantic Segmentation of Remote Sensing Images with Diffusion-Guided Label Enrichment

Wenjie Liu, Hongmin Liu, Lixin Zhang, Bin Fan

机构 * School of Intelligence Science and Technology, University of Science and Technology Beijing(智能科学与技术学院,科学技术大学) Institute of Artificial Intelligence, University of Science and Technology Beijing(人工智能研究院,科学技术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17993 2025-09-24 cs.CV 79%

StableGuard: Towards Unified Copyright Protection and Tamper Localization in Latent Diffusion Models

Haoxin Yang, Bangzhen Liu, Xuemiao Xu, Cheng Xu, Yuyang Yu, Zikai Huang, Yi Wang, Shengfeng He

机构 * South China University of Technology(南方科技大学) Singapore Management University(新加坡国立管理学院) Dongguan University of Technology(东莞大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08908 2025-09-24 cs.CV 79%

Diffusion-Based Action Recognition Generalizes to Untrained Domains

Rogerio Guimaraes, Frank Xiao, Pietro Perona, Markus Marks

机构 * California Institute of Technology(加州理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project page: https://www.vision.caltech.edu/actiondiff. Code: https://github.com/frankyaoxiao/ActionDiff

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20429 2025-09-24 cs.CV 79%

Latent Beam Diffusion Models for Generating Visual Sequences

Guilherme Fernandes, Vasco Ramos, Regev Cohen, Idan Szpektor, João Magalhães

机构 * NOVA LINCS, NOVA School of Science and Technology(NOVA LINCS、NOVA科学与技术学校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19200 2025-09-24 cs.CV 79%

HDM: Hybrid Diffusion Model for Unified Image Anomaly Detection

Zekang Weng, Jinjin Shi, Jinwei Wang, Zeming Han

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments The paper is withdrawn owing to issues found in the experimental results

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10211 2025-09-24 cs.CV 79%

DiffusionBlend: Learning 3D Image Prior through Position-aware Diffusion Score Blending for 3D Computed Tomography Reconstruction

Bowen Song, Jason Hu, Zhaoxu Luo, Jeffrey A. Fessler, Liyue Shen

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Journal ref Neural Information Processing Systems (NeurIPS), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02462 2025-09-24 cs.CV cs.AI 79%

Learning Image Priors through Patch-based Diffusion Models for Solving Inverse Problems

Jason Hu, Bowen Song, Xiaojian Xu, Liyue Shen, Jeffrey A. Fessler

机构 * Department of Electrical and Computer Engineering University of Michigan(电气与计算机工程系 华盛顿大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Journal ref Neural Information Processing Systems (NeurIPS), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17985 2025-09-23 cs.GR 79%

VideoFrom3D: 3D Scene Video Generation via Complementary Image and Video Diffusion Models

Geonung Kim, Janghyeok Han, Sunghyun Cho

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

Comments Project page: https://kimgeonung.github.io/VideoFrom3D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17941 2025-09-23 cs.RO cs.AI cs.CV cs.LG 79%

ComposableNav: Instruction-Following Navigation in Dynamic Environments via Composable Diffusion

Zichao Hu, Chen Tang, Michael J. Munje, Yifeng Zhu, Alex Liu, Shuijing Liu, Garrett Warnell, Peter Stone, Joydeep Biswas

机构 * Department of Computer Science, The University of Texas at Austin(德克萨斯大学计算机科学系) Army Research Laboratory(陆军研究实验室) Sony AI(索尼人工智能)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Conference on Robot Learning (CoRL) 2025 Project site: https://amrl.cs.utexas.edu/ComposableNav/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17684 2025-09-23 cs.CV cs.RO 79%

DINOv3-Diffusion Policy: Self-Supervised Large Visual Model for Visuomotor Diffusion Policy Learning

ThankGod Egbe, Peng Wang, Zhihao Guo, Zidong Chen

机构 * Department of Computing and Mathematics, Manchester Metropolitan University(计算与数学系,曼彻斯特 Metropolitan 大学) Department of Computing, Imperial College London(计算系,帝国理工学院伦敦分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17627 2025-09-23 cs.CV 79%

OmniInsert: Mask-Free Video Insertion of Any Reference via Diffusion Transformer Models

Jinshu Chen, Xinghui Li, Xu Bai, Tianxiang Ma, Pengze Zhang, Zhuowei Chen, Gen Li, Lijie Liu, Songtao Zhao, Bingchuan Li, Qian He

机构 * Intelligent Creation Lab, ByteDance(字节跳动智能创作实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Github Page: https://phantom-video.github.io/OmniInsert/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17397 2025-09-23 cs.CV cs.ET 79%

Diff-GNSS: Diffusion-based Pseudorange Error Estimation

Jiaqi Zhu, Shouyi Lu, Ziyao Li, Guirong Zhuo, Lu Xiong

机构 * School of Automotive Studies, Tongji University(同济大学汽车学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17232 2025-09-23 cs.CV 79%

DT-NeRF: A Diffusion and Transformer-Based Optimization Approach for Neural Radiance Fields in 3D Reconstruction

Bo Liu, Runlong Li, Li Zhou, Yan Zhou

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17206 2025-09-23 cs.CV cs.AI cs.LG 79%

Guided and Unguided Conditional Diffusion Mechanisms for Structured and Semantically-Aware 3D Point Cloud Generation

Gunner Stone, Sushmita Sarker, Alireza Tavakkoli

机构 * Department of Computer Science Engineering, University of Nevada, Reno, USA

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏