arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2507.16341 2025-07-23 cs.CV 79%

Navigating Large-Pose Challenge for High-Fidelity Face Reenactment with Video Diffusion Model

Mingtao Guo, Guanyu Xing, Yanci Zhang, Yanli Liu

机构 * National Key Laboratory of Fundamental Science on Synthetic Vision, Sichuan University, Chengdu, 610065, China(合成视觉基础科学国家重点实验室,四川大学,成都,610065,中国) School of Cyber Science and Engineering, Sichuan University, Chengdu, 610065, China(网络科学与工程学院,四川大学,成都,610065,中国) College of Computer Science, Sichuan University, Chengdu, 610065, China(计算机科学学院,四川大学,成都,610065,中国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19848 2025-07-23 cs.CV 79%

One-for-More: Continual Diffusion Model for Anomaly Detection

Xiaofan Li, Xin Tan, Zhuo Chen, Zhizhong Zhang, Ruixin Zhang, Rizen Guo, Guannan Jiang, Yulong Chen, Yanyun Qu, Lizhuang Ma, Yuan Xie

机构 * East China Normal University(东华师范大学) Shanghai Innovation Institute(上海创新研究院) Xiamen University(厦门大学) Shanghai Jiao Tong University(上海交通大学) Tencent YouTu Lab(腾讯YouTu实验室) Tencent WeChatPay Lab33(腾讯微信支付实验室) CATL(宁德时代) Key Laboratory of Multimedia Trusted Perception and Efficient Computing Ministry of Education of China(教育部多媒体可信感知与高效计算重点实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13684 2025-07-23 cs.CV 79%

FiVE: A Fine-grained Video Editing Benchmark for Evaluating Emerging Diffusion and Rectified Flow Models

Minghan Li, Chenxi Xie, Yichen Wu, Lei Zhang, Mengyu Wang

机构 * Harvard AI and Robotics Lab, Harvard University(哈佛人工智能与机器人实验室,哈佛大学) Broad Institute(博德研究所) Hong Kong Polytechnic University(香港理工大学) School of Engineering and Applied Sciences, Harvard University(哈佛大学工程与应用科学学院) City University of Hong Kong(香港城市大学) Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University(自然与人工智能研究学院,哈佛大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 24 pages, 14 figures, 16 tables

Journal ref ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06132 2025-07-23 cs.CV 79%

USP: Unified Self-Supervised Pretraining for Image Generation and Understanding

Xiangxiang Chu, Renda Li, Yong Wang

机构 * AMAP, Alibaba Group(阿里集团)

专题命中 扩散模型 :image generation(title);diffusion(abstract);分类 cs.CV

Comments Accepted to ICCV2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15595 2025-07-22 cs.CV 79%

SegDT: A Diffusion Transformer-Based Segmentation Model for Medical Imaging

Salah Eddine Bekhouche, Gaby Maroun, Fadi Dornaika, Abdenour Hadid

机构 * University of the Basque Country UPV/EHU(巴斯克大学国家研究型大学) IKERBASQUE Sorbonne University Abu Dhabi(索邦大学阿布扎比分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15346 2025-07-22 cs.CV 79%

RoadFusion: Latent Diffusion Model for Pavement Defect Detection

Muhammad Aqeel, Kidus Dagnaw Bellete, Francesco Setti

机构 * Dept. of Engineering for Innovation Medicine, University of Verona(创新医学工程系,威尼斯大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to ICIAP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17769 2025-07-22 cs.CV 79%

Omegance: A Single Parameter for Various Granularities in Diffusion-Based Synthesis

Xinyu Hou, Zongsheng Yue, Xiaoming Li, Chen Change Loy

机构 * S-Lab, Nanyang Technological University(南洋理工大学S实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICCV 2025 Camera Ready. Project page: https://itsmag11.github.io/Omegance/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15265 2025-07-22 cs.CV cs.LG 79%

Derivative-Free Diffusion Manifold-Constrained Gradient for Unified XAI

Won Jun Kim, Hyungjin Chung, Jaemin Kim, Sangmin Lee, Byeongsu Sim, Jong Chul Ye

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025 (poster), 19 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13769 2025-07-21 cs.CV cs.AI 79%

Learning Spectral Diffusion Prior for Hyperspectral Image Reconstruction

Mingyang Yu, Zhijian Wu, Dingjiang Huang

机构 * School of Data Science and Engineering, East China Normal University(数据科学与工程学院,东华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13598 2025-07-21 cs.CR cs.AI cs.CV cs.LG 79%

GIFT: Gradient-aware Immunization of diffusion models against malicious Fine-Tuning with safe concepts retention

Amro Abdalla, Ismail Shaheen, Dan DeGenaro, Rupayan Mallick, Bogdan Raita, Sarah Adel Bargal

机构 * Department of Computer Science, Georgetown University(计算机科学系,乔治城大学) Department of Mathematics and Statistics, Georgetown University(数学与统计学系,乔治城大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Warning: This paper contains NSFW content. Reader discretion is advised

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13599 2025-07-21 cs.CV 79%

Learning Deblurring Texture Prior from Unpaired Data with Diffusion Model

Chengxu Liu, Lu Qi, Jinshan Pan, Xueming Qian, Ming-Hsuan Yang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICCV2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13404 2025-07-21 cs.CV 79%

AortaDiff: Volume-Guided Conditional Diffusion Models for Multi-Branch Aortic Surface Generation

Delin An, Pan Du, Jian-Xun Wang, Chaoli Wang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13366 2025-07-21 cs.SI cs.CV 79%

Leveraging the Spatial Hierarchy: Coarse-to-fine Trajectory Generation via Cascaded Hybrid Diffusion

Baoshen Guo, Zhiqing Hong, Junyi Li, Shenhao Wang, Jinhua Zhao

机构 * Singapore-MIT Alliance for Research and Technology(新加坡-麻省理工联合研究技术联盟) Rutgers University(罗格斯大学) University of Florida(佛罗里达大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05156 2025-07-21 cs.CV 79%

Accelerating Diffusion Transformer via Gradient-Optimized Cache

Junxiang Qiu, Lin Liu, Shuo Wang, Jinda Lu, Kezhou Chen, Yanbin Hao

机构 * University of Science and Technology of China(中国科学技术大学) Hefei University of Technology(合肥工业大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Journal ref ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19243 2025-07-21 cs.CV 79%

Accelerating Diffusion Transformer via Error-Optimized Cache

Junxiang Qiu, Shuo Wang, Jinda Lu, Lin Liu, Houcheng Jiang, Xingyu Zhu, Yanbin Hao

机构 * University of Science and Technology of China(中国科学技术大学) Hefei University of Technology(合肥工业大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Journal ref ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13344 2025-07-18 cs.CV 79%

Diffuman4D: 4D Consistent Human View Synthesis from Sparse-View Videos with Spatio-Temporal Diffusion Models

Yudong Jin, Sida Peng, Xuan Wang, Tao Xie, Zhen Xu, Yifan Yang, Yujun Shen, Hujun Bao, Xiaowei Zhou

机构 * Zhejiang University(浙江大学) Ant Research(蚂蚁研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project page: https://diffuman4d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13106 2025-07-18 cs.CV cs.LG 79%

Deep Learning-Based Fetal Lung Segmentation from Diffusion-weighted MRI Images and Lung Maturity Evaluation for Fetal Growth Restriction

Zhennan Xiao, Katharine Brudkiewicz, Zhen Yuan, Rosalind Aughwane, Magdalena Sokolska, Joanna Chappell, Trevor Gaunt, Anna L. David, Andrew P. King, Andrew Melbourne

机构 * School of Biomedical Engineering and Imaging Sciences, King's College London, London, UK(生物医学工程与成像科学学院,伦敦国王学院) Elizabeth Garrett Anderson Institute for Women’s Health, University College, London, UK(埃利扎贝塔·加德纳妇女健康研究所,大学学院,伦敦) University College London Hospital NHS Foundation Trust, London, UK(伦敦大学学院医院国家健康服务信托基金) Department of Medical Physics and Biomedical Engineering, University College London Hospitals, London, UK(医学物理与生物医学工程系,伦敦大学学院医院) Department of Radiology, University College London Hospitals NHS Foundation Trust, London, United Kingdom(放射科,伦敦大学学院医院国家健康服务信托基金)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12985 2025-07-18 eess.IV cs.CV 79%

From Variability To Accuracy: Conditional Bernoulli Diffusion Models with Consensus-Driven Correction for Thin Structure Segmentation

Jinseo An, Min Jin Lee, Kyu Won Shim, Helen Hong

机构 * Department of Software Convergence, Seoul Women's University, Seoul, Republic of Korea(首尔女性大学软件融合系) Department of Pediatric Neurosurgery, Craniofacial Reforming and Reconstruction Clinic, Yonsei University College of Medicine, Seoul, Republic of Korea(延世大学医学院小儿神经外科及颅面整复与重建诊所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Early accepted at MICCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12967 2025-07-18 cs.CV 79%

RGB Pre-Training Enhanced Unobservable Feature Latent Diffusion Model for Spectral Reconstruction

Keli Deng, Jie Nie, Yuntao Qian

机构 * Institute of Artificial Intelligence, College of Computer Science, Zhejiang University(人工智能研究院,计算机科学学院,浙江大学) Department of Computer Science and Technology, Ocean University of China(计算机科学与技术系,中国海洋大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12804 2025-07-18 cs.CV 79%

ATL-Diff: Audio-Driven Talking Head Generation with Early Landmarks-Guide Noise Diffusion

Hoang-Son Vo, Quang-Vinh Nguyen, Seungwon Kim, Hyung-Jeong Yang, Soonja Yeom, Soo-Hyung Kim

机构 * Chonnam National University(全南国立大学) University of Tasmania(塔斯马尼亚大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12493 2025-07-18 cs.GR 79%

WaFusion: A Wavelet-Enhanced Diffusion Framework for Face Morph Generation

Seyed Rasoul Hosseini, Omid Ahmadieh, Jeremy Dawson, Nasser Nasrabadi

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11980 2025-07-18 cs.CV 79%

EC-Diff: Fast and High-Quality Edge-Cloud Collaborative Inference for Diffusion Models

Jiajian Xie, Shengyu Zhang, Zhou Zhao, Fan Wu, Fei Wu

机构 * Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 21 pages, 8 figures. arXiv admin note: text overlap with arXiv:2408.12588 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11557 2025-07-17 eess.IV cs.AI cs.CV 79%

3D Wavelet Latent Diffusion Model for Whole-Body MR-to-CT Modality Translation

Jiaxu Zheng, Meiman He, Xuhui Tang, Xiong Wang, Tuoyu Cao, Tianyi Zeng, Lichi Zhang, Chenyu You

机构 * School of Biomedical Engineering, Shanghai Jiao Tong University(上海交通大学生物医学工程学院) School of Information Science and Technology, ShanghaiTech University(上海交通大学信息科学与技术学院) Shanghai United Imaging Healthcare Co., Ltd.(上海联影医疗科技有限公司) Department of Radiology and Biomedical Imaging, Yale University(耶鲁大学放射科与生物医学成像系) Department of Applied Mathematics & Statistics and Department of Computer Science, Stony Brook University(石溪大学应用数学与统计系和计算机科学系)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17791 2025-07-17 cs.CV cs.RO 79%

LiDPM: Rethinking Point Diffusion for Lidar Scene Completion

Tetiana Martyniuk, Gilles Puy, Alexandre Boulch, Renaud Marlet, Raoul de Charette

机构 * Inria(法国国家信息与自动化技术研究所) LIGM, ENPC, Univ Gustave Eiffel, CNRS, France(LIGM,ENPC,法国埃菲尔大学,CNRS,法国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to IEEE IV 2025 (Oral); v2 - updated quantitative results based on the metrics (Voxel IoU) calculation code corrections

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12567 2025-07-17 cs.CV 79%

DeltaDiff: Reality-Driven Diffusion with AnchorResiduals for Faithful SR

Chao Yang, Yong Fan, Qichao Zhang, Cheng Lu, Zhijing Yang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00355 2025-07-17 cs.CV cs.AI cs.LG 79%

TextDestroyer: A Training- and Annotation-Free Diffusion Method for Destroying Anomal Text from Images

Mengcheng Li, Fei Chao

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing Xiamen University(多媒体可信感知与高效计算重点实验室 厦门大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03924 2025-07-15 cs.CV 79%

DNF-Intrinsic: Deterministic Noise-Free Diffusion for Indoor Inverse Rendering

Rongjia Zheng, Qing Zhang, Chengjiang Long, Wei-Shi Zheng

机构 * Sun Yat-sen University(中山大学) Meta Reality Labs(Meta现实实验室) Key Laboratory of Machine Intelligence and Advanced Computing, Ministry of Education(教育部机器智能与先进计算重点实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to ICCV2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09227 2025-07-15 eess.IV cs.AI cs.CV cs.LG 79%

PanoDiff-SR: Synthesizing Dental Panoramic Radiographs using Diffusion and Super-resolution

Sanyam Jain, Bruna Neves de Freitas, Andreas Basse-OConnor, Alexandros Iosifidis, Ruben Pauwels

机构 * Department of Dentistry(牙科系) Oral Health, Aarhus University(口腔健康,奥胡斯大学) Aarhus Institute of Advanced Studies, Aarhus University(奥胡斯大学高级研究 institute) Department of Mathematics, Aarhus University(数学系,奥胡斯大学) Faculty of Information Technology(信息科技学院) Communication Sciences, Tampere University(传播科学学院,塔尔库大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09140 2025-07-15 cs.GR 79%

Interactive Drawing Guidance for Anime Illustrations with Diffusion Model

Chuang Chen, Xiaoxuan Xie, Yongming Zhang, Tianyu Zhang, Haoran Xie

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

Comments 9 pages, 7 figures. In proceedings of NICOGRAPH International 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02481 2025-07-15 cs.CV 79%

A Novel Streamline-based diffusion MRI Tractography Registration Method with Probabilistic Keypoint Detection

Junyi Wang, Mubai Du, Ye Wu, Yijie Li, William M. Wells, Lauren J. O'Donnell, Fan Zhang

机构 * University of Electronic Science and Technology of China(电子科技大学) Nanjing University of Science and Technology(南京理工大学) Harvard Medical School(哈佛医学院) Brigham and Women’s Hospital(布莱根和妇女医院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏