arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86872 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2509.16117 2026-02-17 cs.LG cs.AI cs.CV 79%

DiffusionNFT: Online Diffusion Reinforcement with Forward Process

DiffusionNFT: 在线扩散强化学习与正向过程

Kaiwen Zheng, Huayu Chen, Haotian Ye, Haoxiang Wang, Qinsheng Zhang, Kai Jiang, Hang Su, Stefano Ermon, Jun Zhu, Ming-Yu Liu

机构 * Tsinghua University(清华大学) NVIDIA Stanford University(斯坦福大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DiffusionNFT通过正向过程优化扩散模型,结合正负生成对比提升强化学习效率,无需CFG且比FlowGRPO更高效。

Comments ICLR 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14577 2026-02-17 cs.CV 79%

DriveFine: Refining-Augmented Masked Diffusion VLA for Precise and Robust Driving

DriveFine: 通过细化增强的掩码扩散VLA实现精确且鲁棒的驾驶

Chenxu Dang, Sining Ang, Yongkang Li, Haochen Tian, Jie Wang, Guang Li, Hangjun Ye, Jie Ma, Long Chen, Yan Wang

机构 * Huazhong University of Science and Technology(华中科技大学) Xiaomi EV(小米电动车) Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DriveFine提出一种结合灵活解码与自我纠正能力的掩码扩散VLA模型,通过插件式块MoE和混合强化学习策略提升自动驾驶规划的精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13993 2026-02-17 cs.CV 79%

Elastic Diffusion Transformer

弹性扩散变换器

Jiangshan Wang, Zeqiang Lai, Jiarui Chen, Jiayi Guo, Hang Guo, Xiu Li, Xiangyu Yue, Chunchao Guo

机构 * Tsinghua University(清华大学) MMLab, CUHK(CUHK实验室) Tencent Hunyuan(腾讯文言)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 E-DiT通过自适应加速框架提升扩散变换器效率,保持生成质量,实现约2倍加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13361 2026-02-17 cs.CV 79%

The Diffusion Duet: Harmonizing Dual Channels with Wavelet Suppression for Image Separation

扩散双人行:通过小波抑制和谐双通道图像分离

Jingwei Li, Wei Pu

机构 * Zhejiang Gongshang University(浙江工商大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出DCDSM模型,通过小波抑制模块和双通道扩散模型提升图像分离性能,在雨雪去除和复杂混合分离中取得优异效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13347 2026-02-17 cs.CV cs.AI cs.RO 79%

Visual Foresight for Robotic Stow: A Diffusion-Based World Model from Sparse Snapshots

机器人存取的视觉预见:一种基于稀疏快照的扩散世界模型

Lijun Zhang, Nikhil Chacko, Petter Nilsson, Ruinian Xu, Shantanu Thakar, Bai Lou, Harpreet Sawhney, Zhebin Zhang, Mudit Agrawal, Bhavana Chandrashekhar, Aaron Parness

机构 * Amazon, Seattle, US(亚马逊(美国西雅图))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 FOREST通过基于稀疏快照的扩散模型,提升仓库存取操作的预测精度,为仓储规划提供有效预见信号。

Comments 20 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13303 2026-02-17 cs.CV cs.AI cs.LG eess.IV 79%

Spectral Collapse in Diffusion Inversion

扩散反演中的谱塌陷

Nicolas Bourriez, Alexandre Verine, Auguste Genovesio

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出OVG方法,解决扩散反演中结构与纹理的权衡问题,通过校正ODE动力学以恢复真实纹理并保持结构保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00787 2026-02-17 cs.CV 79%

Image-to-Brain Signal Generation for Visual Prosthesis with CLIP Guided Multimodal Diffusion Models

基于CLIP引导的多模态扩散模型的图像到脑信号生成用于视觉假体

Ganxi Xu, Zhao-Rong Lai, Yuting Tang, Yonghao Song, Guoxu Zhou, Boyu wang, Jian Zhu, Jinyi Long

机构 * Jinan University, Guangzhou, China Department of Rehabilitation Medicine, The First Affiliated Hospital of Jinan University, Guangzhou, China Western University, Ontario, Canada Guangdong University of Technology, Guangzhou, China Tsinghua University, Beijing, China

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出基于CLIP引导的多模态扩散模型,实现图像到脑信号的转换,通过交叉注意力机制和空间-时间位置编码生成生物合理的脑信号。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13168 2026-02-16 cs.CV cs.LG 79%

Realistic Face Reconstruction from Facial Embeddings via Diffusion Models

通过扩散模型从面部嵌入中重建逼真人脸

Dong Han, Yong Li, Joachim Denzler

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出FEM框架,利用扩散模型和KAN网络,从面部嵌入中重建逼真人脸,以评估FR和PPFR系统的隐私安全性和攻击鲁棒性。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01091 2026-02-16 cs.CV 79%

DuoCast: Duo-Probabilistic Diffusion for Precipitation Nowcasting

DuoCast:双概率扩散用于降水现在预测

Penghui Wen, Mengwei He, Patrick Filippi, Na Zhao, Feng Zhang, Thomas Francis Bishop, Zhiyong Wang, Kun Hu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DuoCast通过双扩散框架分解降水预报为低频和高频成分,利用正交潜在子空间提升预测精度,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17298 2026-02-16 cs.CV 79%

ProCache: Constraint-Aware Feature Caching with Selective Computation for Diffusion Transformer Acceleration

ProCache:基于约束的特征缓存与选择性计算用于扩散变换器加速

Fanpu Cao, Yaofo Chen, Zeng You, Wei Luo

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 ProCache通过约束感知的特征缓存和选择性计算,有效缓解了扩散变换器的高计算成本问题,实现了显著的加速效果。

Comments Accepted for poster presentation at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06027 2026-02-16 cs.CV cs.LG 79%

Sample-Specific Noise Injection For Diffusion-Based Adversarial Purification

针对扩散的对抗性净化中的样本特定噪声注入

Yuhao Sun, Jiacheng Zhang, Zesheng Ye, Chaowei Xiao, Feng Liu

机构 * School of Computing and Information Systems, The University of Melbourne(墨尔本大学计算机与信息系统学院) University of Wisconsin, Madison(威斯康星大学麦迪逊分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出样本特定的分数感知噪声注入方法,通过自适应调整噪声水平提升对抗净化的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11704 2026-02-13 eess.IV cs.CV 79%

U-DAVI: Uncertainty-Aware Diffusion-Prior-Based Amortized Variational Inference for Image Reconstruction

U-DAVI:基于不确定性意识的扩散先验的图像重建近似变分推断

Ayush Varshney, Katherine L. Bouman, Berthy T. Feng

机构 * Computing and Mathematical Sciences, California Institute of Technology(计算与数学科学系,加州理工学院) Mathematical Sciences, California Institute of Technology(数学科学系,加州理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 U-DAVI通过引入空间自适应扰动和不确定性估计,改进了基于扩散的图像重建方法,实现更高质量的重建效果。

Comments Accepted at ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11703 2026-02-13 cs.CV cs.AI 79%

Semantically Conditioned Diffusion Models for Cerebral DSA Synthesis

具有语义条件的扩散模型用于脑部DSA合成

Qiwen Xu, David Rügamer, Holger Wenz, Johann Fontana, Nora Meggyeshazi, Andreas Bender, Máté E. Maros

机构 * Department of Statistics, LMU Munich(统计学系) Department of Biomedical Informatics (DBMI), Medical Faculty Mannheim, Heidelberg University(生物医学信息学系) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Clinic for Diagnostic and Interventional Neuroradiology, Medical Faculty Mannheim, Heidelberg University(诊断和介入神经放射科) Department of Anesthesiology and Intensive Care Medicine, BG Trauma Center Tuebingen(麻醉和重症医学科)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本研究提出一种具有语义条件的扩散模型,用于生成具有真实感的脑部DSA图像,以支持医学研究和算法开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11653 2026-02-13 cs.CV 79%

GR-Diffusion: 3D Gaussian Representation Meets Diffusion in Whole-Body PET Reconstruction

GR-Diffusion:3D高斯表示与扩散在全身体PET重建中的结合

Mengxiao Geng, Zijie Chen, Ran Hong, Bingxuan Li, Qiegen Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 GR-Diffusion结合3D高斯表示与扩散模型,提升全身体PET重建的图像质量和细节保留能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11545 2026-02-13 cs.CV 79%

Supervise-assisted Multi-modality Fusion Diffusion Model for PET Restoration

监督辅助多模态融合扩散模型用于PET修复

Yingkai Zhang, Shuang Chen, Ye Tian, Yunyi Gao, Jianyong Jiang, Ying Fu

机构 * Beijing Institute of Technology(北京理工大学) Research and Development Center of Agricultural Bank of China(中国农业银行研发中心) Peking University(北京大学) Beijing Normal University(北京师范大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出监督辅助多模态融合扩散模型,用于从低剂量PET和MR图像中恢复高质量SPET图像,通过优化特征融合和两阶段监督学习策略提升修复效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11446 2026-02-13 cs.CV cs.AI 79%

Enhanced Portable Ultra Low-Field Diffusion Tensor Imaging with Bayesian Artifact Correction and Deep Learning-Based Super-Resolution

增强型便携式超低场扩散张量成像与贝叶斯伪影校正及基于深度学习的超分辨率

Mark D. Olchanyi, Annabel Sorby-Adams, John Kirsch, Brian L. Edlow, Ava Farnan, Renfei Liu, Matthew S. Rosen, Emery N. Brown, W. Taylor Kimberly, Juan Eugenio Iglesias

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出了一种便携式超低场扩散张量成像序列及贝叶斯伪影校正算法,结合深度学习超分辨率技术,提升白质成像质量并应用于阿尔茨海默病分类。

Comments 38 pages, 8 figures, 2 supplementary figures, and 3 supplementary tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11214 2026-02-13 cs.CV cs.RO 79%

DD-MDN: Human Trajectory Forecasting with Diffusion-Based Dual Mixture Density Networks and Uncertainty Self-Calibration

DD-MDN: 基于扩散的双混合密度网络与不确定性自校准的人体轨迹预测

Manuel Hetzel, Kerim Turacan, Hannes Reichert, Konrad Doll, Bernhard Sick

机构 * Faculty of Engineering, University of Applied Sciences Aschaffenburg(亚琛应用科学大学工程学院) Intelligent Embedded Systems Lab, University of Kassel(卡塞尔大学智能嵌入式系统实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DD-MDN通过结合扩散模型和双混合密度网络,实现高精度的人体轨迹预测,具备自校准的不确定性建模和对短观察期的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01497 2026-02-13 cs.CV 79%

Learning A Physical-aware Diffusion Model Based on Transformer for Underwater Image Enhancement

基于变压器的物理感知扩散模型学习用于水下图像增强

Chen Zhao, Chenyu Dong, Weiling Cai, Yueyue Wang

机构 * School of Intelligence Science and Technology, Nanjing University(智能科学与技术学院,南京大学) School of Artificial Intelligence, Nanjing Normal University(人工智能学院,南京师范大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出基于物理知识的扩散模型PA-Diff,通过物理先验生成和隐式神经重建提升水下图像增强效果,实验表明其在水下图像增强任务中表现最优。

Comments IEEE Transactions on Geoscience and Remote Sensing (TGRS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09181 2026-02-13 cs.CV 79%

Improving Efficiency of Diffusion Models via Multi-Stage Framework and Tailored Multi-Decoder Architectures

通过多阶段框架和定制多解码器架构提高扩散模型的效率

Huijie Zhang, Yifu Lu, Ismail Alkhouri, Saiprasad Ravishankar, Dogyoon Song, Qing Qu

机构 * University of Michigan(密歇根大学) Michigan State University(密歇根州立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出多阶段框架和定制多解码器架构,以提高扩散模型的训练和采样效率。

Comments The IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10940 2026-02-12 cs.CV 79%

FastUSP: A Multi-Level Collaborative Acceleration Framework for Distributed Diffusion Model Inference

FastUSP:一种多级协作加速框架用于分布式扩散模型推理

Guandong Li

机构 * iFLYTEK

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 FastUSP通过多级优化提升分布式扩散模型推理效率,重点解决内核启动开销和计算-通信调度问题,实现1.12×-1.16×的加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10319 2026-02-12 cs.CV 79%

A Low-Rank Defense Method for Adversarial Attack on Diffusion Models

一种用于对抗攻击的低秩防御方法(扩散模型)

Jiaxuan Zhu, Siyu Huang

机构 * Corresponding author: Siyu Huang(通讯作者)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出了一种名为LoRD的低秩防御方法,用于防御扩散模型的对抗攻击,通过结合低秩适应模块和平衡参数,有效提升模型在对抗样本下的生成质量。

Comments Accepted by ICME2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10221 2026-02-12 cs.CV 79%

DEGMC: Denoising Diffusion Models Based on Riemannian Equivariant Group Morphological Convolutions

DEGMC:基于黎曼等变群形态卷积的去噪扩散模型

El Hadji S. Diop, Thierno Fall, Mohamed Daoudi

机构 * NAGIP-Nonlinear Analysis and Geometric Information Processing Research Group(非线性分析与几何信息处理研究组) Department of Mathematics, University Iba Der Thiam(数学系,Iba Der Thiam大学) Institut Mines-Telecom Nord Europe, Centre for Digital Systems, CNRS Centrale Lille UMR 9189 CRIStAL, University of Lille(Institut Mines-Telecom Nord Europe数字系统中心,CNRS Centrale Lille UMR 9189 CRIStAL,Lille大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DEGMC通过引入基于黎曼等变群形态卷积的方法,改进了DDPM在几何特征提取和网络等变性方面的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10219 2026-02-12 cs.MM eess.IV 79%

Rethinking Security of Diffusion-based Generative Steganography

重新审视基于扩散模型的生成隐写术的安全性

Jihao Zhu, Zixuan Chen, Jiali Liu, Lingxiao Yang, Yi Zhou, Weiqi Luo, Xiaohua Xie

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.MM

AI总结 本文提出NS-DSer框架,通过分析扩散模型噪声分布与隐写安全性之间的关系,重新评估了基于扩散模型的生成隐写术的安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05380 2026-02-12 cs.CV 79%

SAIL: Self-Amplified Iterative Learning for Diffusion Model Alignment with Minimal Human Feedback

SAIL:基于最小人类反馈的扩散模型对齐的自增强迭代学习

Xiaoxuan He, Siming Fu, Wanli Li, Zhiyuan Li, Dacheng Yin, Kang Rong, Fengyun Rao, Bo Zhang

机构 * ZheJiang University(浙江大学) Tencent Inc(腾讯公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 SAIL通过最小人类反馈实现扩散模型对齐,利用自我增强迭代学习替代传统奖励模型和大规模标注数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17247 2026-02-12 cs.CL cs.CV 79%

From Preferences to Prejudice: The Role of Alignment Tuning in Shaping Social Bias in Video Diffusion Models

从偏好到偏见:对齐调谐在视频扩散模型中塑造社会偏见的作用

Zefan Cai, Haoyi Qiu, Haozhe Zhao, Ke Wan, Jiachen Li, Jiuxiang Gu, Wen Xiao, Nanyun Peng, Junjie Hu

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) University of California, Los Angeles(加州大学洛杉矶分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of California, San Diego(加州大学圣地亚哥分校) University of California, Santa Barbara(加州大学圣巴巴拉分校) Microsoft(微软公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文研究了对齐调谐在视频扩散模型中如何塑造社会偏见,提出VideoBiasEval框架以评估和缓解偏见,揭示了对齐调谐使偏见更稳定且刻板化的现象。

Comments TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09983 2026-02-11 cs.CV cs.AI cs.LG 79%

Coupled Inference in Diffusion Models for Semantic Decomposition

扩散模型中的耦合推断用于语义分解

Calvin Yeung, Ali Zakeri, Zhuowen Zou, Mohsen Imani

机构 * Department of Computer Science University of California, Irvine(计算机科学系 加州大学伊维特分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出了一种基于扩散模型耦合推断的语义分解框架,通过逆问题建模和重建导向的引导项提升分解性能,并展示了其在合成任务中的优越性。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09883 2026-02-11 cs.CV 79%

AdaTSQ: Pushing the Pareto Frontier of Diffusion Transformers via Temporal-Sensitivity Quantization

AdaTSQ: 通过时间敏感量化推动扩散变换器的帕累托前沿

Shaoqiu Zhang, Zizhong Ding, Kaicheng Yang, Junyi Wu, Xianglong Yan, Xi Li, Bingnan Duan, Jianping Fang, Yulun Zhang

机构 * Shanghai Jiaotong University(上海交通大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 AdaTSQ通过时间敏感量化方法提升扩散变换器的效率与质量,优于现有方法。

Comments Code will be released at https://github.com/Qiushao-E/AdaTSQ/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09510 2026-02-11 cs.CV 79%

Robust Depth Super-Resolution via Adaptive Diffusion Sampling

通过自适应扩散采样实现鲁棒的深度超分辨率

Kun Wang, Yun Zhu, Pan Zhou, Na Zhao

机构 * Singapore University of Technology(新加坡科技设计大学) Nanjing University of Science(南京理工大学) Singapore Management University(新加坡管理大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 AdaDS通过自适应扩散采样实现鲁棒深度超分辨率,利用高斯平滑性质提升恢复鲁棒性,展现优异的零样本泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09494 2026-02-11 cs.CV 79%

OSI: One-step Inversion Excels in Extracting Diffusion Watermarks

OSI: 一步反向在提取扩散水印中表现优异

Yuwei Chen, Zhenliang He, Jia Tang, Meina Kan, Shiguang Shan

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, CAS, China(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences (CAS), China(中国科学院大学) School of Information Science and Technology, ShanghaiTech University, China(信息科学与技术学院,上海科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 OSI通过一步反向高效提取高斯阴影水印,速度快20倍,精度更高,承载能力翻倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20642 2026-02-11 cs.LG cs.AI cs.CV 79%

Detecting and Mitigating Memorization in Diffusion Models through Anisotropy of the Log-Probability

通过概率的各向异性检测和缓解扩散模型中的记忆化

Rohan Asthana, Vasileios Belagiannis

机构 * Friedrich-Alexander-Universität Erlangen-Nürnberg(埃朗根-纽伦堡弗里德里希-亚历山大大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 通过分析概率各向异性,提出一种高效的扩散模型记忆化检测与缓解方法,提升检测效率并减少计算成本。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏