arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-02-27 至 2026-02-27 共收录 52 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 52 篇

2510.04504 2026-02-27 cs.CV 91%

Asynchronous Denoising Diffusion Models for Aligning Text-to-Image Generation

异步去噪扩散模型用于文本到图像生成对齐

Zijing Hu, Yunze Tong, Fengda Zhang, Junkun Yuan, Jun Xiao, Kun Kuang

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学)

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);image generation(title);分类 cs.CV

AI总结 本文提出异步扩散模型,通过为不同像素分配不同时间步以改进文本到图像生成的对齐效果。

Comments Accepted to ICLR 2026, 25 pages, 13 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23295 2026-02-27 cs.CV cs.LG 79%

ManifoldGD: Training-Free Hierarchical Manifold Guidance for Diffusion-Based Dataset Distillation

ManifoldGD: 无需训练的分层流形引导用于基于扩散的数据集蒸馏

Ayush Roy, Wei-Yang Alex Lee, Rudrasis Chakraborty, Vishnu Suresh Lokhande

机构 * University at Buffalo, SUNY(布法罗大学,SUNY) Lawrence Livermore National Lab(劳伦斯利弗莫尔国家实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 ManifoldGD通过流形引导方法实现无需训练的扩散数据集蒸馏,提升数据集的代表性、多样性和图像保真度。

Comments CVPE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22862 2026-02-27 cs.RO cs.CV 79%

GraspLDP: Towards Generalizable Grasping Policy via Latent Diffusion

GraspLDP: 通过潜在扩散实现通用抓取策略

Enda Xiang, Haoxiang Ma, Xinzhu Ma, Zicheng Liu, Di Huang

机构 * State Key Laboratory of Complex and Critical Software Environment(复杂与关键软件环境国家重点实验室) School of Computer Science and Engineering(计算机科学与工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 GraspLDP通过引入潜在扩散框架和抓取先验知识,提升了抓取策略的精度和泛化能力,实验表明其在动态抓取任务中表现优异。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22717 2026-02-27 cs.CV 79%

IRSDE-Despeckle: A Physics-Grounded Diffusion Model for Generalizable Ultrasound Despeckling

IRSDE-Despeckle: 一种基于物理的扩散模型用于通用的超声去斑处理

Shuoqi Chen, Yujia Wu, Geoffrey P. Luke

机构 * Thayer School of Engineering, Dartmouth College, Hanover, NH, USA(达特茅斯学院工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 IRSDE-Despeckle提出了一种基于物理的扩散模型,用于通用的超声去斑处理,通过模拟数据集训练,有效抑制斑点并保留解剖结构,同时量化预测不确定性,提升临床应用的鲁棒性。

Comments 12 pages main text + 6 pages appendix, 7 figures main + 3 figures appendix, 3 tables main + 1 table appendix. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21893 2026-02-27 cs.CV 79%

EndoDDC: Learning Sparse to Dense Reconstruction for Endoscopic Robotic Navigation via Diffusion Depth Completion

EndoDDC: 通过扩散深度补全学习稀疏到密集重建以实现内窥镜机器人导航

Yinheng Lin, Yiming Huang, Beilei Cui, Long Bai, Huxin Gao, Hongliang Ren, Jiewen Lai

机构 * Department of Electronic Engineering, The Chinese University of Hong Kong(电子工程系,香港中文大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 EndoDDC通过扩散模型整合图像、稀疏深度信息和深度梯度特征,提升内窥镜环境下深度重建的准确性和鲁棒性。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01292 2026-02-27 cs.CV cs.AI 79%

Diffusion Model in Latent Space for Medical Image Segmentation Task

用于医学图像分割任务的潜在空间扩散模型

Huynh Trinh Ngoc, Toan Nguyen Hai, Ba Luong Son, Long Tran Quoc

机构 * Ngoc Huynh Trinh1(Ngoc Huynh Trinh) Hai Toan Nguyen Son Ba Luong Quoc Long Tran2(Quoc Long Tran)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 MedSegLatDiff结合VAE和潜在扩散模型,通过加权交叉熵损失提升医学图像分割的精度与可靠性,适用于临床部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01031 2026-02-27 cs.CV cs.LG 79%

Secure and reversible face anonymization with diffusion models

基于扩散模型的安全可逆面部匿名化

Pol Labarbarie, Vincent Itier, William Puech

机构 * LIRMM, Univ Montpellier, CNRS, Montpellier, FRANCE(LIRMM,蒙彼利埃大学,法国国家科学研究中心,蒙彼利埃,法国) IMT Nord Europe, Institut Mines-Télécom, Univ. Lille, Centre for Digital Systems, Lille, FRANCE(IMT北欧,法国电信研究院,里尔大学,数字系统研究中心,里尔,法国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出基于扩散模型的安全可逆面部匿名化框架,通过秘密密钥条件实现匿名化与授权身份恢复,提升匿名化与去匿名化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16904 2026-02-27 cs.CV 79%

Diffusion or Non-Diffusion Adversarial Defenses: Rethinking the Relation between Classifier and Adversarial Purifier

扩散或非扩散对抗防御:重新思考分类器与对抗净化器之间的关系

Yuan-Chih Chen, Chun-Shien Lu

机构 * Institute of Information Science, Academia Sinica(中国台湾“中央研究院”信息科学研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文重新审视分类器与对抗净化器的关系,发现非扩散模型在对抗防御中表现优异,尤其在防御转移性和颜色泛化方面,且无需额外数据即可在ImageNet上取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22610 2026-02-27 cs.LG cs.CV 79%

DP-aware AdaLN-Zero: Taming Conditioning-Induced Heavy-Tailed Gradients in Differentially Private Diffusion

DP-aware AdaLN-Zero: 降低差分隐私扩散中因条件诱导的重尾梯度

Tao Huang, Jiayang Meng, Xu Yang, Chen Hou, Hong Chen

机构 * School of Computer Science(计算机科学学院) Big Data, Minjiang University, Fuzhou, Fujian, China.(大数据,闽江大学,福州,福建,中国) School of Information, Renmin University of China, Beijing, China(信息学院,中国人民大学,北京,中国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DP-aware AdaLN-Zero通过敏感性感知条件机制降低差分隐私扩散中因条件诱导的重尾梯度,提升隐私保护下的条件生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22594 2026-02-27 cs.CV 79%

Causal Motion Diffusion Models for Autoregressive Motion Generation

因果运动扩散模型用于自回归运动生成

Qing Yu, Akihisa Watanabe, Kent Fujiwara

机构 * LY Corporation(LY公司) Waseda University(早稻田大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出因果运动扩散模型,通过因果扩散变换器实现高质量运动生成,提升语义保真度与时间平滑度,同时减少推理延迟。

Comments Accepted to CVPR 2026, Project website: https://yu1ut.com/CMDM-HP/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11025 2026-02-27 cs.CV 79%

Human-Guided Shade Artifact Suppression in CBCT-to-MDCT Translation via Schrödinger Bridge with Conditional Diffusion

基于Schrödinger Bridge的受人类指导的CBCT到MDCT翻译中的阴影伪影抑制

Sung Ho Kang, Hyun-Cheol Park

机构 * National Institute for Mathematical Sciences(国家信息科学研究院) Department of Computer Engineering, Korea National University of Transportation(计算机工程系,韩国交通国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出了一种基于Schrödinger Bridge的框架,通过人类指导的条件扩散模型实现CBCT到MDCT的翻译,有效抑制阴影伪影并提升医学图像的解剖学准确性与感知可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.09861 2026-02-27 cs.CV 79%

BSDM: Background Suppression Diffusion Model for Hyperspectral Anomaly Detection

BSDM:超分辨率异常检测的背景抑制扩散模型

Jitao Ma, Weiying Xie, Yunsong Li, Leyuan Fang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 BSDM通过设计伪背景噪声和改进扩散模型推断过程,实现无需标注样本的超光谱异常检测背景抑制。

Journal ref IEEE Transactions on Circuits and Systems for Video Technology, 31, 1, 190-204, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20064 2026-02-27 nucl-th astro-ph.HE gr-qc hep-ph 79%

Nonlinear causality of Israel-Stewart theory with diffusion

以色列-斯图尔特理论中的非线性因果性

Ian Cordeiro, Fábio S. Bemfica, Enrico Speranza, Jorge Noronha

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了以色列-斯图尔特理论在能量和数密度扩散下的非线性因果性约束,揭示了两种流体动力学框架下的物理行为差异,并展示了非线性因果性方法在捕捉新物理约束方面的有效性。

Comments 26 pages, 1 figure. Accepted for publication in Phys. Rev. D

Journal ref I. Cordeiro, F. S. Bemfica, E. Speranza, and J. Noronha, Nonlinear causality of Israel-Stewart theory with diffusion, Phys. Rev. D 113, 045024 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23181 2026-02-27 physics.flu-dyn nlin.CD 78%

From synthetic turbulence to true solutions: A deep diffusion model for discovering periodic orbits in the Navier-Stokes equations

从合成湍流到真实解:一种深度扩散模型用于发现纳维-斯托克斯方程中的周期轨道

Jeremy P Parker, Tobias M Schneider

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出一种深度扩散模型,用于发现纳维-斯托克斯方程中的周期轨道,通过生成合成轨迹并优化得到111个新周期轨道。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23162 2026-02-27 math.DS 78%

Existence and characterization of attractors for a nonlocal reaction-diffusion equation having an energy functional

非局部反应扩散方程吸引子的存在与特征化

Rubén Caballero, Pedro Marín-Rubio, José Valero

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究非局部反应扩散方程的吸引子存在性与特征化,通过多值半流理论证明全局吸引子的存在,并将其与平稳点集的不稳定或稳定流形联系起来。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23132 2026-02-27 cs.IR cs.LG 78%

From Agnostic to Specific: Latent Preference Diffusion for Multi-Behavior Sequential Recommendation

从无偏到特定:基于潜在偏好的多行为序列推荐扩散模型

Ruochen Yang, Xiaodong Li, Jiawei Sheng, Jiangxia Cao, Xinkui Lin, Shen Wang, Shuang Yang, Zhaojie Liu, Tingwen Liu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, UCAS(UCAS网络安全学院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 FatsMB通过潜在空间中的偏好生成,实现从无偏到特定的多行为序列推荐,提升推荐的多样性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22907 2026-02-27 math.AP 78%

Orbital stability of monostable waves for reaction-diffusion systems

反应扩散系统中单稳波的轨道稳定性

Louis Garénaux

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究探讨了反应扩散系统中单稳波的轨道稳定性,通过显式残差核估计方法证明了在特定条件下波形的收敛性,并讨论了埃文斯与傅里叶特征值模式的差异。

Comments 37 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22871 2026-02-27 cs.CL cs.AI 78%

Test-Time Scaling with Diffusion Language Models via Reward-Guided Stitching

通过奖励引导缝合实现扩散语言模型的测试时扩展

Roy Miles, Aysim Toker, Andreea-Maria Oncescu, Songcen Xu, Jiankang Deng, Ismail Elezi

机构 * Huawei London Research Center(华为伦敦研究中心) MVP Lab(MVP实验室)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 通过奖励引导缝合实现扩散语言模型的测试时扩展,提升数学和编程任务的准确率并降低延迟

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22661 2026-02-27 cs.CL cs.AI cs.LG 78%

dLLM: Simple Diffusion Language Modeling

dLLM:简单的扩散语言建模

Zhanhui Zhou, Lingjie Chen, Hanghang Tong, Dawn Song

机构 * UC Berkeley(伯克利大学) UIUC(伊利诺伊大学香槟分校)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 dLLM提供了一个统一的开源框架,用于标准化和灵活扩展扩散语言建模的核心组件,同时提供可重现的食谱以加速小型DLMs的研究与开发。

Comments Code available at: https://github.com/ZHZisZZ/dllm

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05725 2026-02-27 cs.LG cs.AI cs.CL 78%

Improving Discrete Diffusion Unmasking Policies Beyond Explicit Reference Policies

超越显式参考策略的改进离散扩散解掩政策

Chunsan Hong, Seonho An, Min-Soo Kim, Jong Chul Ye

机构 * Graduate School of AI, KAIST(人工智能研究生院,韩国科学技术院) School of Computing, KAIST(计算学院,韩国科学技术院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种基于学习调度器的改进离散扩散解掩策略,通过KL正则化马尔可夫决策过程优化,显著提升了在多个基准测试中的性能。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17517 2026-02-27 cs.LG 78%

The Spacetime of Diffusion Models: An Information Geometry Perspective

扩散模型的空间时间:信息几何视角

Rafał Karczewski, Markus Heinonen, Alison Pouplin, Søren Hauberg, Vikas Garg

机构 * Aalto University(阿alto大学) Technical University of Denmark(技术大学) YaiYai Ltd(YaiYai公司)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文从信息几何视角提出扩散模型的空间时间结构,通过引入潜在空间时间z=(x_t,t)构建非平凡几何结构,实现高效的测地线计算和扩散编辑距离,应用于分子系统过渡路径采样。

Comments ICLR 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22505 2026-02-27 cs.LG stat.ML 78%

Sharp Convergence Rates for Masked Diffusion Models

masked扩散模型的sharp收敛速率

Yuchen Liang, Zhiheng Tan, Ness Shroff, Yingbin Liang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种基于总变差的分析方法,用于评估masked扩散模型的收敛速率,同时提供了FHS采样器的理论保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22246 2026-02-27 cs.CR cs.LG 78%

Self-Purification Mitigates Backdoors in Multimodal Diffusion Language Models

自净化缓解多模态扩散语言模型中的后门

Guangnian Wan, Qi Li, Gongfan Fang, Xinyin Ma, Xinchao Wang

机构 * National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 DiSP通过在推理过程中选择性屏蔽视觉标记,有效去除多模态扩散语言模型中的后门,无需额外模型或干净数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22235 2026-02-27 q-bio.QM cs.AI eess.IV 78%

Unsupervised Denoising of Diffusion-Weighted Images with Bias and Variance Corrected Noise Modeling

无需监督的扩散加权图像去噪:具有偏倚和方差校正的噪声建模

Jine Xie, Zhicheng Zhang, Yunwei Chen, Yanqiu Feng, Xinyuan Zhang

机构 * School of Biomedical Engineering, Southern Medical University(南方医科大学生物医学工程学院) Guangdong Provincial Key Laboratory of Medical Image Processing, Southern Medical University(南方医科大学医学图像处理广东省重点实验室) JancsiLab, JancsiTech(JancsiTech实验室) Department of Radiation Oncology, Sun Yat-sen University Cancer Center(中山大学肿瘤防治中心放射肿瘤科)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种无监督的dMRI去噪方法,通过引入偏倚和方差校正的噪声建模,有效减少Rician偏倚并提高图像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22689 2026-02-27 cs.CV cs.CR 77%

No Caption, No Problem: Caption-Free Membership Inference via Model-Fitted Embeddings

无标题,无问题:通过模型拟合嵌入进行无标题成员推断

Joonsung Jeon, Woo Jae Kim, Suhyeon Ha, Sooel Son, Sung-Eui Yoon

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

专题命中 扩散模型 :image generation(abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出MoFit框架,通过模型拟合嵌入实现无标题成员推断,克服了传统方法对真实标题的依赖,提升了在无标注场景下的成员推断性能。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05115 2026-02-27 cs.GR cs.CV cs.SD eess.AS 76%

RAP: Real-time Audio-driven Portrait Animation with Video Diffusion Transformer

RAP: 基于音频的实时人物动画与视频扩散变换器

Fangyu Du, Taiqing Li, Qian Qiao, Tan Yu, Ziwei Zhang, Dingcheng Zhen, Xu Jia, Yang Yang, Shunshun Yin, Siyuan Liu

专题命中 扩散模型 :diffusion(title);分类 cs.CV、cs.GR

AI总结 RAP通过混合注意力机制和静态-动态训练-推理范式,在实时约束下实现高质量音频驱动人物动画,提升音频-视觉同步与视觉保真度。

Comments 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22785 2026-02-27 cs.CV 74%

SceneTransporter: Optimal Transport-Guided Compositional Latent Diffusion for Single-Image Structured 3D Scene Generation

SceneTransporter: 基于最优传输的组合潜在扩散模型用于单图像结构化3D场景生成

Ling Wang, Hao-Xiang Guo, Xinzhou Wang, Fuchun Sun, Kai Sun, Pengkun Liu, Hang Xiao, Zhong Wang, Guangyuan Fu, Eric Li, Yang Liu, Yikai Wang

机构 * Xi’an Research Institute of Hi-Tech(西安高新技术研究院) Tsinghua University(清华大学) SkyWork AI Tongji University(同济大学) Fudan University(复旦大学) Beijing Normal University(北京师范大学)

专题命中 扩散模型 :diffusion(title);分类 cs.CV

AI总结 SceneTransporter通过最优传输引导的组合潜在扩散模型,提升单图像结构化3D场景生成的实例连贯性和几何保真度。

Comments published at iclr 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09293 2026-02-27 cs.CV cs.GR 73%

StableMaterials: Enhancing Diversity in Material Generation via Semi-Supervised Learning

StableMaterials: 通过半监督学习增强材料生成的多样性

Giuseppe Vecchio

机构 * Adobe Research(Adobe研究院)

专题命中 扩散模型 :image generation(abstract);diffusion(abstract);分类 cs.CV、cs.GR

AI总结 StableMaterials通过半监督学习与潜在扩散模型结合,提升材料生成的多样性和视觉质量,实现快速高效生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23157 2026-02-27 math.OC 71%

Operator learning for prescribed-time stabilization of reaction-diffusion systems

运算学习用于反应扩散系统的预设时间稳定化

Kaijing Lyu, Umberto Biccari, Jun-Min Wang

专题命中 扩散模型 :diffusion(title)

AI总结 本文提出基于神经运算的预设时间稳定化方法,用于解决具有空间和时间变化系数的反应扩散系统稳定化问题,通过减少计算成本实现实时应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22226 2026-02-27 cs.IR cs.LG 71%

SEGB: Self-Evolved Generative Bidding with Local Autoregressive Diffusion

SEGB: 自适应生成性竞价与局部自回归扩散

Yulong Gao, Wan Jiang, Mingzhe Cao, Xuepu Wang, Zeyu Pan, Haonan Yang, Ye Liu, Xin Yang

机构 * Beijing China(中国北京)

专题命中 扩散模型 :diffusion(title)

AI总结 SEGB通过自适应生成性竞价与局部自回归扩散,实现动态市场中的高效竞价策略,显著提升广告效果与商业价值。

详情

展开后加载摘要…

URL PDF HTML 收藏