arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-12-22 至 2025-12-22 共收录 45 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 45 篇

2512.16625 2025-12-22 cs.CV 89%

DeContext as Defense: Safe Image Editing in Diffusion Transformers

DeContext作为防御:扩散变换器中的安全图像编辑

Linghui Shen, Mingyue Cui, Xingyi Yang

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 扩散模型 :diffusion(title,abstract);image editing(title);image generation(abstract);text-to-image(abstract)

AI总结 DeContext通过扰动注意力层来防止图像编辑,有效保护输入图像免受未经授权的修改。

Comments 17 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17782 2025-12-22 cs.CV 83%

UrbanDIFF: A Denoising Diffusion Model for Spatial Gap Filling of Urban Land Surface Temperature Under Dense Cloud Cover

UrbanDIFF: 一种用于密集云覆盖下城市地表温度空间填补的去噪扩散模型

Arya Chavoshi, Hassan Dashtian, Naveen Sudharsan, Dev Niyogi

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

AI总结 UrbanDIFF是一种基于去噪扩散模型的城市地表温度空间填补方法,通过静态城市结构信息和监督像素引导细化步骤,有效应对密集云覆盖下的LST重建问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17578 2025-12-22 cs.CV 83%

3One2: One-step Regression Plus One-step Diffusion for One-hot Modulation in Dual-path Video Snapshot Compressive Imaging

3One2: 一步回归加一步扩散用于双路径视频压缩成像中的one-hot调制

Ge Wang, Xing Liu, Xin Yuan

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

AI总结 3One2通过结合一步回归和一步扩散方法,解决双路径视频压缩成像中的one-hot调制问题,实现高效的时间解耦和空间增强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17573 2025-12-22 cs.CV 83%

RoomEditor++: A Parameter-Sharing Diffusion Architecture for High-Fidelity Furniture Synthesis

RoomEditor++: 一种用于高保真家具合成的参数共享扩散架构

Qilong Wang, Xiaofan Ming, Zhenyi Lin, Jinwen Li, Dongwei Ren, Wangmeng Zuo, Qinghua Hu

机构 * School of Artificial Intelligence, Tianjin University(天津大学人工智能学院) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) Engineering Research Center of City Intelligence and Digital Governance, Ministry of Education(教育部城市智能与数字治理工程研究中心)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

AI总结 RoomEditor++通过参数共享的扩散架构实现高保真家具合成,提供公开数据集并优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07449 2025-12-22 cs.CV 83%

Tracing the Roots: Leveraging Temporal Dynamics in Diffusion Trajectories for Origin Attribution

追溯根源:利用扩散轨迹的时间动态性进行起源归因

Andreas Floros, Seyed-Mohsen Moosavi-Dezfooli, Pier Luigi Dragotti

机构 * Imperial College London(伦敦帝国学院)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出利用扩散轨迹的时间动态性,解决图像起源归因问题,挑战现有成员推断方法,并提出统一的数据来源框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17675 2025-12-22 cs.CV cs.AI 79%

An Empirical Study of Sampling Hyperparameters in Diffusion-Based Super-Resolution

扩散基超分辨率中采样超参数的实证研究

Yudhistira Arief Wibowo

机构 * Technical University of Munich(慕尼黑技术大学) Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本研究通过实证分析发现,在扩散模型超分辨率中,条件步长对性能影响显著大于扩散步数,最佳步长范围为[2.0, 3.0]。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17323 2025-12-22 cs.CV 79%

DESSERT: Diffusion-based Event-driven Single-frame Synthesis via Residual Training

DESSERT: 基于扩散的事件驱动单帧合成 via 剩余训练

Jiyun Kong, Jun-Hyuk Kim, Jong-Seok Lee

机构 * Yonsei University(延世大学) Chung-Ang University(Chung-Ang 大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DESSERT通过基于扩散的剩余训练方法,实现了更清晰且时间一致的事件驱动单帧合成,优于现有多种视频帧预测方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17253 2025-12-22 cs.CV 79%

Mitty: Diffusion-based Human-to-Robot Video Generation

Mitty:基于扩散的Human-to-Robot视频生成

Yiren Song, Cheng Liu, Weijia Mao, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Mitty通过基于扩散的变换器实现端到端的人机视频生成,利用预训练模型和双向注意力机制,无需动作标签或中间抽象,生成高质量的机器人执行视频。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05814 2025-12-22 eess.IV cs.CV 79%

MSDiff: Multi-Scale Diffusion Model for Ultra-Sparse View CT Reconstruction

MSDiff:多尺度扩散模型用于超稀疏视角CT重建

Junyan Zhang, Mengxiao Geng, Pinhuang Tan, Yi Liu, Zhili Liu, Bin Huang, Qiegen Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 MSDiff通过多尺度扩散模型提升超稀疏视角CT重建质量,整合全面与选择性采样技术,优化噪声分布与图像结构理解,实现更高效的图像恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12019 2025-12-22 cs.CV 79%

LN3DIFF++: Scalable Latent Neural Fields Diffusion for Speedy 3D Generation

LN3DIFF++: 可扩展的潜在神经场扩散用于快速3D生成

Yushi Lan, Fangzhou Hong, Shangchen Zhou, Shuai Yang, Xuyi Meng, Yongwei Chen, Zhaoyang Lyu, Bo Dai, Xingang Pan, Chen Change Loy

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 LN3DIFF++通过3D感知架构和变分自编码器实现快速高质量的3D生成,优于现有方法在推理速度和生成质量上。

Comments TPAMI 2025 version of LN3Diff. Project webpage: https://nirvanalan.github.io/projects/ln3diff/ Code: https://github.com/NIRVANALAN/LN3Diff

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17568 2025-12-22 cs.RO 79%

Kinematics-Aware Diffusion Policy with Consistent 3D Observation and Action Space for Whole-Arm Robotic Manipulation

具有一致3D观察和动作空间的运动学感知扩散策略用于全身机械臂操作

Kangchen Lv, Mingrui Yu, Yongyi Jia, Chenyu Zhang, Xiang Li

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出一种基于一致3D空间的运动学感知扩散策略,用于提高全身机械臂操作的样本效率和空间泛化能力。

Comments The first two authors contributed equally. Project Website: https://kinematics-aware-diffusion-policy.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17859 2025-12-22 cond-mat.mtrl-sci 78%

InfinityEBSD : Metrics-Guided Infinite-Size EBSD Map Generation With Diffusion Models

InfinityEBSD : 基于度量的无限大小EBSD地图生成与扩散模型

Sterley Labady, Youssef Mesri, Daniel Pino Munoz, Baptiste Flipon, Marc Bernacki

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 InfinityEBSD利用扩散模型和物理度量生成任意大小的EBSD地图,实现大范围微观结构模拟与真实材料表征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17661 2025-12-22 cs.RO cs.LG 78%

Vidarc: Embodied Video Diffusion Model for Closed-loop Control

Vidarc:用于闭环控制的具身视频扩散模型

Yao Feng, Chendong Xiang, Xinyi Mao, Hengkai Tan, Zuyue Zhang, Shuhe Huang, Kaiwen Zheng, Haitian Liu, Hang Su, Jun Zhu

机构 * Dept. of Comp. Sci. and Tech., Institute for AI, BNRist Center, THBI Lab, Tsinghua-Bosch Joint ML Center, Tsinghua University(计算机科学与技术系,人工智能研究院,BNRist中心,THBI实验室,清华-博世联合机器学习中心,清华大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 Vidarc 提出了一种基于视频扩散的具身模型,通过掩码反向动力学模型实现快速准确的闭环控制,提升了现实部署中的成功率和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10892 2025-12-22 cs.LG cs.AI cs.CL 78%

The Diffusion Duality

扩散对偶性

Subham Sekhar Sahoo, Justin Deschenaux, Aaron Gokaslan, Guanghan Wang, Justin Chiu, Volodymyr Kuleshov

机构 * School of Computer and Communication Sciences, EPFL(计算机与通信科学学院,瑞士洛桑联邦理工学院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 Duo通过结合高斯扩散技术提升训练和采样效率,实现离散扩散模型在文本生成中的性能突破。

Comments ICML 2025. We provide the code at: https://github.com/s-sahoo/duo [v3] includes improved theory, clearer presentation, and a new future work section

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13071 2025-12-22 math.PR math.AP 78%

Fractional diffusion in convex domains and reflected isotropic stable processes

凸域中的分数扩散与反射各向同性稳定过程

Loïc Béthencourt, Nicolas Fournier

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究了强凸域中反射各向同性稳定过程的分数扩散极限,通过Ito合成构造边界过程并推导了反射分数热方程。

Comments Appendix A by Laurent Mazet

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10063 2025-12-22 cs.CR 78%

Provably Secure Covert Messaging Using Image-based Diffusion Processes

基于图像扩散过程的可证明安全隐写术

Luke A. Bauer, Wenxuan Bao, Vincent Bindschaedler

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种在图像扩散模型初始潜在空间中嵌入隐写信息的方法,确保信息传输的安全性和鲁棒性,通过数学证明其对对手不可区分,并分析了嵌入容量与恢复率的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17138 2025-12-22 eess.SP 78%

BM4D-PC: nonlocal volumetric denoising of principal components of diffusion-weighted MR images

BM4D-PC:非局部体积分量去噪扩散加权MRI图像的主成分

Vinicius P. Campos, Diego Szczupak, Tales Santini, Afonso C. Silva, Alessandro Foi, Marcelo A. C. Vieira, Corey A. Baron

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 BM4D-PC通过结合BM4D算法和主成分分析,实现扩散加权MRI图像的高效去噪,提升图像质量和扩散指标精度。

Comments Submitted to Magnetic Resonance in Medicine

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16931 2025-12-22 physics.comp-ph 78%

On Energy-Dependent Neutron Diffusion

关于能量依赖的中子扩散

Gabriele Burgio, Christian Reiter, Stefano Lorenzi

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种多群扩散方程的正式渐近推导,解决了不同近似方法之间的差异,并给出了精确的扩散系数计算方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19011 2025-12-22 cs.LG cs.AI 78%

STDiff: A State Transition Diffusion Framework for Time Series Imputation in Industrial Systems

STDiff:一种用于工业系统时间序列填补的状态转换扩散框架

Gary Simethy, Daniel Ortiz-Arroyo, Petar Durdevic

机构 * Department of Energy Technology(能源技术系) Aalborg University(奥胡斯大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 STDiff通过状态转换扩散框架实现工业时间序列填补,结合长距离一致性和短期细节,优于现有神经基线模型,保留动态并提升预测性能。

Comments Peer-reviewed and published in Expert Systems with Applications, Volume 302 (2026). This version reflects the published article

Journal ref Expert Systems with Applications, Volume 302, 2026, Article 130592

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20439 2025-12-22 cond-mat.mtrl-sci 78%

Multiscale modeling of hydrogen diffusion in iron considering the effect of dislocations

考虑位错影响的铁中氢扩散多尺度建模

Gonzalo Álvarez, Álvaro Ridruejo, Javier Segurado

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究通过多尺度方法分析铁中氢扩散,考虑位错对扩散张量的影响,揭示位错通过微应力降低扩散率并破坏各向同性。

Comments 32 pages, 6 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13431 2025-12-22 cs.RO 78%

A Practical Guide for Incorporating Symmetry in Diffusion Policy

在扩散策略中融入对称性的实用指南

Dian Wang, Boce Hu, Shuran Song, Robin Walters, Robert Platt

机构 * Stanford University(斯坦福大学) Northeastern University(东北大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出在扩散策略中融入对称性的实用方法,通过不变表示、等变视觉编码器和对称特征提取提升策略性能,实现高效且简单的实现。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10432 2025-12-22 cs.LG physics.ao-ph 78%

How to use score-based diffusion in earth system science: A satellite nowcasting example

如何利用基于分数的扩散模型用于地球系统科学:一个卫星现在预报示例

Randy J. Chase, Katherine Haynes, Lander Ver Hoef, Imme Ebert-Uphoff

机构 * Cooperative Institute for Research in the Atmosphere, Colorado State University, Fort Collins, CO(大气研究合作研究所,科罗拉多州立大学,福尔科尔斯)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文通过卫星现在预报示例,展示基于分数的扩散模型在地球科学中的应用,验证了CorrDiff方法在云生成与衰减方面的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17650 2025-12-22 cs.CV cs.MM 73%

Region-Constraint In-Context Generation for Instructional Video Editing

区域约束的上下文生成用于教学视频编辑

Zhongwei Zhang, Fuchen Long, Wei Li, Zhaofan Qiu, Wu Liu, Ting Yao, Tao Mei

机构 * University of Science and Technology of China(中国科学技术大学) HiDream.ai Inc.(HiDream.ai公司)

专题命中 扩散模型 :diffusion(abstract);image editing(abstract);分类 cs.CV、cs.MM

AI总结 ReCo通过引入区域约束建模,提升基于指令的视频编辑中编辑区域的准确性和去噪效果,提出新的正则化方法和大规模数据集。

Comments Project page: https://zhw-zhang.github.io/ReCo-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17907 2025-12-22 cs.CV 57%

Dexterous World Models

灵巧世界模型

Byungjun Kim, Taeksoo Kim, Junyoung Lee, Hanbyul Joo

机构 * Seoul National University(首尔国立大学) RLWRLD

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 灵巧世界模型通过场景-动作-条件的视频扩散框架,实现静态3D场景与灵巧人类动作的动态交互模拟,推动交互式数字双胞胎的发展。

Comments Project Page: snuvclab.github.io/dwm

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17302 2025-12-22 cs.CV 57%

MatLat: Material Latent Space for PBR Texture Generation

MatLat:用于PBR纹理生成的材料潜在空间

Kyeongmin Yeo, Yunhong Min, Jaihoon Kim, Minhyuk Sung

机构 * KAIST(韩国科学技术院)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 MatLat通过微调预训练VAE学习材料潜在空间,提升PBR纹理生成的保真度和性能

Comments Project page: https://matlat-proj.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14862 2025-12-22 cs.LG cs.CL cs.CV 57%

LatentExplainer: Explaining Latent Representations in Deep Generative Models with Multimodal Large Language Models

LatentExplainer: 通过多模态大语言模型解释深度生成模型中的潜在表示

Mengdan Zhu, Raasikh Kanjiani, Jiahui Lu, Andrew Choi, Qirui Ye, Liang Zhao

机构 * Emory University(埃默里大学) University College London(伦敦大学学院)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 LatentExplainer通过多模态大语言模型为深度生成模型的潜在变量生成语义解释,提升模型可解释性。

Comments Accepted to CIKM 2025 Full Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17878 2025-12-22 cs.LG cs.AI stat.ML 50%

Weighted Stochastic Differential Equation to Implement Wasserstein-Fisher-Rao Gradient Flow

带权随机微分方程实现Wasserstein-Fisher-Rao梯度流

Herlock Rahimi

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出通过带权随机微分方程实现Wasserstein-Fisher-Rao梯度流,以改进生成建模中的采样效率。

Comments 26 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17764 2025-12-22 cs.RO 50%

UniStateDLO: Unified Generative State Estimation and Tracking of Deformable Linear Objects Under Occlusion for Constrained Manipulation

UniStateDLO:统一的生成式状态估计与变形线性物体在遮挡下的跟踪用于受限操作

Kangchen Lv, Mingrui Yu, Shihefeng Wang, Xiangyang Ji, Xiang Li

机构 * Department of Automation, Tsinghua University(自动化系,清华大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 UniStateDLO通过深度学习方法实现可变形线性物体在遮挡下的鲁棒状态估计与跟踪,利用扩散模型提升复杂映射的捕捉能力,展现高效的数据利用和仿真到现实的泛化能力。

Comments The first two authors contributed equally. Project page: https://unistatedlo.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17725 2025-12-22 math.AP 50%

The Fractional Stefan Problem: Global Regularity of the Bounded Selfsimilar Solution"

分数阶Stefan问题:有界自相似解的全局正则性

Marcos Llorca, Juan Luis Vázquez

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了分数阶Stefan问题中自相似解的正则性,发现临界指数$ s=1/2 $决定解的正则性,亚临界情况下具有更高正则性,而临界及超临界情况下解在自由边界处不满足Lipschitz连续性。

Comments 60 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17649 2025-12-22 math.AP 50%

Stability analysis for active Brownian particle models

主动布朗粒子模型的稳定性分析

Michele Coti Zelati, Lucas Ertzbischoff, David Gerard-Varet

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文通过线性稳定性分析,揭示了主动布朗粒子模型在非扩散和小角扩散情况下的稳定性特征,并发现其相分离机制与Landau阻尼类似但衰减更弱。

详情

展开后加载摘要…

URL PDF HTML 收藏