arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-25 至 2026-08-25 共收录 161 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 129 篇

2607.01156 2026-08-25 physics.comp-ph cs.CE physics.geo-ph 版本更新 50%

Verification of a sequential thermo-poroelasticity formulation in PFLOTRAN

PFLOTRAN中顺序热-孔隙弹性公式的验证

J. Al Kubaisy, G. E. Hammond, S. Karra, J. Burghardt, L. Murdoch, T. Johnson, K. M. Rosso

专题命中 扩散模型 :diffusion(abstract)

AI总结 在PFLOTRAN框架中实现了热-水-力耦合,采用顺序非迭代固定应力分裂策略,通过基准测试验证了孔隙弹性与热-孔隙弹性响应,并提出了处理不连续性的方法。

Comments 22 pages, 14 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12553 2026-08-25 cond-mat.mtrl-sci 版本更新 50%

Hierarchical Interdiffusion Kinetics in Nanoscale Ni/Al Multilayers

纳米Ni/Al多层膜中的层级互扩散动力学

S. S. Riegler, I. Gallino, N. J. Peter, A. Tarasov, T. Meyer, J. Schmauch, C. Pauly, M. Frey, Y. H. Sauni Camposano, H. Bartsch, R. Schwaiger, P. Schaaf, R. Busch, J. Arlt

专题命中 扩散模型 :diffusion(abstract)

AI总结 结合快速差示扫描量热法和扫描透射电镜,揭示了纳米Ni/Al多层膜中层级互扩散动力学:低温下Ni沿Al晶界扩散,高温下从晶界向晶内扩散,晶界是控制反应起始的关键微结构参数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05930 2026-08-25 cond-mat.stat-mech 50%

Thermodynamics of bouncing grains

弹跳颗粒的热力学

Olivier Devauchelle, Predrag Popović, Piotr Szymczak, Anaïs Abramian, Arnaud Lazarus

专题命中 扩散模型 :diffusion(abstract)

AI总结 通过实验研究振动板上弹跳颗粒的扩散行为,发现其类似于经典分子扩散,定义了颗粒温度并验证了涨落-耗散定理,但在温度不均匀时菲克定律失效,支持一种新的输运关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01805 2026-08-25 nucl-th hep-th 版本更新 50%

Hydrodynamics without a relaxation gap: memory effects, nonlocality, and superdiffusion

无弛豫间隙的流体动力学:记忆效应、非定域性和超扩散

Lorenzo Gavassino, Sukanya Mitra, Rajeev Singh

专题命中 扩散模型 :diffusion(abstract)

AI总结 通过研究能量依赖弛豫时间无上界的相对论粒子传播模型,探讨长时记忆如何阻碍具有无间隙非流体动力学扇区的系统中定域流体动力学的出现,并揭示梯度展开发散的根本原因及超扩散行为。

Comments 11 pages, 2 figures, published in PRD (see https://journals.aps.org/prd/abstract/10.1103/9362-8gmq)

Journal ref Phys. Rev. D 114, 034038 (August 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01027 2026-08-25 cs.RO 版本更新 50%

$τ_0$-WM: A Unified Video-Action World Model for Robotic Manipulation

$\tau_0$-WM:一种用于机器人操作的统一视频-动作世界模型

Pengfei Zhou, Shengcong Chen, Di Chen, Jiaxu Wang, Rongjun Jin, Bingwen Zhu, Yike Pan, Songen Gu, Kuanning Wang, Shufeng Nan, Xingyu Qiu, Chenhao Qiu, Pu Yang, Yunuo Cai, Jianxiong Gao, Yifan Li, Yanwei Fu, Xiangyu Yue, Zhi Chen, Jianlan Luo

机构 * Shanghai Innovation Institute(上海创新研究院) AGIBOT Finch

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出$\tau_0$-WM,一个统一视频-动作世界模型,通过共享视频扩散骨干集成策略学习、视频预测和动作评估,在长时域和精细操作任务上优于基线。

Comments Our project homepge: https://tau0-wm.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19292 2026-08-25 math.DS math.PR 版本更新 50%

Most Probable KAM Tori in Stochastic Hamiltonian Systems Driven by Multiplicative Noise

随机激励哈密顿系统中最可能的KAM环面

Xinze Zhang, Yong Li, Xue Yang

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了随机扰动,特别是乘性噪声,对哈密顿系统可积结构的影响,重点在于随机哈密顿动力学中的KAM理论。证明在适当假设下,对于同时受小确定性扰动和乘性噪声影响的可积哈密顿系统,具有迪奥菲antine频率的不变环面在最可能路径的意义下保持存在。此外,当乘性噪声强度足够小时,利用大偏差原理来表征解轨迹偏离这些不变环面的渐近概率,并推导出相应的速率函数。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20821 2026-08-25 cond-mat.dis-nn cond-mat.stat-mech 版本更新 50%

Autonomous Emergence of Hamiltonian in Deep Generative Models

深度生成模型中哈密顿量的自主涌现

Wenjie Xi, Wei-Qiang Chen

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究探讨深度生成模型是否能自主推导物理规律,通过构建代数框架提取隐含相互作用,验证生成模型能自主恢复自旋系统微观哈密顿量参数。

Comments 9 pages, 4 figures, find code in: https://github.com/WJXI/emergent-Hamiltonian-from-AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10708 2026-08-25 quant-ph 版本更新 50%

Gate-Level Quantum Simulation of Nonunitary Linear Dynamics with Hybrid Oscillator-Qubit Architecture

通过混合振子-量子比特线性组合哈密顿量模拟求解量子微分方程

Elin Ranjan Das, Muqing Zheng, Rishab Dutta, Ang Li, Timothy Stavenger, Yuan Liu

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种混合振子-量子比特方法,用于求解线性常微分方程,通过连续变量辅助模式替代离散变量辅助寄存器,减少量子比特开销,并展示其在热方程中的高保真度表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02509 2026-08-25 physics.chem-ph 50%

Quantitative and Predictive Folding Models from Limited Single-Molecule Data Using Simulation-Based Inference

基于模拟推理的有限单分子数据中定量与预测折叠模型构建

Lars Dingeldein, Aaron Lyons, Pilar Cossio, Michael Woodside, Roberto Covino

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出基于模拟推理的框架,利用单分子数据重建DNA发夹和核糖开关的折叠自由能景观,通过深度学习与物理建模结合,实现对折叠动力学的预测,且无需大量数据。

Journal ref hys. Rev. Lett. 137, 088402, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18609 2026-08-25 stat.AP 版本更新 50%

The Broken Shield of European Palliative Care: Evidence from Synthetic Counterfactuals on Financial Toxicity and Informal Care

欧洲姑息医疗的‘破碎盾牌’:基于合成反事实的财务毒性与非正式护理证据

Pietro Grassi, Edoardo Paperi, Chiara Seghieri, Daniele Vignoli

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文通过合成数据生成框架,探讨姑息医疗在缓解经济负担和减轻家庭护理压力方面的双重作用,揭示了脆弱家庭和极端事件中医疗体系的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14998 2026-08-25 quant-ph 版本更新 50%

Investigating Spectral Dynamics and Spin Signatures of a Mechanically Isolated Quantum Emitter in hBN

研究六方氮化硼中机械隔离量子发射体的光谱动力学和自旋特征

Sajedeh Shahbazi, Alexander Pachl, Kathrin Schwer, Patrick Maier, Alexander Kubanek

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了六方氮化硼中机械隔离量子发射体的光谱动态和自旋特性,发现其具有高亮度共振荧光,并揭示了不同自旋依赖态的弛豫动力学。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13929 2026-08-25 physics.optics cond-mat.soft 版本更新 50%

Three-dimensional photon transport in spinodal photocatalytic aerogels: how bicontinuous morphology controls kinetic rate constants

三维光子输运在分相光催化气凝胶中的研究:双连续形态如何控制速率常数

Renaud A. L. Vallée

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究通过结合3D分相结构与GPU MC方法,揭示双连续形态对光催化速率常数的影响,发现光子通道效应导致固相接收到的光子比体积平均多50%-70%,并指出有效介质理论无法完全解释分相结构的内在差异。

Comments 39 pages, 12 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07110 2026-08-25 cond-mat.mtrl-sci 50%

Towards viable H$_2$ storage in Ca decorated low-dimensional materials with insights from reference quantum Monte Carlo

迈向具有钙修饰低维材料的可行氢气存储方法:来自参考量子蒙特卡罗研究的见解

Yasmine S. Al-Hamdani, Dario Alfè, Andrea Zen

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究通过量子蒙特卡罗方法和密度泛函近似,探讨钙修饰低维材料中氢气的吸附性能,发现钙锚定在碳纳米管和硼掺杂石墨烯上可提升氢吸附能,达到可行存储窗口。

Journal ref J. Chem. Phys. 165, 054703 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21025 2026-08-25 q-bio.PE 版本更新 50%

Pattern Formation in a Spatial Public Goods Dilemma due to Diffusive or Directed Motion

由于扩散或定向运动导致的空间公共物品困境中的图案形成

Yuxuan Zhao, Kaisheng Zhu, Yefei Zhang, Daniel B. Cooney

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究探讨了扩散或定向运动如何影响公共物品困境中的合作行为,通过偏微分方程模型分析了策略分布和公共物品的空间模式,发现扩散和定向运动均可引发空间异质性。

Comments Accepted for publication in Bulletin of Mathematical Biology. Added several figures illustrating bifurcation behavior over a wide range of reaction parameters

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18902 2026-08-25 math.PR 版本更新 50%

Stochastic invariance in infinite dimension beyond Lipschitz coefficients

无穷维中超越利普希茨系数的随机不变性

Eduardo Abi Jaber, Stefan Tappe

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了无穷维随机微分方程中闭子集的随机不变性条件,提出基于散射算子的修正漂移和正最大原理的两种特征化方法,并通过不变流形案例进行验证。

Comments 84 pages decomposing into the main article (pp. 1-52) and an appendix about geometry, stochastic processes and smooth functions in infinite dimension (pp. 53-84)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11095 2026-08-25 cond-mat.stat-mech 版本更新 50%

Stochastic synthesis-degradation processes: first-passage properties and connections with resetting

随机合成-降解过程:首次通过性质及与重置的联系

Gabriel Mercado-Vásquez, Denis Boyer

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究随机合成-降解过程的首次通过性质,发现其在特定条件下能优化搜索效率,与重置过程有相似特性。

Comments 6 pages, 3 Figures. (7 pages of Suppl. Mat.)

Journal ref Phys. Rev. E 114, L022107 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17910 2026-08-25 math.ST stat.TH 版本更新 50%

Quasi-likelihood inference for SDE with mixed-effects observed at high frequency

具有混合效应的随机微分方程的准似然推断

Maud Delattre, Hiroki Masuda

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种基于准似然函数的高频观测下混合效应随机微分方程的推断方法,通过分步处理随机效应和漂移效应,实现了理论性质的证明和计算效率的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18987 2026-08-25 cond-mat.soft physics.bio-ph 50%

Junctional-Fluctuation-Mediated Fluidisation of Multi-Phase Field Epithelial Monolayers

James N. Graham, Jan Rozman

专题命中 扩散模型 :diffusion(abstract)

Journal ref Phys. Rev. E 114, 024407 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14357 2026-08-25 cond-mat.stat-mech 版本更新 50%

Non-equilibrium and first-passage properties of generalized Ornstein-Uhlenbeck processes under stochastic resetting

随机重置下广义奥恩斯坦-乌伦贝克过程的非平衡与首通性质

Anna S. Bodrova, S. I. Serdyukov

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究探究一维随机重置下广义奥恩斯坦-乌伦贝克过程的非平衡空间性质,运用扩展的Onsager-Machlup涨落理论与更新形式论,计算非平衡稳态的均方位移、概率密度函数及受限区间内的平均首通时间,发现重置可缩短平均首通时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.00379 2026-08-25 cs.LG physics.comp-ph 版本更新 50%

Residual-based attention in physics-informed neural networks

物理信息神经网络中基于残差的注意力机制

Sokratis J. Anagnostopoulos, Juan Diego Toscano, Nikolaos Stergiopulos, George Em Karniadakis

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究针对物理信息神经网络(PINNs)收敛性与准确性的可靠性挑战,提出基于演化累积残差的无梯度注意力机制,可加速收敛、提升精度,在基准测试及脑周血管空间Navier-Stokes逆问题中表现优异,或成为PINNs快速训练的关键要素。

Journal ref Anagnostopoulos, S.J., Toscano, J.D., Stergiopulos, N. and Karniadakis, G.E., 2024. Residual-based attention in physics-informed neural networks. Computer Methods in Applied Mechanics and Engineering, 421, p.116805

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 12 篇

2608.23140 2026-08-25 cs.CV cs.RO 新提交 79%

MIVIFI: Bridging Perspective and Fisheye Domains for Training Multi-View Fisheye Image Generation Models

MIVIFI:弥合透视域与鱼眼域以训练多视图鱼眼图像生成模型

Matthias Neuwirth-Trapp, Begüm Altunbas, Jiayi Wang, Yan Xia, Maarten Bieshaar, Xinyu Huang, Daniel Cremers

机构 * ETH Zurich(苏黎世联邦理工学院) Bosch Research(博世研究中心) Technical University of Munich(慕尼黑工业大学)

专题命中 可控生成 :image generation(title,abstract);分类 cs.CV

AI总结 本研究针对多视图鱼眼图像生成问题,提出SyntheOcc-FE与MIVIFI两种方法,其中MIVIFI利用跨域学习缓解鱼眼数据稀缺问题,实现高保真的多视图鱼眼图像生成。

Comments Accepted at the IEEE International Conference on Intelligent Transportation Systems (ITSC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23238 2026-08-25 cs.CV 新提交 70%

Mover360: Controllable Object Manipulation in 360° Panoramic Images

Mover360:360°全景图像中的可控物体操作

Haoyi Zhong, Fang-Lue Zhang, Andrew Chalmers, Taehyun Rhee

机构 * Victoria University of Wellington(惠灵顿维多利亚大学) University of New South Wales(新南威尔士大学) The University of Melbourne(墨尔本大学)

专题命中 可控生成 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 Mover360是针对360°全景图像的可控物体操作框架,以物体平移为核心,支持插入、移除辅助任务,在多域多评估协议下优于相关强基线,代码与基准数据集已公开。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22329 2026-08-25 cs.MM cs.CV 新提交 62%

ReART: Reference-Guided Retrieval and Refinement for Emotion-Aware Art Generation

ReART:用于情感感知艺术生成的参考引导检索与细化

Qianqian Tang, Jiayi Gao, Ting Lei, Yang Liu

专题命中 可控生成 :image generation(abstract);分类 cs.CV、cs.MM

AI总结 ReART框架通过参考引导检索与AAS驱动的细化,在AffectiveArt 2026挑战赛Track 1中获第2,实现1.00的AAS与0.78总分,用于情感感知艺术生成。

Comments Accepted by ACM Multimedia 2026 (Grand Challenge Track 1), 7 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23549 2026-08-25 cs.CV 新提交 57%

FixAnything: 3D-Consistent Rendering Refinement via Video Generative Priors

FixAnything:基于视频生成先验的3D一致性渲染优化

Khiem Vuong, Deva Ramanan, Srinivasa Narasimhan

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 FixAnything是一款复用预训练视频生成模型、仅需轻量微调的单一模型,可修复3DGS、NeRF等四种3D表示的渲染伪影,实现3D一致性渲染,替代多个专用优化管线。

Comments Appearing in ECCV 2026. Project page: https://fix-anything.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22828 2026-08-25 cs.CV 新提交 57%

VeCAS: Vessel-Focused Contrast-Free Angiogram Synthesis for Vascular Interventions

VeCAS:面向血管介入的聚焦血管的无造影剂血管造影合成

De-Xing Huang, Chen-Yu Wang, Hao Liang, Xiao-Hu Zhou, Mei-Jiang Gui, Tian-Yu Xiang, Qin-Yi Zhang, Chen Wang, Xiao-Liang Xie, Shi-Qi Liu, Ming-Yuan Liu, Zhen-Chang Wang, Zeng-Guang Hou

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

AI总结 本文提出VeCAS框架,通过两阶段合成实现无造影剂血管造影,在下肢数据集实验中优于对比方法,还可缩短机器人导丝导航的时间与步骤,具临床应用潜力。

Comments 10 pages, 8 figures, 5 tabels, supplementary material: https://dxhuang-casia.github.io/data/vecas_supplementary_material.pdf

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21659 2026-08-25 cs.CV 新提交 57%

SketchFlow: Zero-Shot Vector Sketch Generation via GMM Prior Flow in CLIP Latent Space

SketchFlow:基于CLIP潜在空间中GMM先验流的零样本矢量草图生成

Jin Zhou, Hongliang Yang, Pengfei Xu, Hui Huang

机构 * Guangdong Provincial Key Laboratory of Visual Media and Multidimensional Intelligence(广东省视觉媒体与多维智能重点实验室) Shenzhen University(深圳大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 SketchFlow是基于CLIP潜在空间的零样本矢量草图生成框架,通过GMM先验流匹配与混合扩散解码器,实现了优于基线的视觉质量与零样本泛化能力。

Comments Accepted to SIGGRAPH Asia 2026 Conference Papers. 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17445 2026-08-25 cs.CV 版本更新 57%

LangDriveCTRL: Natural Language Controllable Driving Scene Editing with Multi-modal Agents

LangDriveCTRL: 通过多模态代理实现自然语言可控的驾驶场景编辑

Yun He, Francesco Pittaluga, Ziyu Jiang, Matthias Zwicker, Manmohan Chandraker, Zaid Tasneem

机构 * University of Maryland, College Park(马里兰大学帕克分校) NEC Labs America(NEC美国实验室) UC San Diego(加州大学圣迭戈分校)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 LangDriveCTRL通过多模态代理实现驾驶视频的自然语言可控编辑,生成多样化的交通场景,提升真实感和交通场景的真实性。

Comments Accepted by ECCV 2026. Project Page: https://yunhe24.github.io/langdrivectrl/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18422 2026-08-25 cs.CV 版本更新 57%

Generated Reality: Human-centric World Simulation using Interactive Video Generation with Hand and Camera Control

生成现实:基于交互式视频生成的人本世界模拟

Linxi Xie, Lisong C. Sun, Ashley Neall, Tong Wu, Shengqu Cai, Gordon Wetzstein

机构 * Stanford University(斯坦福大学) NYU Shanghai(纽约大学上海分校) UNC Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 本文提出了一种基于交互式视频生成的人本世界模拟系统,通过结合头部和手部姿态控制,提升虚拟环境的交互性和用户控制感。

Comments Project page here: https://codeysun.github.io/generated-reality

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05076 2026-08-25 cs.CV 版本更新 57%

BulletTime: Decoupled Control of Time and Camera Pose for Video Generation

BulletTime: 分离时间与相机姿态的视频生成控制

Yiming Wang, Qihang Zhang, Shengqu Cai, Tong Wu, Jan Ackermann, Zhengfei Kuang, Yang Zheng, Frano Rajič, Siyu Tang, Gordon Wetzstein

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 BulletTime通过分离时间与相机姿态,实现了视频生成的精细控制与高质量生成。

Comments CVPR 2026, Project Page: https://19reborn.github.io/Bullet4D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22367 2026-08-25 cs.CL 新提交 50%

Context-Aware Cluster Decoding: Semantic Anchor-Driven Coherence in dMLLMs

上下文感知集群解码:dMLLMs中的语义锚驱动连贯性

Yikai Zhao, Qiyan Zhao, Jiaquan Zhang, Xiaofeng Zhang, Xiaosong Yuan, Pengzhou Cheng

机构 * Sun Yat-sen University(中山大学) Shanghai Jiao Tong University(上海交通大学) University of Electronic Science and Technology of China(电子科技大学) Alibaba Group(阿里巴巴集团) Shanghai University(上海大学)

专题命中 可控生成 :diffusion(abstract)

AI总结 针对 dMLLMs 生成长文本时的语义漂移与重复问题,提出上下文感知集群解码方法,结合置信度与邻域邻近度评分,在多模型多基准上实现质量提升并减少幻觉。

Comments This paper is accepted by EMNLP 2026. 19 pages, 12 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏