arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

世界模型

面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。

共收录 6506 信号源:cs.AI, cs.LG, cs.CV, cs.RO, cs.MA

1. 模型式强化学习 1126 篇

1907.04202 2019-10-08 cs.LG cs.SY eess.SY stat.ML 76%

Variational Inference MPC for Bayesian Model-based Reinforcement Learning

Masashi Okada, Tadahiro Taniguchi

专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.LG;dynamics model(abstract)

Comments Accepted to CoRL2019. Camera-ready ver

详情

展开后加载摘要…

URL PDF HTML 收藏
1811.09602 2018-11-28 cs.LG cs.AI stat.ML 76%

Model-Based Reinforcement Learning for Sepsis Treatment

Aniruddh Raghu, Matthieu Komorowski, Sumeetpal Singh

专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.AI、cs.LG

Comments Machine Learning for Health (ML4H) Workshop at NeurIPS 2018 arXiv:1811.07216

详情

展开后加载摘要…

URL PDF HTML 收藏
1811.00128 2018-11-02 cs.LG cs.AI stat.ML 76%

Towards a Simple Approach to Multi-step Model-based Reinforcement Learning

Kavosh Asadi, Evan Cater, Dipendra Misra, Michael L. Littman

专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1804.07193 2018-07-30 cs.LG cs.AI stat.ML 76%

Lipschitz Continuity in Model-based Reinforcement Learning

Kavosh Asadi, Dipendra Misra, Michael L. Littman

专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.AI、cs.LG

Comments Accepted for the 35th International Conference on Machine Learning (ICML 2018)

详情

展开后加载摘要…

URL PDF HTML 收藏
1806.01265 2018-07-10 cs.LG cs.AI stat.ML 76%

Equivalence Between Wasserstein and Value-Aware Loss for Model-based Reinforcement Learning

Kavosh Asadi, Evan Cater, Dipendra Misra, Michael L. Littman

专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.AI、cs.LG

Comments Accepted at the FAIM workshop "Prediction and Generative Modeling in Reinforcement Learning", Stockholm, Sweden, 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1612.06018 2017-07-28 cs.LG cs.AI 76%

Self-Correcting Models for Model-Based Reinforcement Learning

Erik Talvitie

专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.AI、cs.LG

Comments Original paper appeared in Proceedings of the 31st AAAI Conference on Artificial Intelligence, 2017. This version incorporates the appendix into document (rather than as supplementary material), corrects a minor error in Lemma 1, and fixes some type-os

Journal ref Proceedings of the Thirty-First AAAI Conference on Artificial Intelligence, 2597-2603 (2017)

详情

展开后加载摘要…

URL PDF HTML 收藏
1804.01238 2018-04-05 cs.LG stat.ML 75%

Information Maximizing Exploration with a Latent Dynamics Model

Trevor Barron, Oliver Obst, Heni Ben Amor

专题命中 模型式强化学习 :latent dynamics(title);dynamics model(title,abstract);分类 cs.LG

Comments Presented at the NIPS 2017 Deep Reinforcement Learning Symposium

详情

展开后加载摘要…

URL PDF HTML 收藏
1506.07365 2015-11-23 cs.LG cs.CV stat.ML 75%

Embed to Control: A Locally Linear Latent Dynamics Model for Control from Raw Images

Manuel Watter, Jost Tobias Springenberg, Joschka Boedecker, Martin Riedmiller

专题命中 模型式强化学习 :latent dynamics(title);dynamics model(title);分类 cs.LG、cs.CV

Comments Final NIPS version

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10634 2026-08-12 cs.LG 新提交 74%

IADD-TR: Intervention-Aware Dynamics Decoupling with Targeted Regularization for Model-Based Reinforcement Learning

IADD-TR:结合干预感知动力学解耦与定向正则化的基于模型强化学习方法

Zefeng Liang, Jie Qiao, Ruichu Cai, Weilin Chen, Zhifeng Hao

机构 * School of Computer Science, Guangdong University of Technology(广东工业大学计算机学院) College of Science, Shantou University(汕头大学理学院)

专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.LG

AI总结 本文提出IADD-TR框架,通过干预感知动力学解耦与定向正则化解决MBRL中策略诱导的数据偏差问题,经MuJoCo任务实验验证可提升样本效率并取得有竞争力回报。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28939 2026-08-03 cs.LG math.DS math.OC 新提交 74%

Latent Lie-Poisson Neural Networks (LLPNNs): Discovering the motion of Lie-Poisson systems through observable data and latent dynamics

隐李-泊松神经网络(LLPNNs):通过可观测量与隐动力学发现李-泊松系统的运动

Vakhtang Putkaradze

机构 * The University of Alabama(阿拉巴马大学)

专题命中 模型式强化学习 :latent dynamics(title,abstract);分类 cs.LG

AI总结 提出LLPNNs这一保结构框架,直接从可观测量学习李-泊松动力学,适用于正则与退化哈密顿系统,在三类系统中展现出优异预测精度与噪声鲁棒性。

Comments 70 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16501 2026-07-21 cs.RO 新提交 74%

Certifiable Safe Model-Based Reinforcement Learning with Control-Affine Dynamics Approximation

基于控制仿射动力学近似的可验证安全模型强化学习

Hao Zhou, Yanze Zhang, Cameron Reid, Wenhao Luo

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) Texas A&M University(德克萨斯农工大学)

专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.RO

AI总结 研究基于模型的安全强化学习,提出用控制障碍函数结合控制仿射随机傅里叶特征及自适应共形预测的框架,通过学习控制仿射动力学实现可验证安全策略,仿真结果验证了该框架在推车摆杆和3D四旋翼平台上的有效性。

Comments 8 pages, accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12676 2026-07-16 cs.LG 版本更新 74%

Disentangled Latent Dynamics Manifold Fusion for Solving Parameterized PDEs

解耦潜在动态流形融合用于求解参数化偏微分方程

Zhangyong Liang, Huanhuan Gao

机构 * National Center for Applied Mathematics, Tianjin University(应用数学国家中心,天津大学)

专题命中 模型式强化学习 :latent dynamics(title,abstract);分类 cs.LG

AI总结 本文提出DLDMF框架,通过解耦空间、时间和参数,利用连续时间潜在方法和动态流形融合机制,提升参数泛化和时间外推的稳定性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11073 2026-07-14 cs.LG physics.ao-ph 新提交 74%

AeroMELD: A Linear Embedding of Aerosol Populations for Diagnostics and Latent Dynamics

AeroMELD:用于诊断和潜在动力学的气溶胶群体线性嵌入

Ehsan Saleh, Saba Ghaffari, Wenhan Tang, Jeffrey H. Curtis, Lekha Patel, Peter A. Bosler, Nicole Riemer, Matthew West

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Amazon(亚马逊) Sandia National Laboratories(桑迪亚国家实验室)

专题命中 模型式强化学习 :latent dynamics(title,abstract);分类 cs.LG

AI总结 研究旨在准确表示大气气溶胶群体,提出AeroMELD框架构建低维潜在变量以保留其数学结构,通过尺度-形状分解等实现,能准确重建多种分布及行为,为在潜在空间学习气溶胶过程演化奠定基础。

Comments 34 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08475 2026-06-29 cs.LG cs.CE cs.NA math.NA 74%

Thermodynamically Consistent Latent Dynamics Identification for Parametric Systems

参数系统简化建模中的热力学一致潜在动力学识别

Xiaolong He, Yeonjong Shin, Anthony Gruber, Sohyeon Jung, Kookjin Lee, Youngsoo Choi

机构 * Ansys Inc.(安西斯公司) North Carolina State University(北卡罗来纳州立大学) Sandia National Laboratories(桑迪亚国家实验室) Arizona State University(亚利桑那州立大学) Lawrence Livermore National Laboratory(劳伦斯利弗莫尔国家实验室)

专题命中 模型式强化学习 :latent dynamics(title,abstract);分类 cs.LG

AI总结 本文提出了一种结合自动编码器和参数化GENERIC框架的神经网络方法,用于参数非线性动力系统简化建模,通过热力学原理提升模型效率和精度。

Journal ref Transactions on Machine Learning Research (TMLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11259 2026-06-23 cs.LG cs.NA math.NA 74%

Latent Dynamics Graph Convolutional Networks for model order reduction of parameterized time-dependent PDEs

隐式动力学图卷积网络用于参数化时变偏微分方程的模型降阶

Lorenzo Tomada, Federico Pichi, Gianluigi Rozza

机构 * mathLab, Mathematics Area, SISSA, via Bonomea 265, I-34136 Trieste, Italy(SISSA数学实验室)

专题命中 模型式强化学习 :latent dynamics(title,abstract);分类 cs.LG

AI总结 本文提出LD-GCN,一种数据驱动的编码器-free架构,通过隐式空间建模时间演化,实现降阶动态分析与零样本预测,数学上通过通用逼近定理验证,应用于复杂计算力学问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13899 2026-06-03 q-bio.NC cs.CE cs.LG 74%

A Factorized Low-Rank RNN Framework for Uncovering Independent Neural Latent Dynamics and Connectivity

一种分解低秩RNN框架用于揭示独立神经潜在动力学和连接性

Chengrui Li, Yunmiao Wang, Yule Wang, Weihan Li, Dieter Jaeger, Anqi Wu

机构 * University of California, San Diego(加州大学圣迭戈分校)

专题命中 模型式强化学习 :latent dynamics(title,abstract);分类 cs.LG

AI总结 提出FacRNN框架,通过组间独立假设和部分相关惩罚,在低秩循环神经网络中实现潜在动力学的解耦与可解释性提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20639 2026-05-21 math.OC cs.LG math.DS 74%

Time-Dependent PDE-Constrained Optimization via Weak-Form Latent Dynamics

通过弱形式潜变量动力学进行时间依赖的PDE约束优化

April Tran, Terry Haut, David Bortz, Youngsoo Choi

机构 * Department of Applied Mathematics, University of Colorado(应用数学系,科罗拉多大学) Center for Applied Scientific Computing, Lawrence Livermore National Laboratory(应用科学计算中心,劳伦斯利弗莫尔国家实验室)

专题命中 模型式强化学习 :latent dynamics(title,abstract);分类 cs.LG

AI总结 本文提出了一种基于弱形式潜空间降阶建模的框架,用于加速梯度基PDE约束优化,通过弱形式系统识别方法压缩高维解轨迹并识别参数化潜变量动力学,从而在多查询设计和控制场景中实现高效优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16682 2026-05-19 cs.LG 74%

Identify Then Project: Contrastive Learning of Latent Dynamics from Partial Observations with Port-Hamiltonian Structure

识别后再投影:从部分观测中利用端-哈密顿结构进行对比学习

Peilun Li, Kaiyuan Tan, Daniel Moyer, Thomas Beckers

机构 * Department of Computer Science(计算机科学系)

专题命中 模型式强化学习 :latent dynamics(title,abstract);分类 cs.LG

AI总结 本文提出一种两阶段框架,通过对比学习从部分观测中学习隐状态动态,并投影到端-哈密顿子流形,以实现物理一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13761 2026-05-14 cs.LG cs.CE 74%

Toward AI-Driven Digital Twins for Metropolitan Floods: A Conditional Latent Dynamics Network Surrogate of the Shallow Water Equations

迈向AI驱动的数字孪生用于城市洪水:一个基于条件潜在动态网络的浅水方程代理模型

Phillip Si, Yuan Qiu, Omar Sallam, Jeremy Feinstein, Ziang He, Eugene Yan, Peng Chen

机构 * School of Computational Science and Engineering, Georgia Institute of Technology(计算科学与工程学院,佐治亚理工学院) Environmental Science Division, Argonne National Laboratory(环境科学部,阿贡国家实验室)

专题命中 模型式强化学习 :latent dynamics(title,abstract);分类 cs.LG

AI总结 本文提出CLDNet,一种基于降雨的低维潜在神经ODE模型,结合坐标解码器,用于快速模拟城市洪水。该方法在单节点上实现大规模训练,并在不需栅格化的情况下进行精确查询,显著提升预测速度和精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02832 2026-05-11 cs.LG physics.flu-dyn 74%

Koopman Autoencoders with Continuous-Time Latent Dynamics for Fluid Dynamics Forecasting

具有连续时间潜在动态的Koopman自编码器用于流体动力学预测

Rares Grozavescu, Pengyu Zhang, Etienne Meunier, Mark Girolami

机构 * University of Cambridge(剑桥大学) Alan Turing Institute(艾伦·图灵研究所) Inria(法国国家信息与自动化技术研究所)

专题命中 模型式强化学习 :latent dynamics(title,abstract);分类 cs.LG

AI总结 本文提出一种连续时间Koopman自编码器,通过闭式推断实现长周期预测,克服了传统方法的固定时间步限制,并在流体动力学中实现了高效稳定预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03201 2026-05-11 cs.LG 74%

SLOPE: Optimistic Potential Landscape Shaping for Model-based Reinforcement Learning

SLOPE:基于模型的强化学习中的乐观势能塑造

Yao-Hui Li, Zeyu Wang, Xin Li, Wei Pang, Yingfang Yuan, Zhengkun Chen, Boya Zhang, Riashat Islam, Alex Lamb, Yonggang Zhang

机构 * Beijing Institute of Technology(北京理工大学) Heriot-Watt University(赫瑞-沃森大学) Shenzhen Institutes of Advanced Technology, CAS(深圳先进技术研究院) Microsoft Research NY(微软研究院纽约分部) Tsinghua University(清华大学) Jilin University(吉林大学)

专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.LG

AI总结 SLOPE通过乐观势能估计构建信息丰富的势能景观,解决稀疏奖励环境下梯度信息不足的问题,提升模型在稀疏、半稀疏和密集奖励任务中的性能。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27411 2026-05-01 cs.LG 74%

Detecting is Easy, Adapting is Hard: Local Expert Growth for Visual Model-Based Reinforcement Learning under Distribution Shift

检测容易,适应困难:基于视觉模型的强化学习在分布偏移下的局部专家增长

Haiyang Zhao

机构 * University of Georgia(佐治亚大学)

专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.LG

AI总结 本文研究了视觉模型强化学习在分布偏移下的适应问题,提出JEPA-Indexed Local Expert Growth方法,通过局部专家进行动作修正,提升了对偏移环境的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05185 2026-04-08 cs.LG cs.SY eess.SY 74%

Cross-fitted Proximal Learning for Model-Based Reinforcement Learning

基于交叉验证的近端学习用于基于模型的强化学习

Nishanth Venkatesh, Andreas A. Malikopoulos

机构 * Cornell University(康奈尔大学)

专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.LG

AI总结 本文提出一种交叉验证的近端学习方法,用于解决基于模型的强化学习中因隐藏混淆导致的模型偏差问题,通过更高效利用数据提高估计精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09219 2026-04-03 cs.LG 74%

Planning in Branch-and-Bound: Model-Based Reinforcement Learning for Exact Combinatorial Optimization

在分支定界中的规划:基于模型的强化学习用于精确组合优化

Paul Strang, Zacharie Alès, Côme Bissuel, Olivier Juan, Safia Kedad-Sidhoum, Emmanuel Rachelson

专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.LG

AI总结 本文提出PlanB&B,一种基于模型的强化学习方法,用于改进分支定界中的分支策略,通过在四个标准MILP基准上优于现有方法的实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19305 2026-03-03 stat.ML cs.LG math.DS 74%

LD-EnSF: Synergizing Latent Dynamics with Ensemble Score Filters for Fast Data Assimilation with Sparse Observations

LD-EnSF:融合潜在动力学与集成评分滤波器用于稀疏观测的快速数据同化

Pengpeng Xiao, Phillip Si, Peng Chen

机构 * Georgia Institute of Technology(佐治亚理工学院) Yale University(耶鲁大学)

专题命中 模型式强化学习 :latent dynamics(title,abstract);分类 cs.LG

AI总结 LD-EnSF通过在潜在空间中直接演进动力学,结合改进的LDNets和历史感知LSTM编码器,实现高维稀疏观测下的高效数据同化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10291 2025-11-14 cs.IT cs.LG cs.NI math.IT 74%

Causal Model-Based Reinforcement Learning for Sample-Efficient IoT Channel Access

Aswin Arun, Christo Kurisummoottil Thomas, Rimalpudi Sarvendranath, Walid Saad

机构 * Department of Electrical Engineering, Indian Institute of Technology, Tirupati, Andhra Pradesh, India(电子工程系,印度理工学院,蒂鲁帕蒂,安得拉邦,印度) Department of Electrical and Computer Engineering, Worcester Polytechnic Institute, Worcester, MA, USA(电气与计算机工程系,沃思堡理工大学,沃思堡,马萨诸塞州,美国) Department of Electrical and Computer Engineering, Virginia Tech, Alexandria, VA, USA(电气与计算机工程系,弗吉尼亚理工大学,亚历山大,弗吉尼亚州,美国)

专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10871 2025-07-16 cs.LG cs.NA math.NA physics.med-ph 74%

GALDS: A Graph-Autoencoder-based Latent Dynamics Surrogate model to predict neurite material transport

Tsung Yeh Hsieh, Yongjie Jessica Zhang

机构 * Department of Mechanical Engineering, Carnegie Mellon University(机械工程系,卡内基梅隆大学) Department of Biomedical Engineering, Carnegie Mellon University(生物医学工程系,卡内基梅隆大学) Department of Civil and Environmental Engineering, Carnegie Mellon University(土木与环境工程系,卡内基梅隆大学)

专题命中 模型式强化学习 :latent dynamics(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19785 2025-06-25 cs.AI 74%

Learning Task Belief Similarity with Latent Dynamics for Meta-Reinforcement Learning

Menglong Zhang, Fuyuan Qian

机构 * Southern University of Science and Technology(南方科技大学)

专题命中 模型式强化学习 :latent dynamics(title,abstract);分类 cs.AI

Comments ICLR2025 https://openreview.net/forum?id=5YbuOTUFQ4

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19617 2025-05-26 cs.RO 74%

LiRA: Light-Robust Adversary for Model-based Reinforcement Learning in Real World

Taisuke Kobayashi

专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.RO

Comments 21 pages, 17 figures (accepted in Robotics and Autonomous Systems)

Journal ref Robotics and Autonomous Systems, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16588 2025-04-24 eess.SY cs.LG cs.SY physics.flu-dyn 74%

Data-Assimilated Model-Based Reinforcement Learning for Partially Observed Chaotic Flows

Defne E. Ozan, Andrea Nóvoa, Luca Magri

机构 * Imperial College London(帝国理工学院伦敦校区) The Alan Turing Institute(阿兰·图灵研究所) Politecnico di Torino(托里尼Politecnico)

专题命中 模型式强化学习 :model-based reinforcement learning(title);model-based RL(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏