arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

世界模型

面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。

共收录 6506 信号源:cs.AI, cs.LG, cs.CV, cs.RO, cs.MA

1. 模型式强化学习 1126 篇

2302.14182 2023-10-19 cs.LG cs.AI 56%

Taylor TD-learning

Michele Garibbo, Maxime Robeyns, Laurence Aitchison

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments Published as a conference paper at NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09495 2023-10-17 cs.LG cs.CV stat.ML 56%

Learning In-between Imagery Dynamics via Physical Latent Spaces

Jihun Han, Yoonsang Lee, Anne Gelb

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG、cs.CV

Comments 26 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16979 2023-09-21 cs.AI cs.LG 56%

Adaptive PD Control using Deep Reinforcement Learning for Local-Remote Teleoperation with Stochastic Time Delays

Luc McCutcheon, Saber Fallah

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments 7 pages + 1 references, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.07461 2023-08-10 cs.LG cs.GT cs.MA math.OC stat.ML 56%

Model-Based Multi-Agent RL in Zero-Sum Markov Games with Near-Optimal Sample Complexity

Kaiqing Zhang, Sham M. Kakade, Tamer Başar, Lin F. Yang

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG、cs.MA

Comments Updated version accepted to Journal of Machine Learning Research (JMLR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.14085 2023-07-27 cs.LG cs.AI math.ST stat.ML stat.TH 56%

Actions Speak What You Want: Provably Sample-Efficient Reinforcement Learning of the Quantal Stackelberg Equilibrium from Strategic Feedbacks

Siyu Chen, Mengdi Wang, Zhuoran Yang

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments 129 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.06630 2023-07-14 cs.CV cs.AI 56%

Image Transformation Sequence Retrieval with General Reinforcement Learning

Enrique Mas-Candela, Antonio Ríos-Vila, Jorge Calvo-Zaragoza

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.04165 2023-07-04 cs.LG cs.CE nlin.CD stat.ML 56%

Neural Extended Kalman Filters for Learning and Predicting Dynamics of Structural Systems

Wei Liu, Zhilu Lai, Kiran Bacsa, Eleni Chatzi

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG;dynamics model(abstract)

Comments Accepted for publication in Structural Health Monitoring

Journal ref Structural Health Monitoring, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.03771 2023-07-03 q-bio.NC cs.LG 56%

Expressive architectures enhance interpretability of dynamics-based neural population models

Andrew R. Sedler, Christopher Versteeg, Chethan Pandarinath

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG;dynamics model(abstract)

Comments Accepted to Neurons, Behavior, Data analysis and Theory (14 pages, 3 figures). Added missing funding info and updated supplement sections 11.1 and 11.2. Updated acknowledgments

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.01549 2023-06-06 stat.ML cs.LG 56%

Streaming Variational Monte Carlo

Yuan Zhao, Josue Nassar, Ian Jordan, Mónica Bugallo, Il Memming Park

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.12016 2023-05-26 cs.AI cs.LG 56%

Mastering the Unsupervised Reinforcement Learning Benchmark from Pixels

Sai Rajeswar, Pietro Mazzaglia, Tim Verbelen, Alexandre Piché, Bart Dhoedt, Aaron Courville, Alexandre Lacoste

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments Accepted at ICML 2023 (oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.04050 2023-05-10 stat.ML cs.LG cs.MA 56%

Efficient Model-Based Multi-Agent Mean-Field Reinforcement Learning

Barna Pásztor, Ilija Bogunovic, Andreas Krause

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG、cs.MA

Journal ref Pásztor, B., Krause, A., & Bogunovic, I. (2023). Efficient Model-Based Multi-Agent Mean-Field Reinforcement Learning. Transactions on Machine Learning Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.12526 2023-03-08 cs.LG cs.AI stat.ML 56%

Model-Based Uncertainty in Value Functions

Carlos E. Luis, Alessandro G. Bottero, Julia Vinogradska, Felix Berkenkamp, Jan Peters

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments AISTATS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.10311 2023-02-22 cs.LG cs.AI 56%

Understanding the effect of varying amounts of replay per step

Animesh Kumar Paul, Videh Raj Nema

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments 10 Pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.14576 2023-02-22 cs.CL cs.AI cs.LG 56%

Using cognitive psychology to understand GPT-3

Marcel Binz, Eric Schulz

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.09846 2023-02-21 cs.RO 56%

Neural Optimal Control using Learned System Dynamics

Selim Engin, Volkan Isler

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.RO;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.03958 2023-02-09 cs.AI cs.LG 56%

Non-zero-sum Game Control for Multi-vehicle Driving via Reinforcement Learning

Xujie Song, Zexi Lin

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.03933 2023-01-11 astro-ph.IM cs.LG 56%

Hint assisted reinforcement learning: an application in radio astronomy

Sarod Yatawatta

专题命中 模型式强化学习 :model based reinforcement learning(abstract);分类 cs.LG;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.08235 2022-12-19 cs.LG cs.RO 56%

A Simple Decentralized Cross-Entropy Method

Zichen Zhang, Jun Jin, Martin Jagersand, Jun Luo, Dale Schuurmans

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG、cs.RO

Comments NeurIPS 2022. The last two authors advised equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.14827 2022-11-29 cs.LG cs.AI stat.ML 56%

Domain Generalization for Robust Model-Based Offline Reinforcement Learning

Alan Clark, Shoaib Ahmed Siddiqui, Robert Kirk, Usman Anwar, Stephen Chung, David Krueger

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments Accepted to the NeurIPS 2022 Workshops on Distribution Shifts and Offline Reinforcement Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.12115 2022-11-29 cs.LG cs.RO 56%

Model-Based Policy Search Using Monte Carlo Gradient Estimation with Real Systems Application

Fabio Amadio, Alberto Dalla Libera, Riccardo Antonello, Daniel Nikovski, Ruggero Carli, Diego Romeres

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG、cs.RO

Comments Accepted in IEEE Transactions on Robotics. MC-PILCO code is publicly available at https://www.merl.com/research/license/MC-PILCO

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.11758 2022-11-23 cs.LG cs.AI 56%

A Graph Regularized Point Process Model For Event Propagation Sequence

Siqiao Xue, Xiaoming Shi, Hongyan Hao, Lintao Ma, Shiyu Wang, Shijun Wang, James Zhang

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.AI、cs.LG

Comments IJCNN 2021

Journal ref 2021 International Joint Conference on Neural Networks (IJCNN) (pp. 1-7). IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.05969 2022-11-01 cs.CV cs.AI cs.LG cs.RO 56%

Dynamics-Regulated Kinematic Policy for Egocentric Pose Estimation

Zhengyi Luo, Ryo Hachiuma, Ye Yuan, Kris Kitani

专题命中 模型式强化学习 :分类 cs.AI、cs.LG、cs.CV;dynamics model(abstract)

Comments NeurIPS 2021. Project page: https://zhengyiluo.github.io/projects/kin_poly/

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.05922 2022-10-13 cs.LG cs.AI 56%

A Unified Framework for Alternating Offline Model Training and Policy Learning

Shentao Yang, Shujian Zhang, Yihao Feng, Mingyuan Zhou

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments 36th Conference on Neural Information Processing Systems (NeurIPS 2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.01805 2022-10-06 cs.LG cs.AI 56%

CostNet: An End-to-End Framework for Goal-Directed Reinforcement Learning

Per-Arne Andersen, Morten Goodwin, Ole-Christoffer Granmo

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments 14 pages, 5 figures, In Proceedings of the International Conference on Innovative Techniques and Applications of Artificial Intelligence, SGAI2020

Journal ref 2020 Springer Nature Switzerland AG

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.00368 2022-10-04 cs.LG 56%

Parameter-varying neural ordinary differential equations with partition-of-unity networks

Kookjin Lee, Nathaniel Trask

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.12387 2022-09-27 cs.LG cs.AI stat.ML 56%

Neural State-Space Modeling with Latent Causal-Effect Disentanglement

Maryam Toloubidokhti, Ryan Missel, Xiajun Jiang, Niels Otani, Linwei Wang

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.AI、cs.LG

Comments presented at the 13th Machine Learning in Medical Imaging (MLMI 2022) Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.07123 2022-08-16 cs.RO cs.AI 56%

Online 3D Bin Packing Reinforcement Learning Solution with Buffer

Aaron Valero Puche, Sukhan Lee

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.RO

Comments Accepted in IROS 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.14003 2022-07-29 cs.CL cs.AI cs.CY cs.HC cs.LG 56%

Raising Student Completion Rates with Adaptive Curriculum and Contextual Bandits

Robert Belfer, Ekaterina Kochmar, Iulian Vlad Serban

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments 6 pages, 1 figure, To appear in the Proceedings of the 23rd International Conference on Artificial Intelligence in Education (AIED 2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.06543 2022-07-26 cs.AI cs.LG 56%

Policy Optimization in Dynamic Bayesian Network Hybrid Models of Biomanufacturing Processes

Hua Zheng, Wei Xie, Ilya O. Ryzhov, Dongming Xie

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments 36 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.04424 2022-07-13 cs.RO cs.LG 56%

Accelerated Reinforcement Learning for Temporal Logic Control Objectives

Yiannis Kantaros

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG、cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏