arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-08-14 至 2025-08-14 共收录 4 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4 篇

2506.05968 2025-08-14 cs.LG cs.AI cs.RO 67%

Gradual Transition from Bellman Optimality Operator to Bellman Operator in Online Reinforcement Learning

Motoki Omura, Kazuki Ota, Takayuki Osa, Yusuke Mukuta, Tatsuya Harada

机构 * The University of Tokyo(东京大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

Comments Accepted at ICML 2025. Source code: https://github.com/motokiomura/annealed-q-learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07071 2025-08-14 cs.LG cs.AI 62%

Retrieval-Augmented Decision Transformer: External Memory for In-context RL

Thomas Schmied, Fabian Paischer, Vihang Patil, Markus Hofmarcher, Razvan Pascanu, Sepp Hochreiter

机构 * ELLIS Unit, LIT AI Lab, Institute for Machine Learning, JKU Linz, Austria(ELLIS单位、LIT人工智能实验室、机器学习研究所、JKU林茨、奥地利) Extensity AI Google DeepMind(谷歌DeepMind) Mila - Québec AI Institute(魁北克人工智能研究所) NXAI

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08511 2025-08-14 cs.RO 57%

Vision-driven UAV River Following: Benchmarking with Safe Reinforcement Learning

Zihan Wang, Nina Mahmoudian

机构 * School of Mechanical Engineering, Purdue University(机械工程学院,普渡大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

Comments Accepted by conference IFAC CAMS 2024

Journal ref IFAC-PapersOnLine, 58(20): 421-427, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.09332 2025-08-14 cs.RO 57%

Synergistic Reinforcement and Imitation Learning for Vision-driven Autonomous Flight of UAV Along River

Zihan Wang, Jianwen Li, Nina Mahmoudian

机构 * School of Mechanical Engineering, Purdue University(机械工程学院,普渡大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

Comments Submitted to IROS2024

Journal ref 979-8-3503-7770-5/24/$31.00 \c{opyright}2024 IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏