arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-11-03 至 2025-11-03 共收录 4 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4 篇

2509.15981 2025-11-03 cs.LG cs.AI cs.RO stat.ML 67%

Uncertainty-Based Smooth Policy Regularisation for Reinforcement Learning with Few Demonstrations

Yujie Zhu, Charles A. Hepburn, Matthew Thorpe, Giovanni Montana

机构 * Department of Statistics(统计系) Warwick Manufacturing Group University of Warwick(沃里克大学沃里克制造集团)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16724 2025-11-03 cs.AI cs.LG 62%

Towards Automated Semantic Interpretability in Reinforcement Learning via Vision-Language Models

Zhaoxin Li, Zhang Xi-Jia, Batuhan Altundas, Letian Chen, Rohan Paleja, Matthew Gombolay

机构 * Georgia Institute of Technology(佐治亚理工学院) Purdue University(普渡大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22575 2025-11-03 cs.SE cs.AI 57%

On the Mistaken Assumption of Interchangeable Deep Reinforcement Learning Implementations

Rajdeep Singh Hundal, Yan Xiao, Xiaochun Cao, Jin Song Dong, Manuel Rigger

机构 * National University of Singapore(新加坡国立大学) Sun Yat-sen University(中山大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI

Comments Added the ACM Functional v1.1 badge, the full publication citation, and a link to the publication on IEEE Xplore

Journal ref IEEE/ACM 47th International Conference on Software Engineering (ICSE), Ottawa, ON, Canada, 2025, pp. 2225-2237

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03394 2025-11-03 cs.RO 57%

Faster Model Predictive Control via Self-Supervised Initialization Learning

Zhaoxin Li, Xiaoke Wang, Letian Chen, Rohan Paleja, Subramanya Nageshrao, Matthew Gombolay

机构 * Georgia Institute of Technology(佐治亚理工学院) MIT Lincoln Laboratory(麻省理工学院林肯实验室) Ford Motor Company(福特汽车公司)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏