arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-10-14 至 2025-10-14 共收录 6 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 6 篇

2509.23135 2025-10-14 cs.LG cs.AI 62%

Trust Region Reward Optimization and Proximal Inverse Reward Optimization Algorithm

Yang Chen, Menglin Zou, Jiaqi Zhang, Yitan Zhang, Junyi Yang, Gael Gendron, Libo Zhang, Jiamou Liu, Michael J. Witbrock

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of Auckland(奥克兰大学) Chongqing University(重庆大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Accepted to NeurIPS 2025. Title used at submission and review: PIRO: Toward Stable Reward Learning for Inverse RL via Monotonic Policy Divergence Reduction

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11501 2025-10-14 cs.LG cs.RO 62%

Context-Aware Model-Based Reinforcement Learning for Autonomous Racing

Emran Yasser Moustafa, Ivana Dusparic

机构 * School of Computer Science and Statistics, Trinity College Dublin(计算机科学与统计学系,特里尼蒂学院都柏林)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments Accepted to IEEE ICAR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10451 2025-10-14 cs.LG cs.AI 62%

Data-driven simulator of multi-animal behavior with unknown dynamics via offline and online reinforcement learning

Keisuke Fujii, Kazushi Tsutsui, Yu Teshima, Makoto Itoh, Naoya Takeishi, Nozomi Nishiumi, Ryoya Tanaka, Shunsuke Shigaki, Yoshinobu Kawahara

机构 * Graduate School of Informatics, Nagoya University, Japan(名古屋大学信息学研究科) RIKEN Center for Advanced Intelligence Project, Japan(RIKEN高级智能项目研究中心) Graduate School of Arts and Sciences, The University of Tokyo, Japan(东京大学文学系研究科) Project team for SIP, Japan(SIP项目团队) Japan Agency for Marine-Earth Science and Technology, Japan(日本海洋地球科学技术机构) Faculty of Education, Shitennoji University, Japan(世田谷大学教育学部) Graduate School of Engineering, The University of Tokyo, Japan(东京大学工学研究科) Graduate School of Science and Technology, Niigata University, Japan(新潟大学科学技术研究科) Graduate School of Science, Nagoya University, Japan(名古屋大学理学研究科) Principles of Informatics Research Division, National Institute of Informatics, Japan(信息学原理研究部门,日本信息处理技术研究所) Graduate School of Information Science, The University of Osaka, Japan(大阪大学信息科学研究科)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments 21 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26605 2025-10-14 cs.AI cs.LG 62%

Fine-tuning Behavioral Cloning Policies with Preference-Based Reinforcement Learning

Maël Macuglia, Paul Friedrich, Giorgia Ramponi

机构 * Department of Informatics, University of Zurich(苏黎世大学信息学院) ETH AI Center(ETH人工智能中心)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments 85 pages (11 + references and appendix), 9 figures. v2: added acknowledgements

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11307 2025-10-14 cs.CL cs.AI 57%

FOSSIL: Harnessing Feedback on Suboptimal Samples for Data-Efficient Generalisation with Imitation Learning for Embodied Vision-and-Language Tasks

Sabrina McCallum, Amit Parekh, Alessandro Suglia

机构 * University of Edinburgh(爱丁堡大学) Heriot-Watt University(赫瑞思-瓦特大学)

专题命中 模仿学习与强化学习 :embodied AI(abstract);分类 cs.AI

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10960 2025-10-14 cs.RO 57%

Game-Theoretic Risk-Shaped Reinforcement Learning for Safe Autonomous Driving

Dong Hu, Fenqing Hu, Lidong Yang, Chao Huang

机构 * Department of Industrial and Systems Engineering, the Hong Kong Polytechnic University(工业与系统工程系,香港理工大学)

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏