arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-11-05 至 2025-11-05 共收录 6 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 6 篇

2505.12737 2025-11-05 cs.LG cs.AI 79%

Option-aware Temporally Abstracted Value for Offline Goal-Conditioned Reinforcement Learning

Hongjoon Ahn, Heewoong Choi, Jisu Han, Taesup Moon

机构 * Department of Electrical and Computer Engineering (ECE), Seoul National University(电子与计算机工程系,首尔国立大学) Interdisciplinary Program in Artificial Intelligence (IPAI), Seoul National University(人工智能跨学科项目,首尔国立大学) ASRI / INMC, Seoul National University(ASRI/INMC,首尔国立大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);navigation(abstract);robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17830 2025-11-05 cs.LG cs.AI 62%

Imagine Beyond! Distributionally Robust Auto-Encoding for State Space Coverage in Online Reinforcement Learning

Nicolas Castanet, Olivier Sigaud, Sylvain Lamprier

机构 * Sorbonne Université, CNRS, ISIR(索邦大学、国家科学研究中心、信息科学研究所)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05818 2025-11-05 cs.LG cs.RO 62%

Closing the Intent-to-Behavior Gap via Fulfillment Priority Logic

Bassel El Mabsout, Abdelrahman Abdelgawad, Renato Mancuso

机构 * Department of Computer Science, Boston University(波士顿大学计算机科学系) Systems Engineering Division, Boston University(波士顿大学系统工程分校)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02690 2025-11-05 cs.LG 57%

Curriculum Design for Trajectory-Constrained Agent: Compressing Chain-of-Thought Tokens in LLMs

Georgios Tzannetos, Parameswaran Kamalaruban, Adish Singla

机构 * MPI-SWS(马克斯·普朗克所际研究所)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments NeurIPS'25 paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08655 2025-11-05 cs.RO 57%

FRASA: An End-to-End Reinforcement Learning Agent for Fall Recovery and Stand Up of Humanoid Robots

Clément Gaspard, Marc Duclusaud, Grégoire Passault, Mélodie Daniel, Olivier Ly

机构 * Univ. Bordeaux, CNRS, LaBRI, UMR 5800(波尔多大学、国家科学研究中心、LaBRI、UMR 5800)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22940 2025-11-05 cs.LG 57%

Generating Auxiliary Tasks with Reinforcement Learning

Judah Goldfeder, Matthew So, Hod Lipson

机构 * Department of Computer Science(计算机科学系) Columbia University(哥伦比亚大学) Department of Mechanical Engineering(机械工程系)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏