arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-02-19 至 2026-02-19 共收录 2 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 2 篇

2602.16196 2026-02-19 cs.LG cs.AI cs.MA 62%

Graphon Mean-Field Subsampling for Cooperative Heterogeneous Multi-Agent Reinforcement Learning

图论均值场子采样用于协作异质多智能体强化学习

Emile Anand, Richard Hoffmann, Sarah Liaw, Adam Wierman

机构 * California Institute of Technology(加州理工学院) Harvard University(哈佛大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

AI总结 GMFS通过子采样异质智能体交互,实现可扩展的协作多智能体强化学习,具有poly(κ)样本复杂度和O(1/√κ)最优性差距。

Comments 43 pages, 5 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15010 2026-02-19 cs.RO cs.LG 62%

BPP: Long-Context Robot Imitation Learning by Focusing on Key History Frames

BPP: 通过聚焦关键历史帧实现长上下文机器人模仿学习

Max Sobol Mark, Jacky Liang, Maria Attarian, Chuyuan Fu, Debidatta Dwibedi, Dhruv Shah, Aviral Kumar

机构 * Carnegie Mellon University(卡内基梅隆大学) Google DeepMind(谷歌DeepMind)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

AI总结 BPP通过聚焦关键历史帧,提升机器人模仿学习在长上下文任务中的表现,成功率达70%。

详情

展开后加载摘要…

URL PDF HTML 收藏