arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

作者

Sergey Levine

Robotics / Reinforcement Learning

2026-02-24 至 2026-02-24 共收录 2
2510.22512 2026-02-24 cs.LG cs.AI

Transitive RL: Value Learning via Divide and Conquer

传递式强化学习:基于分而治之的价值学习

Seohong Park, Aditya Oberai, Pranav Atreya, Sergey Levine

AI总结 本文提出传递式强化学习算法,通过分而治之策略解决离线目标条件强化学习问题,有效降低偏见累积和方差,实现长horizon任务中的最优性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07730 2026-02-24 cs.LG cs.RO

Multistep Quasimetric Learning for Scalable Goal-conditioned Reinforcement Learning

多步准度量学习用于可扩展的目标导向强化学习

Bill Chunyuan Zheng, Vivek Myers, Benjamin Eysenbach, Sergey Levine

AI总结 本文提出了一种基于多步准度量学习的离线目标导向强化学习方法,通过多步蒙特卡洛回报提升长视野任务的性能,并在现实世界机器人操作中实现了多步拼接。

Journal ref ICLR (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏