arXivDaily arXiv每日学术速递 周一至周五更新

作者

Sergey Levine

Robotics / Reinforcement Learning

2025-12-03 至 2025-12-03 共收录 1
2509.20478 2025-12-03 cs.LG

Offline Goal-conditioned Reinforcement Learning with Quasimetric Representations

离线目标条件强化学习与准度量表示

Vivek Myers, Bill Chunyuan Zheng, Benjamin Eysenbach, Sergey Levine

AI总结 本文提出了一种结合对比表示和时间距离的离线目标条件强化学习方法,利用准度量表示空间结构和约束,实现最优目标到达,提升缝合任务和高维环境下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏