Offline Goal-conditioned Reinforcement Learning with Quasimetric Representations
离线目标条件强化学习与准度量表示
AI总结 本文提出了一种结合对比表示和时间距离的离线目标条件强化学习方法,利用准度量表示空间结构和约束,实现最优目标到达,提升缝合任务和高维环境下的性能。
作者
Robotics / Reinforcement Learning
离线目标条件强化学习与准度量表示
AI总结 本文提出了一种结合对比表示和时间距离的离线目标条件强化学习方法,利用准度量表示空间结构和约束,实现最优目标到达,提升缝合任务和高维环境下的性能。