Multi-scale Predictive Representations for Goal-conditioned Reinforcement Learning
多尺度预测表示用于目标条件强化学习
机构 * Mila, McGill University(蒙特利尔大学Mila实验室) ; ServiceNow Research(ServiceNow研究) ; Qualcomm Research(高通研究)
AI总结 本文探讨了离线目标条件强化学习中鲁棒表示学习问题,提出多尺度预测监督框架Ms.PR,通过多尺度预测提升潜在空间中目标导向对齐,提升表示质量和任务性能。