Scalable Offline Model-Based RL with Action Chunks
可扩展的基于模型的强化学习与动作块
AI总结 本文提出MAC方法,通过动作块模型和拒绝采样提升离线基于模型的强化学习在复杂长 horizon 任务中的性能。
Comments 22 pages, 7 figures
作者
Robotics / Reinforcement Learning
可扩展的基于模型的强化学习与动作块
AI总结 本文提出MAC方法,通过动作块模型和拒绝采样提升离线基于模型的强化学习在复杂长 horizon 任务中的性能。
Comments 22 pages, 7 figures
训练时的动作条件化以实现高效的实时分块
机构 * Physical Intelligence(物理智能)
AI总结 本研究提出在训练时模拟推理延迟并直接条件化动作前缀,以实现更高效、计算成本更低的实时机器人控制。