ProcVLM: Learning Procedure-Grounded Progress Rewards for Robotic Manipulation
ProcVLM:基于学习的程序导向进度奖励用于机器人操作
机构 * School of Information, Renmin University of China(中国人民大学信息学院) ; Zhipu AI(智谱AI) ; Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)
AI总结 ProcVLM通过程序结构和阶段内视觉变化学习密集的进度奖励,提升机器人操作的程序推理能力,优于现有基线方法。