On the Generalization Capabilities, Design Choices and Limitations of Keypoint Imitation Learning
关键点模仿学习的泛化能力、设计选择与局限性
机构 * AI and Robotics Lab, IDLAB-AIRO, Ghent University-imec(人工智能与机器人实验室,IDLAB-AIRO,根特大学-imec) ; Robotics, Perception and Learning Lab, (RPL), EECS, KTH Royal Institute of Technology(机器人、感知与学习实验室,(RPL),EECS,皇家理工学院) ; INCAR Robotics AB, Stockholm, Sweden(INCAR机器人公司,斯德哥尔摩,瑞典)
AI总结 本文通过2000多次真实世界实验,系统评估了基于视觉基础模型的关键点模仿学习在机器人操作中的泛化能力、设计选择及局限性,发现其总体成功率达75%,显著优于RGB基线(47%),与S2扩散模型(73%)相当,但未超越其他表示方法且继承了基础模型的局限。
Comments This version was submitted to IROS 2026