Behavior Cloning of MPC for 3-DOF Robotic Manipulators
三自由度机械臂MPC的行为克隆
机构 * University of Waterloo(多伦多大学) ; Universite de Technologie de Compiègne(技术与科学大学) ; Nanyang Technological University(南洋理工大学) ; Polytechnique Montréal(蒙特利尔理工学院)
专题命中 模仿学习与强化学习 :robotic(title,abstract);分类 cs.RO、cs.LG
AI总结 针对MPC实时计算负担重的问题,采用行为克隆方法近似MPC策略,通过多种神经网络架构实现三自由度机械臂的实时控制,在宽松容差下推理延迟降低3倍,成功率84.98%。
Comments Accepted at the IEEE ICRA 2026 Workshop on Reinforcement Learning in the Era of Imitation Learning (RL4IL), 6 pages excluding references