Hybrid Training for Vision-Language-Action Models
视觉-语言-动作模型的混合训练
机构 * Qualcomm AI Research(高通AI研究)
专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV
AI总结 本文提出混合训练框架,旨在使视觉-语言-动作模型在推理时能够根据需要生成思考过程或直接预测动作,从而在保持性能提升的同时提高推理效率。
Comments Published as a conference paper at ICLR 2026