Rethinking Visual-Language-Action Model Scaling: Alignment, Mixture, and Regularization
重新思考视觉-语言-动作模型的扩展:对齐、混合与正则化
机构 * Renmin University of China(中国人民大学) ; BeingBeyond ; Peking University(北京大学)
专题命中 机器人基础模型 :robotics(abstract);robotic(abstract);分类 cs.RO
AI总结 本研究重新审视视觉-语言-动作模型的扩展问题,探讨了对齐、混合与正则化在机器人控制中的关键作用,挑战了传统假设并提供实践指导。