Role-Conditioned Sub-Token Routing for Efficient Vision-Language-Action Policies
用于高效视觉-语言-动作策略的角色条件子令牌路由
机构 * Futurewei Technologies(未来智能技术公司)
专题命中 VLA模型 :VLA(summary_cn,abstract);vision-language-action(title,abstract);分类 cs.LG
AI总结 该研究针对VLA模型推理成本高的问题,提出RoleSub方法,通过角色条件子令牌路由压缩视觉和语言表示,在匹配视觉-KV预算下多数场景优于仅令牌控制,结合压缩后总KV仅为原始的9.2-11.3%且控制性能强。
Comments 12 pages, 5 tables