BFA++: Hierarchical Best-Feature-Aware Token Prune for Multi-View Vision Language Action Model
BFA++: 多视角视觉语言动作模型的分层最佳特征感知令牌剪枝
机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) ; University of Chinese Academy of Sciences(中国科学院大学) ; LimX Dynamic(LimX动态) ; Nanjing University(南京大学) ; Nanyang Technological University(南洋理工大学) ; Zhejiang University(浙江大学)
专题命中 VLA模型 :vision language action(title);action model(title);vision-language-action(abstract);VLA(abstract)
AI总结 BFA++通过分层最佳特征感知令牌剪枝提升多视角视觉语言动作模型的效率和成功率
Comments 9 pages, 10 figures