Evo-1: Lightweight Vision-Language-Action Model with Preserved Semantic Alignment
Evo-1:轻量级视觉-语言-动作模型,保持语义对齐
机构 * School of AI, Shanghai Jiao Tong University(上海交通大学人工智能学院) ; EvoMind Tech(EvoMind科技) ; IAAR-Shanghai(IAAR-上海) ; SII ; Carnegie Mellon University(卡内基梅隆大学) ; University of Cambridge(剑桥大学) ; Nanyang Technological University(南洋理工大学)
专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract);分类 cs.RO、cs.CV
AI总结 Evo-1是一种轻量级的视觉-语言-动作模型,通过减少计算并保持语义对齐,实现了高效的部署和强大的性能。
Comments Github: https://github.com/MINT-SJTU/Evo-1