CombatVLA: An Efficient Vision-Language-Action Model for Combat Tasks in 3D Action Role-Playing Games
CombatVLA: 一种高效的视觉-语言-动作模型,用于3D动作角色扮演游戏中的战斗任务
机构 * Alibaba Group(阿里巴巴集团)
专题命中 VLA模型 :vision-language-action(title,abstract);action model(title,abstract);VLA(abstract);分类 cs.CV、cs.AI
AI总结 CombatVLA是一种高效的视觉-语言-动作模型,用于3D动作角色扮演游戏中的战斗任务,通过高效的训练和推理方法,在战斗理解基准上表现优异,并实现了游戏战斗的50倍加速。
Comments Accepted by ICCV 2025