A Collaborative Multi-Modality Interaction for VLA-based End-to-End Autonomous Driving
面向基于视觉-语言-动作(VLA)的端到端自动驾驶的协同多模态交互
机构 * National University of Singapore (NUS)(新加坡国立大学) ; Hunan University(湖南大学) ; The University of Western Australia (UWA)(西澳大学)
专题命中 端到端驾驶 :autonomous driving(title,abstract);trajectory planning(abstract);分类 cs.RO、cs.CV
AI总结 本文针对现有VLA自动驾驶模型决策不可靠、多模态交互不足的问题,提出含三类核心组件的多模态交互与多轨迹规划系统,实验显示其在安全推理与场景感知上优于现有系统。