WorldVLN: Autoregressive World Action Model for Aerial Vision-Language Navigation
WorldVLN: 用于空域视觉-语言导航的自回归世界动作模型
机构 * Tsinghua University(清华大学) ; Shandong University(山东大学) ; Manifold AI ; Beijing Institute of Technology(北京理工大学) ; Northeastern University(东北大学)
专题命中 具身与机器人 :world model(abstract);world models(abstract);world model(abstract);world models(abstract)
AI总结 WorldVLN提出一种自回归世界动作模型,通过预测潜在世界演变并生成可执行的航点动作,提升空域视觉-语言导航性能,优于现有基线模型。