VLN-AVP: Zero-Shot Vision-Language Navigation with Hybrid Long-Short-Term Memory for Autonomous Valet Parking
VLN-AVP:用于自动代客泊车的基于混合长短时记忆的零样本视觉语言导航
机构 * Shanghai Jiao Tong University(上海交通大学) ; Yinwang Intelligent Technology Co., Ltd.(银望智能科技有限公司)
专题命中 GUI与屏幕智能体 :VLM(summary_cn,abstract);vision-language model(abstract)
AI总结 研究针对自主代客泊车依赖预建地图限制可扩展性问题,提出VLN-AVP零样本导航框架,结合BEV模型与VLM,引入混合记忆系统,构建数据集和基准,实验证明该方法在模拟和实际车辆实验中均有良好效果,提升了成功率。