LaST-VLA: Thinking in Latent Spatio-Temporal Space for Vision-Language-Action in Autonomous Driving
LaST-VLA: 在自动驾驶的视觉-语言-动作中思考于潜在的空间-时间空间
专题命中 自动驾驶 :world model(abstract);world models(abstract);world model(abstract);world models(abstract)
AI总结 LaST-VLA通过潜在空间-时间推理框架,结合双特征对齐机制和渐进式SFT训练策略,提升自动驾驶中的视觉-语言-动作处理能力,实现更安全的物理基础推理。