SteerVLA: Steering Vision-Language-Action Models in Long-Tail Driving Scenarios
SteerVLA:在长尾驾驶场景中引导视觉-语言-动作模型
机构 * Stanford University(斯坦福大学) ; University of California, Berkeley(加州大学伯克利分校) ; Microsoft(微软公司)
AI总结 SteerVLA通过结合视觉-语言模型的推理能力,生成细粒度语言指令以提升驾驶策略的稳健性和长尾场景下的性能。