GeoWAM: Visual Geometry World Action Models for Autonomous Driving
GeoWAM:面向自动驾驶的视觉几何世界动作模型
机构 * Uber AV Labs(优步自动驾驶实验室) ; Case Western Reserve University(凯斯西储大学)
专题命中 规划控制 :autonomous driving(title,abstract);分类 cs.RO、cs.CV
AI总结 该研究提出 GeoWAM,一种用于自动驾驶的视觉几何世界动作模型,通过预训练预测未来场景几何来学习动力学,经评估其生成的驾驶策略比图像基方案更强,确立未来几何预测为自动驾驶有效预训练目标。