DriveReward: A Comprehensive Dataset and Generative Vision-Language Reward Model for Autonomous Driving
DriveReward:面向自动驾驶的综合数据集与生成式视觉语言奖励模型
机构 * Tsinghua University(清华大学) ; Xiaomi EV(小米汽车)
专题命中 图像生成评测 :generative vision(title);分类 cs.CV
AI总结 提出DriveReward数据集和专用视觉语言奖励模型,通过反事实标注和时序视觉引导,解决自动驾驶中奖励获取的泛化问题,在强化学习和轨迹选择中取得与基于规则方法相当的性能。