arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

行业趋势

道路场景感知、驾驶规划与驾驶仿真。

2610.10759 自动驾驶

点云也要有记忆!剑桥交大把远期运动预测误差降71.6%

剑桥大学、上海交通大学、特温特大学、华威大学联合提出MESSENGER,为连续点云运动预测加入记忆和不确定性估计。nuScenes第四个未来帧的平均误差从0.088米降至0.025米,下降71.6%。模型保留多个历史时刻的信息,再按可靠程度

剑桥大学、上海交通大学、特温特大学、华威大学等
文章封面
2610.08761 自动驾驶

英伟达等让AI裁判一起进化,驾驶推理得分提高18.2%

英伟达、加州大学洛杉矶分校、加州大学伯克利分校、斯坦福大学提出VeriFine,让具身AI与评分裁判交替改进。AI的新错误用于调整训练题,裁判遇到判断瓶颈时再引入人工反馈。在驾驶推理实验中,固定评分器测得成绩从60.56提高到71.61,相

英伟达、加州大学洛杉矶分校、加州大学伯克利分校、斯坦福大学等
文章封面
2609.39841 自动驾驶

自动驾驶雷达补全新视角,DyRAD把物体恢复率从26.9%提到90.7%

以色列理工学院、康奈尔科技校区与NVIDIA提出DyRAD,从录制的车载雷达数据重建可换轨迹、换传感器配置的动态场景。它显式建模径向速度与传感器响应,在离轨视角的物体恢复率上从对照的26.9%提升到90.7%;结果来自论文数据集与指标。

以色列理工学院、康奈尔科技校区、NVIDIA等
文章封面
2609.36851 自动驾驶

小鹏给世界模型装上“测谎仪”:自动驾驶安全违规少了27.6%

香港中文大学(深圳)、小鹏汽车、西安电子科技大学等机构提出RoXDrive,让自动驾驶策略只从“听指令”的世界模型片段中学习。它在nuScenes上把DiffusionDrive的安全违规减少27.6%,并在超过13万段场景的内部数据上持续

香港中文大学(深圳)、小鹏汽车、西安电子科技大学等
文章封面
2609.30436 自动驾驶

港科大地平线攻克端到端智驾瓶颈:规划算力直降30.5%,驾驶评分还更高

香港科技大学、地平线、香港中文大学、南开大学等机构提出WALT,让自动驾驶规划器更好地利用视觉世界模型已经学到的道路信息。它先把行车轨迹转成紧凑的内部表示,再与路况画面的表示对齐,而不是直接让模型吐出一串坐标。在NAVSIM评测中,规划计算

香港科技大学、地平线、香港中文大学、南开大学等
文章封面
2609.24952 自动驾驶

NASA毅力号实机数据跑通AI越野:火星漫游车防陷通行准确率破87%

深空漫游车在松软异星土壤中极易发生车轮下陷打滑,依赖人工延时干预严重限制了探索范围与移动效率。南加州大学联合NASA喷气推进实验室与华盛顿州立大学等机构推出了面向火星行驶的端到端自监督通行评估模型。该系统在毅力号真实火星车跨越500个火星日

南加州大学、NASA喷气推进实验室、华盛顿州立大学等
文章封面
2609.20756 自动驾驶

英伟达斯坦福给自动驾驶请了个无渲染老师,仿真交互少千倍

KE:SAI、苏黎世联邦理工学院、英伟达研究院和斯坦福大学团队提出OPTED,用只看高清地图与车辆框的教师策略,给看相机画面的端到端驾驶模型做闭环后训练。两种学生模型的驾驶分数分别提高1.6倍和9.5倍,受控实验所需仿真交互约少三个数量级。

KE:SAI、苏黎世联邦理工学院、英伟达研究院、斯坦福大学等
文章封面
2609.08117 自动驾驶

斯坦福等做出393小时驾驶员动作库,转向前手臂运动多3.4倍

南佛罗里达大学、普渡大学、斯坦福大学、中佛罗里达大学联合建立DriveMotion,把360位驾驶员的393小时座舱视频整理成133关键点连续动作序列。论文发现,车辆机动前窗口的手臂运动幅度是同路线稳定驾驶对照的3.4倍。它提供的是数据集与

南佛罗里达大学、普渡大学、斯坦福大学、中佛罗里达大学等
文章封面
2609.00111 自动驾驶

Qwen下场做自动驾驶,一个4B模型同时感知、问答和规划

通义千问团队、华中科技大学联合提出Qwen-Drive-1.0。这个4B视觉语言模型把3D感知、驾驶视觉问答和运动规划放进同一框架,并在开环、伪闭环和闭环设置中评估规划表现。

通义千问团队、华中科技大学等
文章封面
2608.28404 自动驾驶

5500小时驾驶视频告诉法雷奥:先多训练,未必先堆大模型

同一笔训练预算,是把驾驶视频模型做得更大,还是让现有模型多看几遍数据?法雷奥AI与索邦大学的研究团队提出VATIX缩放研究,覆盖从100万到约90亿参数的视频扩散模型,并在最高5500小时驾驶数据上改变训练曝光量,得到一组面向固定数据池的缩

法雷奥AI、索邦大学等
文章封面
2608.26737 自动驾驶

复旦&CMU让激光雷达补全街景:只看1%体积也能生成稠密语义

车载激光雷达的一次扫描只占目标三维体积约1%,其余位置既没有几何信息,也没有类别标签。复旦大学、卡内基梅隆大学提出生成式语义场景补全GSSC,用一套离散扩散框架同时合成训练数据、从噪声生成完整场景,并修正已有模型的输出。

复旦大学、卡内基梅隆大学等
文章封面
2608.17420 自动驾驶

清华&长城汽车等提出SPVC:修好跨数据集驾驶视频里的结构错位

自动驾驶仿真把相机移到训练轨迹之外,3D高斯溅射生成的道路、建筑和车道线容易变形;向场景插入车辆后,前景还可能与背景错位。清华大学人工智能产业研究院、浙江大学、长城汽车、上海交通大学等机构提出SPVC,用一套两阶段视频扩散模型修复跨数据集驾

清华大学人工智能产业研究院、浙江大学、长城汽车、上海交通大学等
文章封面
2608.12932 自动驾驶

自动驾驶大模型提速4.7倍!普林斯顿FlashDrive把10B VLA延迟压到151毫秒

自动驾驶模型如果每次思考要717毫秒,车辆一秒只能更新约1.4次决策。普林斯顿大学与加州大学圣迭戈分校提出FlashDrive,把Alpamayo 1.5-10B视觉—语言—动作模型在单张GPU上的端到端延迟压到151毫秒,频率升至6.6H

普林斯顿大学、加州大学圣迭戈分校等
FlashDrive自动驾驶大模型加速效果文章封面
2607.23511 自动驾驶

中科大&理想汽车提出MOJITO:端到端自动驾驶告别两级流水线

中国科学技术大学、理想汽车和新南威尔士大学的研究人员联合提出了MOJITO,一个统一的端到端自动驾驶框架。它去掉了主流方案里「感知先压缩、规划后解码」的两级接口,让动作、图像、激光雷达特征在块级模态联合注意力中同步更新。在NAVSIM v1

中国科学技术大学、理想汽车、新南威尔士大学等
封面
2607.22038 AI基础设施

华为诺亚等让AI芯片按任务跳过计算,端侧延迟降51%至59%

多任务模型执行左转、右转、直行或刹车时,通常会完整运行同一套骨干网络,即使部分计算与当前任务无关。香港科技大学、华为诺亚方舟实验室、香港科技大学(广州)团队把任务命令直接变成硬件执行掩码,在FPGA闭环驾驶实验中将端侧延迟降低51%至59%

香港科技大学、华为诺亚方舟实验室、香港科技大学(广州)等
文章封面
↑