arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-08-19 至 2026-08-19 共收录 8 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 4 篇

2608.01035 2026-08-19 cs.RO cs.AI cs.CV 版本更新 82%

WAM-Diff2: Hierarchical AR-to-Diffusion Distillation for Highly Efficient Autonomous Driving VLA

WAM-Diff2:面向高效自动驾驶视觉-语言-动作(VLA)的分层自回归到扩散蒸馏

Zhihao Zhu, Hanlin Shang, Mingwang Xu, Feipeng Cai, Zhuolin He, Yaoyi Li, Jianhua Han, Hang Xu, Siyu Zhu

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 WAM-Diff2通过三阶段分层蒸馏策略,将预训练自回归VLA模型转化为高效扩散模型,缓解暴露偏差、实现与基线相当性能,解码速度提升2.8倍,结合系统级优化后达15.1倍加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18682 2026-08-19 cs.CV cs.AI 版本更新 81%

Multi-Scale Spectral Attention Module-based Hyperspectral Segmentation in Autonomous Driving Scenarios

基于多尺度光谱注意力模块的自动驾驶场景高光谱分割

Imad Ali Shah, Jiarong Li, Tim Brophy, Martin Glavin, Edward Jones, Enda Ward, Brian Deegan

机构 * School of Engineering, University of Galway, Ireland(Galway大学工程学院,爱尔兰) Ryan Institute, University of Galway, Ireland(Galway大学Ryan研究所,爱尔兰) Valeo Vision Systems, Tuam, Ireland(爱尔兰Tuam市Valeo Vision Systems公司)

专题命中 感知 :autonomous driving(title,abstract);分类 cs.CV、cs.AI

AI总结 本文提出多尺度注意力机制提升高光谱图像分割性能,通过不同核尺寸的1D卷积和自适应特征聚合,在多个城市驾驶场景数据集中提升mIoU和mF1指标,证明了最优核组合的dataset特异性。

Comments Under review-and-revisions

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14603 2026-08-19 cs.NI cs.AI cs.CV cs.IT math.IT 版本更新 62%

HMS-SCP: Task-Oriented Multi-Scale Semantic Communication for V2X Cooperative Perception

通过语义感知协同感知扩展智能交通系统的安全 horizon

Chun-Yeow Yeoh, Chee Keong Tan, Joanne Mun-Yee Lim, Heng-Siong Lim

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 本文提出 HMS-SCP 框架,通过多尺度语义冗余与 JSCC 编码实现带宽效率与鲁棒性的平衡,在 V2X 环境中保障安全关键型协同感知的性能。

Comments 15 pages, 7 figures, 6 tables, Submitted to IEEE Transactions on Vehicular Technology (TVT)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08748 2026-08-19 cs.RO cs.AI 版本更新 62%

Visual Prompting for Robotic Manipulation with Annotation-Guided Pick-and-Place Using ACT

面向机器人操作的视觉提示:采用带标注引导的拾取与放置方法,基于ACT算法

Muhammad A. Muttaqien, Tomohiro Motoda, Ryo Hanai, Yukiyasu Domae

机构 * Embodied AI Research Team(具身人工智能研究团队) National Institute of AIST(国家信息与系统技术研究所)

专题命中 感知 :trajectory planning(abstract);分类 cs.RO、cs.AI

AI总结 针对便利店机器人拾取放置任务的挑战,提出带标注引导视觉提示的感知-行动流水线,采用ACT算法实现自适应操作,提升了零售环境下的抓取精度与适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 1 篇

2506.13624 2026-08-19 eess.SY cs.RO cs.SY 版本更新 57%

Parallel Branch Model Predictive Control on GPUs

GPU上的并行分支模型预测控制

Luyao Zhang, Chenghuai Lin, Sergio Grammatico

机构 * Delft Center for Systems and Control, TU Delft(代尔夫特系统与控制中心,代尔夫特理工大学)

专题命中 规划控制 :trajectory planning(abstract);分类 cs.RO

AI总结 该研究提出基于GPU的分支模型预测控制轨迹规划求解器,结合迭代LQR等方法,开发两种定制内部LQR求解器,在大规模轨迹规划问题上性能优于高性能CPU求解器。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 端到端驾驶 1 篇

2606.14438 2026-08-19 cs.RO cs.AI 版本更新 76%

Physics-Grounded Causal Auditing of End-to-End Driving Planners

CADET: 基于物理的因果审计与无训练去混杂的端到端驾驶规划器

Zikun Guo, Minglan Chen, Jinyou Zhai, Rongjin Zou

机构 * School of Electronics Engineering, Kyungpook National University(庆北国立大学电子工程学院)

专题命中 端到端驾驶 :end-to-end driving(title);分类 cs.RO、cs.AI

AI总结 提出CADET框架,无需重新训练即可审计和修复预训练端到端驾驶规划器中的虚假关联,通过物理因果图识别混杂因素并干预测试时输入。

Comments 8pages 4figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. BEV与占用 1 篇

2606.29590 2026-08-19 gr-qc 版本更新 50%

Saturation Equations of State in Critical Gravitational Collapse: The Primordial Black Hole Threshold

临界引力坍缩中的饱和状态方程:原初黑洞阈值

Benaoumeur Bakhti

专题命中 BEV与占用 :occupancy(abstract)

AI总结 通过广义相对论模拟,研究具有饱和密度的状态方程对原初黑洞形成阈值和临界标度指数的影响,发现阈值增加约0.5%,但临界指数保持不变。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 仿真评测 1 篇

2603.11534 2026-08-19 cs.CV 版本更新 57%

Risk-Controllable Multi-View Diffusion for Driving Scenario Generation

可控风险多视角扩散用于驾驶场景生成

Hongyi Lin, Wenxiu Shi, Heye Huang, Dingyi Zhuang, Song Zhang, Yang Liu, Xiaobo Qu, Jinhua Zhao

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 RiskMV-DPO通过整合风险水平与物理风险建模,实现可控风险的多视角驾驶场景生成,提升3D检测性能并减少FID,推动安全导向的具身智能发展。

Comments 10 pages, 4 figures; accepted at the CVPR 2026 Workshop on Video Generative Models: Benchmarks and Evaluation (VGBE). Updated to the complete camera-ready version

Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏