arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2025-12-17 至 2025-12-17 共收录 15 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 5 篇

2510.19981 2025-12-17 cs.CV 83%

FutrTrack: A Camera-LiDAR Fusion Transformer for 3D Multiple Object Tracking

FutrTrack: 一种基于相机与激光雷达融合的变压器用于三维多目标跟踪

Martha Teiko Teye, Ori Maoz, Matthias Rottmann

机构 * University of Wuppertal(乌珀塔尔大学) Institute of Computer Science, Osnabrück University(计算机科学研究所,奥斯纳布鲁克大学)

专题命中 感知 :LiDAR(title,abstract);BEV(abstract);分类 cs.CV

AI总结 FutrTrack通过融合相机与激光雷达数据,利用基于变压器的跟踪框架,在多目标跟踪中实现了高效且鲁棒的跟踪性能。

Comments Accepted to VISAPP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07740 2025-12-17 cs.CV 79%

LSM: A Comprehensive Metric for Assessing the Safety of Lane Detection Systems in Autonomous Driving

LSM:用于评估自动驾驶中车道检测系统安全性的综合指标

Jörg Gamerdinger, Sven Teufel, Stephan Amann, Georg Volk, Oliver Bringmann

机构 * University of Tübingen, Faculty of Science, Department of Computer Science, Embedded Systems Group(图宾根大学,科学学院,计算机科学系,嵌入式系统组)

专题命中 感知 :autonomous driving(title);trajectory planning(abstract);分类 cs.CV

AI总结 本文提出LSM,一种用于评估自动驾驶中车道检测系统安全性的综合指标,考虑了场景语义、检测范围及车辆速度等因素,通过安全分数评估系统安全性。

Comments Accepted at IEEE VTC-Fall 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14158 2025-12-17 cs.CV cs.CR 57%

CIS-BA: Continuous Interaction Space Based Backdoor Attack for Object Detection in the Real-World

CIS-BA:基于连续交互空间的面向现实世界目标检测的后门攻击

Shuxin Zhao, Bo Lang, Nan Xiao, Yilang Zhang

机构 * organization= State Key Laboratory of Complex \& Critical Software Environment , addressline= Beihang University , city= Beijing , postcode= 100191 , country= China organization= Zhongguancun Laboratory , addressline= , city= Beijing , postcode= 100080 , country= China

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 CIS-BA通过引入连续交互空间的触发机制,实现了对现实世界目标检测模型的高效且鲁棒的后门攻击,有效提升了攻击成功率并规避了现有防御方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14126 2025-12-17 cs.CV 57%

Consistent Instance Field for Dynamic Scene Understanding

一致实例场用于动态场景理解

Junyi Wu, Van Nguyen Nguyen, Benjamin Planche, Jiachen Tao, Changchang Sun, Zhongpai Gao, Zhenghao Zhao, Anwesa Choudhuri, Gengyu Zhang, Meng Zheng, Feiran Wang, Terrence Chen, Yan Yan, Ziyan Wu

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) United Imaging Intelligence(联合影像智能)

专题命中 感知 :occupancy(abstract);分类 cs.CV

AI总结 本文提出了一种基于变形3D高斯的连续概率时空表示,用于动态场景理解,通过解耦可见性与实例身份,提升新颖视角分割和开放词汇4D查询任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01705 2025-12-17 cs.RO 57%

Efficient Collision Detection for Long and Slender Robotic Links in Euclidean Distance Fields: Application to a Forestry Crane

在欧几里得距离场中高效检测长而细的机械臂碰撞:应用于林业起重机

Marc-Philip Ecker, Bernhard Bischof, Minh Nhat Vu, Christoph Fröhlich, Tobias Glück, Wolfgang Kemmetmüller

机构 * Automation & Control Institute (ACIN), TU Wien(自动化与控制研究所(ACIN),维也纳技术大学) Center for Vision, Automation & Control, AIT Austrian Institute of Technology GmbH(视觉、自动化与控制中心,奥地利技术研究所)

专题命中 感知 :LiDAR(abstract);分类 cs.RO

AI总结 本文提出了一种针对长细机械臂的高效碰撞检测算法,通过利用其细长结构提升运动规划效率,适用于林业起重机等大尺寸机械臂的应用。

Comments Accepted at IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 4 篇

2512.06112 2025-12-17 cs.RO cs.AI cs.CV 85%

WAM-Flow: Parallel Coarse-to-Fine Motion Planning via Discrete Flow Matching for Autonomous Driving

WAM-Flow:通过离散流匹配实现自动驾驶的并行粗到细路径规划

Yifang Xu, Jiahao Cui, Feipeng Cai, Zhihao Zhu, Hanlin Shang, Shan Luan, Mingwang Xu, Neng Zhang, Yaoyi Li, Jia Cai, Siyu Zhu

机构 * Fudan University(复旦大学) Yinwang Intelligent Technology Co., Ltd(英伟达智能科技有限公司)

专题命中 规划控制 :autonomous driving(title,abstract);trajectory planning(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 WAM-Flow通过离散流匹配实现自动驾驶的并行粗到细路径规划,结合几何感知目标和并行生成,提升闭环性能。

Comments 18 pages, 11 figures. Code & Model: https://github.com/fudan-generative-vision/WAM-Flow

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11872 2025-12-17 cs.RO cs.AI cs.CV 82%

WAM-Diff: A Masked Diffusion VLA Framework with MoE and Online Reinforcement Learning for Autonomous Driving

WAM-Diff: 一种结合MoE和在线强化学习的掩码扩散VLA框架用于自动驾驶

Mingwang Xu, Jiahao Cui, Feipeng Cai, Hanlin Shang, Zhihao Zhu, Shan Luan, Yifang Xu, Neng Zhang, Yaoyi Li, Jia Cai, Siyu Zhu

机构 * Fudan University(复旦大学) Yinwang Intelligent Technology Co., Ltd(云网智能科技有限公司)

专题命中 规划控制 :autonomous driving(title,abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 WAM-Diff通过结合MoE和在线强化学习的掩码扩散框架,提升自动驾驶轨迹生成的性能与灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05638 2025-12-17 cs.RO cs.AI cs.SY eess.SY 62%

Closing the Loop: Motion Prediction Models beyond Open-Loop Benchmarks

闭环:超越开环基准的运动预测模型

Mohamed-Khalil Bouzidi, Christian Schlauch, Nicole Scheuerer, Yue Yao, Nadja Klein, Daniel Göhring, Jörg Reichardt

机构 * Freie Universität Berlin(柏林自由大学) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Continental AG(大陆集团)

专题命中 规划控制 :autonomous driving(abstract);分类 cs.RO、cs.AI

AI总结 本文研究了运动预测模型与规划器的交互,发现高开环精度不必然带来更好闭环驾驶性能,且缩小版模型在某些情况下表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14151 2025-12-17 cs.AR cs.PF 50%

Adaptive Cache Pollution Control for Large Language Model Inference Workloads Using Temporal CNN-Based Prediction and Priority-Aware Replacement

基于时间卷积网络的自适应缓存污染控制:用于大语言模型推理工作负载

Songze Liu, Hongkun Du, Shaowen Wang

专题命中 规划控制 :occupancy(abstract)

AI总结 本文提出基于时间卷积网络的自适应缓存污染控制机制,通过预测和优先级替换策略优化LLM推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. BEV与占用 2 篇

2512.14225 2025-12-17 cs.CV 85%

OmniGen: Unified Multimodal Sensor Generation for Autonomous Driving

OmniGen:面向自动驾驶的统一多模态传感器生成

Tao Tang, Enhui Ma, xia zhou, Letian Wang, Tianyi Yan, Xueyang Zhang, Kun Zhan, Peng Jia, XianPeng Lang, Jia-Wang Bian, Kaicheng Yu, Xiaodan Liang

机构 * Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区) Westlake University(西湖大学) Li Auto Inc.(Li汽车公司) The University of Toronto(多伦多大学) University of Macau(澳门大学)

专题命中 BEV与占用 :autonomous driving(title,abstract);BEV(abstract);LiDAR(abstract);分类 cs.CV

AI总结 OmniGen通过统一框架生成对齐的多模态传感器数据,结合共享BEV空间和UAE方法,实现高效且灵活的传感器生成。

Comments ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14447 2025-12-17 nucl-th nucl-ex 50%

Modeling Short-Range Nucleon Pair and Triplet Abundances in Atomic Nuclei

原子核中短程核子对和三重团丰度建模

I. Wischnevsky Shlush, A. Denniston, R. Wagner, I. Korover, E. Piasetzky

专题命中 BEV与占用 :occupancy(abstract)

AI总结 该研究利用独立粒子壳模型和谐振子基底,计算原子核中短程关联核子对和三重团的丰度,揭示了核子-核子相互作用和壳层占据对SRC对形成的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 激光雷达 3 篇

2511.16349 2025-12-17 cs.CV cs.GR 79%

CRISTAL: Real-time Camera Registration in Static LiDAR Scans using Neural Rendering

CRISTAL:利用神经渲染进行静态LiDAR扫描中的实时相机定位

Joni Vanherck, Steven Moonen, Brent Zoomers, Kobe Werner, Jeroen Put, Lode Jorissen, Nick Michiels

机构 * Hasselt University - Digital Future Lab - Flanders(哈塞尔特大学-数字未来实验室-弗拉芒)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.CV

AI总结 CRISTAL通过神经渲染技术实现静态LiDAR扫描中的实时相机定位,提供无漂移且具有正确度量尺度的跟踪,优于现有SLAM流程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13423 2025-12-17 physics.optics eess.IV 57%

Multi-wavelength ghost imaging: a review

多波长鬼成像:综述

Tong Tian, Sukyoon Oh, Christian Spielmann

专题命中 激光雷达 :LiDAR(abstract);分类 eess.IV

AI总结 多波长鬼成像通过结合不同波长的光子技术,实现了从极紫外到太赫兹波段的广泛应用,提供低损伤显微镜、视频速率激光雷达和非破坏性检测等新方法。

Journal ref Vicinagearth 2, 4 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14235 2025-12-17 cs.CV 57%

4D-RaDiff: Latent Diffusion for 4D Radar Point Cloud Generation

4D-RaDiff:用于4D雷达点云生成的潜在扩散

Jimmie Kwok, Holger Caesar, Andras Palffy

机构 * Delft University of Technology(代尔夫特理工大学) Perciv AI

专题命中 激光雷达 :LiDAR(abstract);分类 cs.CV

AI总结 4D-RaDiff通过潜在扩散生成4D雷达点云,提升目标检测性能并减少标注数据需求

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 多传感器融合 1 篇

2512.13177 2025-12-17 cs.CV cs.RO 79%

MMDrive: Interactive Scene Understanding Beyond Vision with Multi-representational Fusion

MMDrive: 通过多表示融合超越视觉的交互场景理解

Minghui Hou, Wei-Hsing Huang, Shaofeng Liang, Daizong Liu, Tai-Hao Wen, Gang Wang, Runwei Guan, Weiping Ding

机构 * organization= College of Computer Science Technology, Jilin University , city= Changchun , country= China organization= Georgia Institute of Technology , city= Atlanta , country= USA organization= Qingdao Institute of Software, College of Computer Science Technology, China University of Petroleum (East China) , city= Qingdao , country= China organization= Institute for Math \& AI, Wuhan University , city= Wuhan , country= China organization= University of Michigan, Ann Arbor , country= USA organization= Thrust of Artificial Intelligence, Hong Kong University of Science organization= School of Artificial Intelligence Computer Science, Nantong University , city= Nantong , country= China

专题命中 多传感器融合 :autonomous driving(abstract);LiDAR(abstract);occupancy(abstract);分类 cs.RO、cs.CV

AI总结 MMDrive通过融合占用图、LiDAR点云和文本描述,实现超越视觉的三维场景理解,提升自动驾驶的多模态推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏