arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-08-25 至 2026-08-25 共收录 22 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 3 篇

2608.21414 2026-08-25 cs.RO cs.LG 新提交 79%

RiskWorld: Object-Centric Latent World Modeling for Autonomous Driving Risk Identification

RiskWorld:面向自动驾驶风险识别的以对象为中心的潜在世界建模

Jingzheng Li, Yufei Ge, Qianren Mao, Zhijun Chen, Bing Li, Xingyu Peng, Baochang Zhang, Xianglong Liu

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO

AI总结 提出 RiskWorld 模型,以对象为中心的潜在世界建模,结合预训练视频表示与自车-对象历史,在 RiskBench 上实现 63.0% F1 和 2.1% 误报率,可有效识别自动驾驶风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21380 2026-08-25 cs.RO cs.AI cs.CV cs.IT 新提交 75%

RoboShape: Information-Theoretic Point Cloud Representations for Privacy-Aware Robot Perception

RoboShape:面向隐私感知机器人感知的信息论点云表示

Oguzhan Baser, Mirac Sozen, Kaan Kale, Sandeep Chinchali, Sriram Vishwanath

机构 * The University of Texas at Austin(得克萨斯大学奥斯汀分校) Bogazici University(博加齐大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 感知 :LiDAR(abstract,abstract_cn);分类 cs.RO、cs.CV、cs.AI

AI总结 RoboShape 是一种信息论引导的点云压缩工具,可在保留物体分类效用的同时降低敏感属性泄露,缩小嵌入体积,发布代码库供机器人社区使用。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23140 2026-08-25 cs.CV cs.RO 新提交 62%

MIVIFI: Bridging Perspective and Fisheye Domains for Training Multi-View Fisheye Image Generation Models

MIVIFI:弥合透视域与鱼眼域以训练多视图鱼眼图像生成模型

Matthias Neuwirth-Trapp, Begüm Altunbas, Jiayi Wang, Yan Xia, Maarten Bieshaar, Xinyu Huang, Daniel Cremers

机构 * ETH Zurich(苏黎世联邦理工学院) Bosch Research(博世研究中心) Technical University of Munich(慕尼黑工业大学)

专题命中 感知 :occupancy(abstract);分类 cs.RO、cs.CV

AI总结 本研究针对多视图鱼眼图像生成问题,提出SyntheOcc-FE与MIVIFI两种方法,其中MIVIFI利用跨域学习缓解鱼眼数据稀缺问题,实现高保真的多视图鱼眼图像生成。

Comments Accepted at the IEEE International Conference on Intelligent Transportation Systems (ITSC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 4 篇

2608.23486 2026-08-25 cs.CV cs.RO 新提交 81%

GeoWAM: Visual Geometry World Action Models for Autonomous Driving

GeoWAM:面向自动驾驶的视觉几何世界动作模型

Yiren Lu, Xin Ye, Jiaming Liu, Jin Yao, Yi-chung Chen, Liam Merino, Dhruva Dixith Kurra, Min Cai, Tom Lampo, Yu Yin, Danhua Guo, Burhan Yaman

机构 * Uber AV Labs(优步自动驾驶实验室) Case Western Reserve University(凯斯西储大学)

专题命中 规划控制 :autonomous driving(title,abstract);分类 cs.RO、cs.CV

AI总结 该研究提出 GeoWAM,一种用于自动驾驶的视觉几何世界动作模型,通过预训练预测未来场景几何来学习动力学,经评估其生成的驾驶策略比图像基方案更强,确立未来几何预测为自动驾驶有效预训练目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23123 2026-08-25 cs.NI 新提交 78%

Distributed Trajectory Planning and Resource Allocation for Dynamic Multi-UAV Collaborative Computing

面向动态多无人机协同计算的分布式轨迹规划与资源分配

Tiankui Zhang, Wenlong Xu, Tianyi Shi, Xiaoxia Xu, Arumugam Nallanathan

专题命中 规划控制 :trajectory planning(title,abstract)

AI总结 本文针对动态参与的多无人机协同计算场景,构建分布式MEC框架,基于斯塔克尔伯格博弈联合优化轨迹与资源,提出分层MADRL算法,仿真显示其能提升无人机效率、降低移动终端开销且适配不同网络规模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21631 2026-08-25 cs.RO math.OC 新提交 74%

OpenSCvx: An Open-Source Modular and Extensible Nonlinear Trajectory Planning Package

OpenSCvx:开源模块化可扩展非线性轨迹规划包

Christopher R. Hayner, Griffin J. Norris, Fabio Spada, Samet Uzun, Avi Mittal, Behcet Acıkmese, Karen Leung

机构 * University of Washington(华盛顿大学) General Robotics(通用机器人公司) University of California, Berkeley(加州大学伯克利分校) Zoox(Zoox公司)

专题命中 规划控制 :trajectory planning(title);分类 cs.RO

AI总结 该研究介绍开源Python框架OpenSCvx,它通过符号建模接口简化轨迹优化问题的构建与求解,支持连续时间约束等功能,助力快速开发与扩展轨迹优化方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22326 2026-08-25 cs.RO 新提交 57%

GCS-Bridging: Restoring Connectivity of Disconnected Convex Sets for Graph-of-Convex-Sets Motion Planning

GCS-Bridging:恢复凸集图运动规划中断开凸集的连通性

Xiaokai Zhou, Baoshi Cao, Yang Liu, Kui Sun, Boyu Ma, Zhengpu Wang, Zongwu Xie

机构 * State Key Laboratory of Robotics and Systems, Harbin Institute of Technology(哈尔滨工业大学机器人技术与系统国家重点实验室) School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与航天工程学院)

专题命中 规划控制 :trajectory planning(abstract);分类 cs.RO

AI总结 针对凸集图(GCS)规划中起始与目标区域断开的问题,提出GCS-Bridging方法,通过无碰撞点路径与凸集膨胀恢复连通性,模拟与硬件实验验证其高成功率与实用性。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 端到端驾驶 1 篇

2608.23405 2026-08-25 cs.CV cs.RO 新提交 81%

MomADv2: Reliable Temporal Memory for End-to-End Autonomous Driving

MomADv2:面向端到端自动驾驶的可靠时序记忆

Ziying Song, Shengkai Zhang, Lin Liu, Peiliang Wu, Lei Yang, Dongyang Xu, Bin Sun, Li Wang, Shaoqing Xu, Caiyan Jia, Yadan Luo

专题命中 端到端驾驶 :autonomous driving(title,abstract);分类 cs.RO、cs.CV

AI总结 针对自动驾驶时序记忆易失效的问题,提出 MomADv2 框架,含选择性记忆查询模块与流匹配残差修正器,在多数据集上使碰撞率降 15.6%。

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. BEV与占用 6 篇

2608.23206 2026-08-25 cs.CV 新提交 79%

Learning Spherical Occupancy Profiles for Multi-View 3D Reconstruction and Generation

用于多视图三维重建与生成的球形占用轮廓学习

YiHsuan Tsai

机构 * Nanjing University(南京大学)

专题命中 BEV与占用 :occupancy(title,abstract);分类 cs.CV

AI总结 该研究提出将逐光线球形占用轮廓作为统一中间表示,训练判别式解码器与生成式流水线,在多视图三维重建任务中取得良好效果,且可迁移至真实照片场景。

Comments 12 pages,5 figures,5 tables. Code and data will be released

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21440 2026-08-25 cs.RO cs.AI 新提交 62%

Geo-VLA: Geometry-Aware Vision-Language-Action Planning via Internalization of Map Semantics

Geo-VLA:通过内化地图语义实现几何感知的视觉-语言-动作规划

Ran Chen, Jiaxing Ren, Zhikun Zhang, Yunhao Hou, Junbao Zhuo, Bochao Zou

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.RO、cs.AI

AI总结 该研究针对VLA模型在复杂驾驶场景中规划性能不足的问题,提出可即插即用的Geo-VLA框架,结合自研Geo-QA数据集,在NAVSIM v1上实现单目VLA规划器的新SOTA。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21395 2026-08-25 cs.RO cs.AI 新提交 62%

ODG-NoMaD: Overhead-Camera Direction-Guided NoMaD

ODG-NoMaD: overhead相机方向引导的NoMaD

Blossom Treesa Bastian, Keerthi S. Shetty, Manish Kolachalam, Rani Malhotra, Ashish Dutta

机构 * Applied Research Center for Autonomous Machines, Infosys Center for Emerging Technologies(Infosys新兴技术中心自主机器应用研究中心) Dept. of Mechanical Engineering, IIT Kanpur(印度理工学院坎普尔分校机械工程系)

专题命中 BEV与占用 :occupancy(abstract);分类 cs.RO、cs.AI

AI总结 该研究提出ODG-NoMaD,通过overhead相机方向引导改进NoMaD,在模拟办公环境中大幅减少残余距离、优于NaviDiffusor且全程无碰撞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22992 2026-08-25 cs.NI cs.LG eess.SP 新提交 50%

Channel-Token Attention for Reliable Dynamic Spectrum Access under Bursty Primary-User Traffic

面向突发主用户业务的可靠动态频谱接入的信道-令牌注意力机制

Krishna Acharya, Dinanath Padhya, Utsab Dahal, Ashish Kandel, Binod Sapkota

专题命中 BEV与占用 :occupancy(abstract)

AI总结 针对突发主用户业务,提出TACAN策略,结合信道-令牌注意力与Transformer优化,在20信道网络中提升存在分组接入成功率、降低时延与可靠性差距,未获得分组吞吐量增益。

Comments 9 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22969 2026-08-25 physics.optics cond-mat.mtrl-sci 新提交 50%

Self-consistent modelling of all-optical switching and magneto-optic readout in an integrated Si$_3$N$_4$/GdFeCo waveguide

集成Si₃N₄/GdFeCo波导中全光开关与磁光读出的自洽建模

Muhammad Arief Mulyana, Budi Adiperdana, Ayi Bahtiar

专题命中 BEV与占用 :occupancy(abstract)

AI总结 本文针对集成Si₃N₄/GdFeCo波导元件,建立全光开关与磁光读出的自洽模型,揭示导波光的磁化相关特征及切换效率,为相关器件设计提供理论支撑

Comments 46 pages, 10 figures. Supplementary material included as an ancillary file

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22931 2026-08-25 cond-mat.mtrl-sci 新提交 50%

Composition- and Ordering-Dependent Evolution of Simulated Kikuchi Patterns of Au-Ni Alloys

Au-Ni合金模拟菊池花样的成分与有序度依赖演化

Camila A. Teixeira, Lukas Berners, Sandra Korte-Kerzel, Ulrich Kerzel

专题命中 BEV与占用 :occupancy(abstract)

AI总结 该研究分析Au-Ni合金模拟菊池花样的成分、有序度等影响因素,明确归一化强度分布和带宽可区分菊池花样,有望用于未来基于表示学习的索引方法。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 激光雷达 3 篇

2608.21371 2026-08-25 physics.ins-det cs.CV 新提交 81%

Gate Voltage Effect on Pulse Detection Efficiency of Perimeter-Gated SPADs

栅极电压对周边栅控单光子雪崩二极管(pg-SPADs)脉冲探测效率的影响

Hunter Guthrie, Md Sakibur Sajal, Zexi Liu, Marc Dandin

专题命中 激光雷达 :LiDAR(summary_cn,abstract);分类 cs.CV

AI总结 本研究针对周边栅控单光子雪崩二极管(pg-SPADs)在脉冲光学系统中的权衡关系空白,明确其0.35μm CMOS工艺制备的器件以脉冲探测效率换虚假事件扩散降低,提出脉冲LIDAR应用的最优使用指南。

Comments 4 pages, 7 figures, accepted in MWSCAS 2026 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21550 2026-08-25 cs.RO 新提交 70%

GOLEM: Modular Humanoid Autonomy Towards Electric Vehicle Battery Disassembly

GOLEM:面向电动汽车电池拆解的模块化人形自主系统

Max Conway, William Xie, Allen Devaraj, Yutong Zhang, Niraj Pudasaini, Mateo Feit, Adam Abid, Zachary Allen, Chen Liu, Xuan Tan, Jensen Lavering, Jason Chen, Lyle Antieau, Anthony Von Pischke, Alessandro Roncone, Zachary Sunberg, Nikolaus Correll

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) University of Notre Dame(圣母大学)

专题命中 激光雷达 :LiDAR(abstract,abstract_cn);分类 cs.RO

AI总结 该研究针对人工拆解报废EV电池的痛点,提出适配Unitree H1-2人形机器人的GOLEM开源模块化架构,通过仿真与现实实验验证了其在电池拆解各模块的性能,可用于人形机器人相关能力的公平对比与开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21468 2026-08-25 cs.CV 新提交 57%

3D Point Cloud from Close-Range Photogrammetry for Defect Characterisation of Rubberised Concrete

用于橡胶混凝土缺陷表征的近程摄影测量生成三维点云

Jiacheng Liu, Mohammed Alnahhal, Ailar Hajimohammadi, Sara Gonizzi Barsanti, Jinling Wang, Mohsen Kalantari

专题命中 激光雷达 :LiDAR(abstract);分类 cs.CV

AI总结 本研究针对橡胶混凝土调整近程摄影测量工作流程,结合SfM、MVS算法及RGB引导裂纹提取方法,生成亚毫米级分辨率三维模型,可替代激光雷达用于实验室样本表面检查与变形监测,为后续研究建立几何基准。

Comments 8 pages, 10 figures. Published in the International Archives of the Photogrammetry, Remote Sensing and Spatial Information Sciences, XXV ISPRS Congress 2026, Toronto, Canada

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 多传感器融合 1 篇

2608.22023 2026-08-25 cs.LG 新提交 50%

Spectral Pre-Filtering for Context-Adaptive Sensor Fusion: A Four-Role FFT-GDCB Integration for High-Stakes Decision Systems

面向高风险决策系统的上下文自适应传感器融合的谱预滤波:FFT-GDCB四角色集成方案

Oleg Miroshnichenko

专题命中 多传感器融合 :LiDAR(abstract)

AI总结 本研究针对传感器融合中周期性结构污染导致的卡尔曼滤波器协方差校准问题,提出FFT-GDCB四角色预滤波方案,在六个领域验证其性能且计算开销极低。

Comments 15 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 仿真评测 2 篇

2608.23040 2026-08-25 cs.RO 新提交 57%

RoboRacer Arena: Scaling High-Fidelity Autonomous Racing in Isaac Sim

RoboRacer Arena:在Isaac Sim中扩展高保真自主赛车研究

Mihaela-Larisa Clement, Agnes Poks, Ezio Bartocci

机构 * TU Wien(维也纳技术大学) AIT Austrian Institute of Technology(奥地利技术研究所)

专题命中 仿真评测 :occupancy(abstract);分类 cs.RO

AI总结 本研究针对RoboRacer平台赛道扩展问题,开发RoboRacer Arena系统可从占用地图自动生成高保真3D赛车环境,支持自然语言生成赛道,在Isaac Sim中实现高效可复现的自主赛车仿真。

Comments Submitted to ICRA 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22833 2026-08-25 cs.MA cs.AI 新提交 57%

Minimal Local Simulation Foundations for LLM- and VLM-Driven Agents in 2D and 3D Environments

用于二维和三维环境中大型语言模型(LLM)与视觉语言模型(VLM)驱动智能体的极简局部仿真基础

Ryuki Hyodo

专题命中 仿真评测 :occupancy(abstract);分类 cs.AI

AI总结 该研究提出SD-AgentFoundry-2D和3D两款极简仿真基础,可在多系统本地运行,用于教育与快速原型设计,为学习生成式社会仿真及构建特定领域扩展提供便捷起点。

Comments GitHub Repositories: this https URL (https://github.com/ryukih/SD-AgentFoundry-2D) and this https URL (https://github.com/ryukih/SD-AgentFoundry-3D)

详情

展开后加载摘要…

URL PDF HTML 收藏

8. 其他自动驾驶 2 篇

2608.22549 2026-08-25 cs.AI cs.LG 新提交 79%

Scaling Curriculum Learning For Autonomous Driving

扩展自动驾驶的课程学习方法

Cevahir Koprulu, David Paz, Feng Tao, Yuliang Guo, Xinyu Huang, Ufuk Topcu, Liu Ren

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Bosch Center for AI(博世人工智能中心)

专题命中 其他自动驾驶 :autonomous driving(title,abstract);分类 cs.AI

AI总结 该研究提出CL4AD,将课程学习集成到批量自动驾驶模拟器中,在GPUDRIVE实验中使自动驾驶RL智能体的训练效率大幅提升,提前10亿步达到99%成功率,减少77%的时间,样本效率提升67%。

Comments 31 pages, 18 figures. Under review at NeurIPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22723 2026-08-25 cs.CV 新提交 57%

LoViF 2026 The First Challenge on Unified Removal of Raindrops and Reflections: Methods and Results

LoViF 2026:首届雨滴与反射联合去除挑战赛:方法与结果

Zewei He, Xi Tong, Yu Chen, Xingyu Liu, Xin Li, Zepeng Wang, Jiagao Hu, Fuhao Li, Yuxuan Chen, Fei Wang, Daiguo Zhou, Minmin Yi, Chuanrui Zhang, Liwen Zhang, Yeongjin Jeong, Hyunjin Cho, Jiwon Lee, Minsang Kim, Jae Woong Soh, Jin-Hui Jiang, Rong-Lin Jian, Chih-Chung Hsu, Youngjin Oh, Junhyeong Kwon, Junyoung Park, Jae Hyun Park, Sung Ju Lee, Nam Ik Cho, Vishwajeet Shukla, Himanshu Baurai, Zhiqi Zhang, Kui Jiang, Zhaocheng Yu, Runzhe Li, Dawei Fan, Hao Li, Zhanshuo Zhang, Fan Ji, Jiangmeng Li, Xiongxin Tang, Fanjiang Xu, Shangquan Sun, Anh-Kiet Duong, Petra Gomez-Krämer, Jean-Michel Carozza, Ruibo Zhang, Dexiang Hong, Xinyan Liu, Shengeng Tang, Weidong Chen, Tzu-Hsuan Weng, Min-Te Sun

专题命中 其他自动驾驶 :autonomous driving(abstract);分类 cs.CV

AI总结 该论文回顾了首届LoViF 2026雨滴与反射联合去除挑战赛,该赛针对自动驾驶雨天雨滴-反射复合退化问题,吸引149人参赛、12份有效提交,基于RDRF数据集评估,分析方法结果并提供研究见解。

Comments ECCV 2026 Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏