arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2025-12-16 至 2025-12-16 共收录 38 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 10 篇

2512.12377 2025-12-16 cs.RO 83%

INDOOR-LiDAR: Bridging Simulation and Reality for Robot-Centric 360 degree Indoor LiDAR Perception -- A Robot-Centric Hybrid Dataset

INDOOR-LiDAR: 联接仿真与现实以提升机器人中心的360度室内LiDAR感知 -- 一个机器人中心的混合数据集

Haichuan Li, Changda Tian, Panos Trahanias, Tomi Westerlund

专题命中 感知 :LiDAR(title,abstract);BEV(abstract);分类 cs.RO

AI总结 INDOOR-LIDAR通过融合仿真与真实数据,为机器人感知研究提供了一个可扩展、真实且可重复的混合数据集,用于提升复杂室内环境中的感知能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11926 2025-12-16 cs.CV 70%

TransBridge: Boost 3D Object Detection by Scene-Level Completion with Transformer Decoder

TransBridge: 通过变换解码器进行场景级补全提升3D目标检测

Qinghao Meng, Chenming Wu, Liangjun Zhang, Jianbing Shen

机构 * School of Computer Science, Beijing Institute of Technology(北京理工大学计算机科学学院) Robotics and Autonomous Driving Lab (RAL), Baidu Research(百度研究机器人与自动驾驶实验室) State Key Laboratory of Internet of Things for Smart City, Department of Computer and Information Science, University of Macau(澳门大学智能城市物联网国家重点实验室,计算机与信息科学系)

专题命中 感知 :autonomous driving(abstract);LiDAR(abstract);分类 cs.CV

AI总结 TransBridge通过变换解码器进行场景级补全,提升3D目标检测性能,实现稀疏区域特征增强和密集点云生成

Comments 12 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04870 2025-12-16 eess.IV cs.CV 62%

Multi-modal Uncertainty Robust Tree Cover Segmentation For High-Resolution Remote Sensing Images

多模态不确定性鲁棒树冠覆盖分割用于高分辨率遥感图像

Yuanyuan Gui, Wei Li, Yinjian Wang, Xiang-Gen Xia, Mauro Marty, Christian Ginzler, Zuyuan Wang

机构 * School of Information and Electronics, Beijing Institute of Technology(信息与电子学院,北京理工大学) National Key Laboratory of Science and Technology on Space-Born Intelligent Information Processing(空间智能信息处理国家重点实验室) Department of Electrical and Computer Engineering, University of Delaware(电气与计算机工程系,德雷塞尔大学) Swiss Federal Institute for Forest, Snow, and Landscape Research WSL(瑞士森林、雪和景观研究联邦 institute WSL)

专题命中 感知 :LiDAR(abstract);分类 cs.CV、eess.IV

AI总结 MURTreeFormer通过多模态分割框架降低不确定性,提升高分辨率遥感图像中树冠分割的鲁棒性与准确性。

Journal ref IEEE Journal of Selected Topics in Applied Earth Observations and Remote Sensing 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13561 2025-12-16 cs.RO 57%

Near-Field Perception for Safety Enhancement of Autonomous Mobile Robots in Manufacturing Environments

近场感知用于制造环境中自主移动机器人的安全增强

Li-Wei Shih, Ruo-Syuan Mei, Jesse Heidrich, Hui-Ping Wang, Joel Hooton, Joshua Solomon, Jorge Arinez, Guangze Li, Chenhui Shao

机构 * Department of Mechanical Engineering, University of Michigan, MI 48109, USA Materials \& Manufacturing Systems Research, General Motors R \& D, Warren, MI 48092, USA

专题命中 感知 :LiDAR(abstract);分类 cs.RO

AI总结 本文提出三级近场感知框架,通过光断续检测、光位移测量和计算机视觉分类,提升自主移动机器人在制造环境中的安全性能。

Comments Submitted to the 54th SME North American Manufacturing Research Conference (NAMRC 54)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13007 2025-12-16 cs.CV 57%

Light Field Based 6DoF Tracking of Previously Unobserved Objects

基于光场的先前未观察到物体的6自由度跟踪

Nikolai Goncharov, James L. Gray, Donald G. Dansereau

机构 * University of Sydney(悉尼大学) Australian Centre For Robotics (ACFR)(澳大利亚机器人中心) School of Aerospace, Mechanical and Mechatronic Engineering(航空航天、机械与机电工程学院)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出了一种基于光场的物体跟踪方法,无需预训练模型,能有效处理复杂视觉行为,如反射,通过统一的物体表示提升跟踪性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12827 2025-12-16 cs.LG cs.CR cs.CV 57%

GradID: Adversarial Detection via Intrinsic Dimensionality of Gradients

GradID: 通过梯度的内在维度进行对抗检测

Mohammad Mahdi Razmjoo, Mohammad Mahdi Sharifian, Saeed Bagheri Shouraki

机构 * Sharif University of Technology(沙里夫技术大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 GradID通过分析梯度的内在维度,提出了一种高效检测对抗攻击的方法,在多个数据集和攻击类型上均表现出色。

Comments 16 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15562 2025-12-16 cs.RO 57%

Transformer-XL for Long Sequence Tasks in Robotic Learning from Demonstration

Transformer-XL在机器人学习从示范中的长序列任务应用

Gao Tianci

机构 * Bauman Moscow State Technical University(巴甫洛夫莫斯科国立技术大学)

专题命中 感知 :LiDAR(abstract);分类 cs.RO

AI总结 本文提出利用Transformer-XL处理机器人学习从示范中的长序列任务,通过多模态传感器输入提升任务成功率和计算效率。

Comments 11 pages,4 figures

Journal ref Tianci G. Transformer-xl for long sequence tasks in robotic learning from demonstrations[C]//International Conference on Intelligent Systems. Cham: Springer Nature Switzerland, 2024: 25-36

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01042 2025-12-16 cs.CV 57%

WCCNet: Wavelet-context Cooperative Network for Efficient Multispectral Pedestrian Detection

WCCNet:小波-上下文协作网络用于高效多光谱行人检测

Xingjian Wang, Li Chai, Jiming Chen, Zhiguo Shi

机构 * the College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院) the College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 WCCNet通过低计算成本的多光谱特征提取与跨模态融合,提升自动驾驶中的行人检测效率与精度。

Comments 35 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12058 2025-12-16 cs.RO 57%

A Stochastic Approach to Terrain Maps for Safe Lunar Landing

为安全月球着陆的地形图提供随机方法

Anja Sheppard, Chris Reale, Katherine A. Skinner

机构 * Draper Scholar University of Michigan(Draper学者 密歇根大学) The Charles Stark Draper Laboratory(查尔斯·斯塔克·德拉珀实验室) University of Michigan(密歇根大学)

专题命中 感知 :LiDAR(abstract);分类 cs.RO

AI总结 本文提出利用高斯过程生成随机高程图的方法,以更准确地建模月球地形不确定性,提升月球着陆的安全性。

Comments Accepted to IEEE Aerospace 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01011 2025-12-16 cond-mat.quant-gas physics.atom-ph quant-ph 50%

Microsecond-scale high-survival and number-resolved detection of ytterbium atom arrays

微秒级高存活率和数分辨的镱原子阵列检测

Alessandro Muzi Falconi, Riccardo Panza, Sara Sbernardori, Riccardo Forti, Ralf Klemt, Omar Abdel Karim, Matteo Marinelli, Francesco Scazza

专题命中 感知 :occupancy(abstract)

AI总结 本研究通过非主动冷却技术实现了微秒级高存活率和数分辨的镱原子阵列检测,为快速原子重用在镊子基处理器和钟中提供关键步骤。

Comments 8+10 pages, 4+6 figures; typos corrected

Journal ref Phys. Rev. Lett. 135, 203402 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 9 篇

2512.12799 2025-12-16 cs.CV 83%

DrivePI: Spatial-aware 4D MLLM for Unified Autonomous Driving Understanding, Perception, Prediction and Planning

DrivePI: 基于空间感知的4D MLLM用于统一自动驾驶理解、感知、预测与规划

Zhe Liu, Runhui Huang, Rui Yang, Siming Yan, Zining Wang, Lu Hou, Di Lin, Xiang Bai, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Yinwang Intelligent Technology Co. Ltd.(英维智能科技有限公司) Tianjin University(天津大学) Huazhong University of Science and Technology(华中科技大学)

专题命中 规划控制 :autonomous driving(title,abstract);occupancy(abstract);分类 cs.CV

AI总结 DrivePI是一种基于空间感知的4D MLLM,用于统一自动驾驶的理解、感知、预测和规划,通过端到端优化实现多任务并行,提升性能并减少碰撞率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13094 2025-12-16 cs.RO cs.AI 81%

Sequence of Expert: Boosting Imitation Planners for Autonomous Driving through Temporal Alternation

专家序列:通过时间交替提升自动驾驶的模仿规划器

Xiang Li, Gang Liu, Weitao Zhou, Hongyi Zhu, Zhong Cao

机构 * HighTech Lab, Tsinghua University(清华大学高科技实验室) School of Mobility, Tsinghua University(清华大学移动学院) University of Michigan(密歇根大学)

专题命中 规划控制 :autonomous driving(title,abstract);分类 cs.RO、cs.AI

AI总结 专家序列通过时间交替策略提升自动驾驶模仿规划器的闭环性能,显著改进了模型表现和训练效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12776 2025-12-16 eess.SY cs.RO cs.SY 79%

High Order Control Lyapunov Function - Control Barrier Function - Quadratic Programming Based Autonomous Driving Controller for Bicyclist Safety

高阶控制李雅普诺夫函数-控制屏障函数-基于二次规划的自动驾驶控制器用于自行车安全

Haochong Chen, Xincheng Cao, Levent Guvenc, Bilin Aksun-Guvenc

专题命中 规划控制 :autonomous driving(title,abstract);分类 cs.RO

AI总结 本文提出基于高阶控制李雅普诺夫函数和控制屏障函数的二次规划控制器,用于提升自动驾驶系统在复杂交通环境中的骑行者安全性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.21180 2025-12-16 cs.RO 79%

STITCHER: Real-Time Trajectory Planning with Motion Primitive Search

STITCHER:基于运动片段搜索的实时轨迹规划

Helene J. Levy, Brett T. Lopez

机构 * VECTR Laboratory, University of California, Los Angeles(UC洛杉矶大学VECTR实验室)

专题命中 规划控制 :trajectory planning(title,abstract);分类 cs.RO

AI总结 STITCHER通过实时拼接短轨迹段实现高效无碰撞轨迹规划,克服传统优化方法在计算时间和稳定性上的限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12021 2025-12-16 cs.RO cs.SY eess.SY 57%

Modified Hybrid A* Collision-Free Path-Planning for Automated Reverse Parking

改进的混合A*碰撞自由路径规划用于自动倒车

Xincheng Cao, Haochong Chen, Bilin Aksun-Guvenc, Levent Guvenc

专题命中 规划控制 :occupancy(abstract);分类 cs.RO

AI总结 本文提出改进的混合A*算法用于自动倒车,结合动态模型和碰撞避障功能,实现碰撞自由的可行路径规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11862 2025-12-16 cs.LG cs.AI 57%

Hierarchical Task Offloading and Trajectory Optimization in Low-Altitude Intelligent Networks Via Auction and Diffusion-based MARL

低空智能网络中的分层任务卸载与轨迹优化:通过拍卖和基于扩散的MARL

Jiahao You, Ziye Jia, Can Cui, Chao Dong, Qihui Wu, Zhu Han

专题命中 规划控制 :trajectory planning(abstract);分类 cs.AI

AI总结 本文提出了一种基于拍卖和扩散的MARL方法,用于低空智能网络中的分层任务卸载与轨迹优化,以提升能耗效率和任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12741 2025-12-16 physics.optics physics.soc-ph 50%

Intracavity-birefringence-enabled soliton states and wavelength control in the (C + L)-band fiber lasers

腔内双折射启 enabled 的孤子态及 C+L 波段光纤激光器的波长控制

Chuangkai Li, Feng Ye, Hong Jin, Xuanyi Liu, H. Y. Fu, Boris A. Malomed, Qian Li

专题命中 规划控制 :LiDAR(abstract)

AI总结 本研究提出了一种基于腔内双折射的光纤激光器,实现了 C+L 波段波长可控的多态孤子态,并展示了其在生物成像和 LiDAR 中的应用潜力。

Comments to be published in J. Lightwave Tech

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06109 2025-12-16 cs.CE 50%

Human Mobility Reimagined: Digital Twin Intelligence for Adaptive Campus Course Timetabling

人类移动重新构想:数字孪生智能用于适应性校园课程安排

Keshu Wu, Xinyue Ye, Suphanut Jamonnak, Xin Feng

专题命中 规划控制 :occupancy(abstract)

AI总结 本文提出基于数字孪生智能的适应性校园课程安排方法,通过整合推荐和反馈机制,优化移动效率与资源利用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13241 2025-12-16 cs.LG 50%

State Combinatorial Generalization In Decision Making With Conditional Diffusion Models

决策中的状态组合泛化与条件扩散模型

Xintong Duan, Yutong He, Fahim Tajwar, Wen-Tse Chen, Ruslan Salakhutdinov, Jeff Schneider

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划控制 :self-driving(abstract)

AI总结 本文提出利用条件扩散模型实现决策中的状态组合泛化,通过实验展示其在多环境中的优越性能。

Comments Accepted to Transactions on Machine Learning Research (TMLR), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 端到端驾驶 2 篇

2512.10947 2025-12-16 cs.CV 85%

Towards Efficient and Effective Multi-Camera Encoding for End-to-End Driving

迈向高效且有效的多摄像头编码以实现端到端驾驶

Jiawei Yang, Ziyu Chen, Yurong You, Yan Wang, Yiming Li, Yuxiao Chen, Boyi Li, Boris Ivanovic, Marco Pavone, Yue Wang

机构 * USC Physical Superintelligence (PSI) Lab(USC物理超智能实验室) Stanford University(斯坦福大学) NVIDIA Research(NVIDIA研究)

专题命中 端到端驾驶 :end-to-end driving(title);autonomous driving(abstract);BEV(abstract);occupancy(abstract)

AI总结 本文提出Flex,一种高效多摄像头编码方法,通过紧凑的场景令牌提升端到端驾驶性能,无需依赖3D先验。

Comments Project Page: https://jiawei-yang.github.io/Flex/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12751 2025-12-16 cs.CV 79%

GenieDrive: Towards Physics-Aware Driving World Model with 4D Occupancy Guided Video Generation

GenieDrive: 向具有物理意识的驾驶世界模型迈进:基于4D占用的视频生成

Zhenya Yang, Zhe Liu, Yuxiang Lu, Liping Hou, Chenxuan Miao, Siyi Peng, Bailan Feng, Xiang Bai, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Huazhong University of Science and Technology(华中科技大学)

专题命中 端到端驾驶 :occupancy(title,abstract);分类 cs.CV

AI总结 GenieDrive通过4D占用引导的视频生成,实现物理意识的驾驶视频生成,提升预测精度和视频质量。

Comments The project page is available at https://huster-yzy.github.io/geniedrive_project_page/

详情

展开后加载摘要…

URL PDF HTML 收藏

4. BEV与占用 6 篇

2512.12907 2025-12-16 cs.LG 82%

Machine Learning Architectures for the Estimation of Predicted Occupancy Grids in Road Traffic

用于道路交通中预测占用网格估计的机器学习架构

Parthasarathy Nadarajan, Michael Botsch, Sebastian Sardina

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract)

AI总结 本文提出了一种新颖的机器学习架构,用于高效估计道路交通中的预测占用网格,通过模拟验证其在准确性和计算时间上的性能。

Comments Journal of Advances in Information Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12896 2025-12-16 cs.LG 82%

Probability Estimation for Predicted-Occupancy Grids in Vehicle Safety Applications Based on Machine Learning

基于机器学习的车辆安全应用中预测占用网格的概率估计

Parthasarathy Nadarajan, Michael Botsch

机构 * Technische Hochschule Ingolstadt(图宾根工业大学)

专题命中 BEV与占用 :occupancy(title,abstract);trajectory planning(abstract)

AI总结 本文提出基于随机森林算法的机器学习方法,用于高效计算车辆安全应用中的预测占用网格,以提升关键性估计和轨迹规划能力。

Comments 2016 IEEE Intelligent Vehicles Symposium

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12901 2025-12-16 cs.LG 78%

Predicted-occupancy grids for vehicle safety applications based on autoencoders and the Random Forest algorithm

基于自编码器和随机森林算法的预测占用网格用于车辆安全应用

Parthasarathy Nadarajan, Michael Botsch, Sebastian Sardina

机构 * RMIT University(皇家墨尔本理工大学)

专题命中 BEV与占用 :occupancy(title,abstract)

AI总结 本文提出基于自编码器和随机森林算法的预测占用网格方法,用于复杂交通场景中的车辆安全应用,通过降维和分类提高预测准确性。

Comments 2017 International Joint Conference on Neural Networks (IJCNN)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13619 2025-12-16 math.NA cs.CE cs.NA 50%

Preconditioning Techniques for Hybridizable Discontinuous Galerkin Discretizations on GPU Architectures

针对GPU架构的混合不连续伽辽金离散化的预处理技术

Andrew Welter, Ngoc Cuong Nguyen

专题命中 BEV与占用 :occupancy(abstract)

AI总结 本文提出了一种适用于GPU的HDG离散化预处理技术,结合牛顿法与GMRES求解器,通过块雅可比等预处理器提升求解效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12573 2025-12-16 quant-ph 50%

Quantum Encoding of Three-Dimensional Ligand Poses for Exhaustive Configuration Enumeration

三维配体构象的量子编码用于穷举配置枚举

Pei-Kun Yang

专题命中 BEV与占用 :occupancy(abstract)

AI总结 本研究提出一种量子编码方法,用于在三维网格上高效枚举配体的全部空间构象,为量子加速的虚拟筛选提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18149 2025-12-16 quant-ph cond-mat.str-el hep-th 50%

Preparing the Gutzwiller wave function for attractive SU(3) fermions on a quantum computer

在量子计算机上为吸引性SU(3)费米子准备Gutzwiller波函数

Han Xu, Kazuhiro Seki, Seiji Yunoki

专题命中 BEV与占用 :occupancy(abstract)

AI总结 在量子计算机上利用量子-经典混合方案实现吸引性SU(3)费米子系统的Gutzwiller波函数,并通过实验验证其有效性。

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 激光雷达 5 篇

2512.12410 2025-12-16 cs.CV cs.AI 81%

A Graph Attention Network-Based Framework for Reconstructing Missing LiDAR Beams

基于图注意力网络的缺失激光雷达束重建框架

Khalfalla Awedat, Mohamed Abidalrekab, Mohammad El-Yabroudi

机构 * Computer Information Technology Department, SUNY Morrisville(SUNY Morrisville 计算机信息科技系) Electrical and Computer Engineering Department, Portland State University(波特兰州立大学电气与计算机工程系) Electrical and Computer Engineering Department, Lawrence Technological University(劳伦斯技术大学电气与计算机工程系)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.CV、cs.AI

AI总结 本文提出基于图注意力网络的框架,通过点云几何数据恢复旋转激光雷达中因硬件老化等导致的垂直束丢失,实现高精度重建与快速推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19004 2025-12-16 cs.CV 79%

A Self-Conditioned Representation Guided Diffusion Model for Realistic Text-to-LiDAR Scene Generation

一种用于真实文本到LiDAR场景生成的自条件表示引导扩散模型

Wentao Qu, Guofeng Mei, Yang Wu, Yongshun Gong, Xiaoshui Huang, Liang Xiao

机构 * NJUST(南京理工大学) FBK(弗拉·恩里科·拉达基金会) SDU(山东大学) SJTU(上海交通大学)

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.CV

AI总结 本文提出T2LDM模型,通过自条件表示引导技术提升文本到LiDAR场景生成的质量和可控性,构建了T2nuScenes基准并改进了生成效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11876 2025-12-16 cs.RO cs.SY eess.SY 57%

Traversability Aware Autonomous Navigation for Multi-Modal Mobility Morphobot (M4)

多模态移动形变机器人(M4)的可 traversability 自主导航

Hrigved Mahesh Suryawanshi

机构 * SiliconSynapse Lab(硅合成实验室)

专题命中 激光雷达 :LiDAR(abstract);分类 cs.RO

AI总结 本研究提出了一种基于LiDAR的多模态移动形变机器人M4的可 traversability 自主导航框架,通过学习地形分析生成节能路径,提升地形适应能力。

Comments Master's thesis

详情

展开后加载摘要…

URL PDF HTML 收藏