arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-02-03 至 2026-02-03 共收录 13 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 13 篇

2602.02167 2026-02-03 eess.SP cs.CV cs.LG cs.RO 84%

Real-Time 2D LiDAR Object Detection Using Three-Frame RGB Scan Encoding

基于三帧RGB扫描编码的实时2D激光雷达目标检测

Soheil Behnam Roudsari, Alexandre S. Brandão, Felipe N. Martins

机构 * Smart Systems Group, Institute of Engineering Hanze University of Applied Sciences, Groningen, The Netherlands

专题命中 感知 :LiDAR(title,abstract);occupancy(abstract);分类 cs.RO、cs.CV

AI总结 本研究提出一种基于三帧RGB扫描编码的实时2D激光雷达目标检测方法,实现高效且隐私友好的嵌入式室内机器人感知。

Comments 6 pages, 6 figures, submitted to IEEE SAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06781 2026-02-03 cs.CV 79%

UrbanTwin: Synthetic Roadside LiDAR Datasets

UrbanTwin:合成道路激光雷达数据集

Muhammad Shahbaz, Shaurya Agarwal

机构 * University of Central Florida(中央佛罗里达大学)

专题命中 感知 :LiDAR(title,abstract);分类 cs.CV

AI总结 UrbanTwin数据集通过数字孪生技术生成,提供高保真合成道路激光雷达数据,用于提升3D目标检测等任务的模型训练效果。

Comments Published journal article; 12 pages; includes figures and tables

Journal ref in IEEE Open Journal of Intelligent Transportation Systems, vol. 7, pp. 353-364, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13703 2026-02-03 physics.optics 78%

Multi-mode Coherent Detection Ghost Imaging Lidar and Vibration-Mode Imaging

多模式相干检测鬼成像雷达与振动模式成像

Jinquan Qi, Shuang Liu, Chenjin Deng, Chaoran Wang, Zunwang Bo, Youzhen Gui, Shensheng Han

专题命中 感知 :LiDAR(title,abstract)

AI总结 本文提出了一种基于桶探测器的多模式相干检测方案,用于实现多模式光场的相干混合与振动模式重建,提升雷达的抗干扰和相位分辨能力。

Comments 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16833 2026-02-03 cs.LG physics.data-an 78%

Exploring the Limitations of kNN Noisy Feature Detection and Recovery for Self-Driving Labs

探索kNN噪声特征检测与恢复在自动驾驶实验室中的局限性

Qiuyu Shi, Kangming Li, Yao Fehlis, Runze Zhang, Daniel Persaud, Robert Black, Jason Hattrick-Simpers

专题命中 感知 :self-driving(title,abstract)

AI总结 本研究探讨了kNN噪声特征检测与恢复在自动驾驶实验室中的局限性,通过系统分析噪声强度、数据集大小等因素对特征可检测性和可恢复性的影响,提出了一种通用的数据恢复框架并建立了材料数据集的基准。

Comments 20 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01594 2026-02-03 cs.CV 74%

UV-M3TL: A Unified and Versatile Multimodal Multi-Task Learning Framework for Assistive Driving Perception

UV-M3TL: 一种统一且多功能的多模态多任务学习框架用于辅助驾驶感知

Wenzhuo Liu, Qiannan Guo, Zhen Wang, Wenshuo Wang, Lei Yang, Yicheng Qiao, Lening Wang, Zhiwei Li, Chen Lv, Shanghang Zhang, Junqiang Xi, Huaping Liu

机构 * Energy and Transportation Domain, Beijing Institute of Technology(能源与交通领域,北京理工大学) State Key Laboratory of Intelligent Technology and Systems and Department of Computer Science and Technology, Tsinghua University(智能技术与系统国家重点实验室和清华大学计算机科学与技术系) School of Mechanical and Aerospace Engineering, Nanyang Technological University(机械与航空航天工程学院,南洋理工大学) School of Transportation Science and Engineering and the State Key Lab of Intelligent Transportation System, Beihang University(交通运输科学与工程学院和智能交通系统国家重点实验室,北京航空航天大学) Beijing University of Chemical Technology(北京化工大学)

专题命中 感知 :driving perception(title);分类 cs.CV

AI总结 UV-M3TL通过双分支结构和自适应损失机制,实现多模态多任务学习,提升辅助驾驶感知的性能与多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05299 2026-02-03 eess.SY cs.AR cs.CV cs.ET cs.RO cs.SY eess.IV 67%

ARCAS: An Augmented Reality Collision Avoidance System with SLAM-Based Tracking for Enhancing VRU Safety

ARCAS:一种基于SLAM跟踪的增强现实避障系统,用于提升VRU安全

Ahmad Yehia, Jiseop Byeon, Tianyi Wang, Huihai Wang, Yiming Xu, Junfeng Jiao, Christian Claudel

机构 * Department of Civil, Architectural, and Environmental Engineering, The University of Texas at Austin(德克萨斯大学奥斯汀分校土木、建筑与环境工程系) School of Architecture, The University of Texas at Austin(德克萨斯大学奥斯汀分校建筑学院)

专题命中 感知 :LiDAR(abstract);分类 cs.RO、cs.CV、eess.IV

AI总结 ARCAS通过融合激光雷达与SLAM跟踪,为行人提供实时AR避障,显著提升城市出行安全。

Comments 8 pages, 3 figures, 1 table, accepted for IEEE Intelligent Vehicles (IV) Symposium 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12638 2026-02-03 cs.CV cs.AI 62%

Mixed Precision PointPillars for Efficient 3D Object Detection with TensorRT

混合精度PointPillars用于基于TensorRT的高效3D目标检测

Ninnart Fuengfusin, Keisuke Yoneda, Naoki Suganuma

机构 * Advanced Mobility Research Institute(先进移动研究院) Kanazawa University(金泽大学)

专题命中 感知 :LiDAR(abstract);分类 cs.CV、cs.AI

AI总结 本文提出混合精度PointPillars框架,结合TensorRT实现高效3D目标检测,通过量化感知训练和贪心搜索优化模型性能,降低延迟达2.538倍。

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22861 2026-02-03 cs.CV cs.CY cs.ET cs.GR 57%

Under-Canopy Terrain Reconstruction in Dense Forests Using RGB Imaging and Neural 3D Reconstruction

利用RGB成像和神经3D重建进行密林下的地形重建

Refael Sheffer, Chen Pinchover, Haim Zisman, Dror Ozeri, Roee Litman

机构 * Rafael Advanced Defense Systems inc., Israel(拉斐尔先进防御系统公司,以色列) Bar-Ilan University, Israel(巴伊兰大学,以色列)

专题命中 感知 :LiDAR(abstract);分类 cs.CV

AI总结 利用RGB图像和神经3D重建技术,实现密林下的地形重建,提供一种低成本、高精度的替代方案。

Comments WACV 2026 CV4EO

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01277 2026-02-03 cs.CV 57%

TF-Lane: Traffic Flow Module for Robust Lane Perception

TF-Lane:用于鲁棒车道感知的交通流模块

Yihan Xie, Han Xia, Zhen Yang

机构 * BYD Company Limited(比亚迪公司)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 TF-Lane通过引入交通流信息提升车道感知鲁棒性,实现在NuScenes数据集上mAP提升达4.1%

Comments 9 pages, 7 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00687 2026-02-03 cs.CV 57%

V2X-DSC: Multi-Agent Collaborative Perception with Distributed Source Coding Guided Communication

V2X-DSC: 基于分布式源编码引导通信的多智能体协同感知

Yuankun Zeng, Shaohui Li, Zhi Li, Shulan Ruan, Yu Liu, You He

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)

专题命中 感知 :BEV(abstract);分类 cs.CV

AI总结 V2X-DSC通过分布式源编码引导通信,实现多智能体协同感知的高效带宽受限融合,提升3D理解精度与通信效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15039 2026-02-03 cs.RO 57%

CADGrasp: Learning Contact and Collision Aware General Dexterous Grasping in Cluttered Scenes

CADGrasp: 学习接触和碰撞感知的通用灵巧抓取在杂乱场景中

Jiyao Zhang, Zhiyuan Ma, Tianhao Wu, Zeyuan Chen, Hao Dong

机构 * Center on Frontiers of Computing Studies, School of Computer Science, Peking University(前沿计算研究中心,计算机学院,北京大学) National Key Laboratory for Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家级重点实验室,计算机学院,北京大学)

专题命中 感知 :occupancy(abstract);分类 cs.RO

AI总结 CADGrasp通过两阶段算法实现接触和碰撞感知的灵巧抓取,利用点云输入预测稀疏IBS表示,并结合占用扩散模型和能量函数优化,提升在杂乱场景中的抓取成功率与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00385 2026-02-03 cs.CV 57%

Deep Learning-Based Object Detection for Autonomous Vehicles: A Comparative Study of One-Stage and Two-Stage Detectors on Basic Traffic Objects

基于深度学习的对象检测在自动驾驶中的应用:对一阶段和两阶段检测器在基本交通物体上的比较研究

Bsher Karbouj, Adam Michael Altenbuchner, Joerg Krueger

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文比较了YOLOv5和Faster R-CNN在自动驾驶中的对象检测性能,发现YOLOv5在精度和效率上表现更优,而Faster R-CNN在检测小距离和复杂光照条件下的物体更有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00958 2026-02-03 physics.optics 50%

Metrology-grade mid-infrared spectroscopy for multi-dimensional perception

用于多维感知的计量级中红外光谱学

Baoqi Shi, Chenxi Zhang, Ming-Yang Zheng, Yue Hu, Zeying Zhong, Zhenyuan Shang, Wenbo Ma, Xiu-Ping Xie, Xue Bai, Yi-Han Luo, Anting Wang, Hairun Guo, Qiang Zhang, Junqiu Liu

专题命中 感知 :LiDAR(abstract)

AI总结 本研究提出了一种基于差频生成的计量级中红外光谱系统,实现了宽波段、高光子通量和高频率精度的结合,有效降低了硅氮化物微谐振器的光学损耗,并展示了在复杂环境中的多维感知能力。

详情

展开后加载摘要…

URL PDF HTML 收藏