arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2025-12-03 至 2025-12-03 共收录 4 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 4 篇

2512.02972 2025-12-03 cs.CV cs.RO 84%

BEVDilation: LiDAR-Centric Multi-Modal Fusion for 3D Object Detection

BEVDilation:以LiDAR为中心的多模态融合用于3D目标检测

Guowen Zhang, Chenhang He, Liyi Chen, Lei Zhang

专题命中 感知 :LiDAR(title,abstract);BEV(abstract);分类 cs.RO、cs.CV

AI总结 BEVDilation提出以LiDAR为中心的多模态融合方法,通过稀疏体素扩张和语义引导BEV扩张模块提升3D目标检测性能,有效缓解深度误差带来的空间错位问题。

Comments Accept by AAAI26

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04096 2025-12-03 cs.RO cs.CV 62%

Image-Based Relocalization and Alignment for Long-Term Monitoring of Dynamic Underwater Environments

基于图像的重定位与对齐用于动态水下环境的长期监测

Beverley Gorry, Tobias Fischer, Michael Milford, Alejandro Fontan

机构 * Queensland University of Technology(昆士兰理工大学)

专题命中 感知 :BEV(abstract);分类 cs.RO、cs.CV

AI总结 本文提出了一种结合VPR、特征匹配和图像分割的方法,用于水下环境的长期监测,并引入了首个大规模水下VPR基准测试。

Journal ref Proceedings of the 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), Hangzhou, China, pp. 10749-10756, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07958 2025-12-03 cs.CV 57%

Detect Anything 3D in the Wild

在野外检测任意3D对象

Hanxue Zhang, Haoran Jiang, Qingsong Yao, Yanan Sun, Renrui Zhang, Hao Zhao, Hongyang Li, Hongzi Zhu, Zetong Yang

机构 * OpenDriveLab at Shanghai AI Laboratory(上海人工智能实验室开放驾驶实验室) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) Stanford University(斯坦福大学) CUHK MMLab(香港大学多模态实验室) Tsinghua University(清华大学) GAC R&D Center(广汽研发中心)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 DetAny3D通过结合2D基础模型知识和3D解释器,实现了在任意相机配置下检测任意新物体的3D检测基础模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02346 2025-12-03 cs.AR 50%

Near-Memory Architecture for Threshold-Ordinal Surface-Based Corner Detection of Event Cameras

近内存架构用于事件相机的阈值序表面基于的角点检测

Hongyang Shang, An Guo, Shuai Dong, Junyi Yang, Ye Ke, Arindam Basu

专题命中 感知 :autonomous driving(abstract)

AI总结 提出一种近内存架构用于高效实现事件相机的阈值序表面角点检测,显著降低延迟和能耗,验证其在低电压下的稳定性和有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏