arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2025-12-04 至 2025-12-04 共收录 5 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 5 篇

2501.04005 2025-12-04 cs.CV cs.LG cs.RO 84%

LargeAD: Large-Scale Cross-Sensor Data Pretraining for Autonomous Driving

LargeAD: 大规模跨传感器数据预训练用于自动驾驶

Lingdong Kong, Xiang Xu, Youquan Liu, Jun Cen, Runnan Chen, Wenwei Zhang, Liang Pan, Kai Chen, Ziwei Liu

机构 * WorldBench Team(WorldBench团队)

专题命中 感知 :autonomous driving(title,abstract);LiDAR(abstract);分类 cs.RO、cs.CV

AI总结 LargeAD通过跨传感器数据预训练提升自动驾驶中的三维场景理解,结合多模态对比学习和时间一致性,实现更鲁棒的感知性能。

Comments IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04039 2025-12-04 cs.CV cs.AI cs.LG 62%

Fast & Efficient Normalizing Flows and Applications of Image Generative Models

高效且快速的归一化流及图像生成模型的应用

Sandeep Nagar

机构 * International Institute of Information Technology (Deemed to be University)(国际信息技术学院(认定为大学)) IIIT Hyderabad(IIIT海得拉尔)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 本研究提出高效归一化流及图像生成模型的应用,包括超分辨率、农业质量评估、地质制图、隐私保护及艺术修复等

Comments PhD Thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03684 2025-12-04 cs.RO 57%

A Novel Approach to Tomato Harvesting Using a Hybrid Gripper with Semantic Segmentation and Keypoint Detection

一种基于语义分割和关键点检测的新型番茄采摘方法

Shahid Ansari, Mahendra Kumar Gohil, Yusuke Maeda, Bishakh Bhattacharya

机构 * TSTS

专题命中 感知 :trajectory planning(abstract);分类 cs.RO

AI总结 本文提出了一种结合语义分割和关键点检测的新型番茄采摘系统,通过混合机械手和智能控制实现高效、安全的采摘

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11323 2025-12-04 cs.CV 57%

Delving into Dynamic Scene Cue-Consistency for Robust 3D Multi-Object Tracking

深入研究动态场景提示一致性以实现稳健的3D多目标跟踪

Haonan Zhang, Xinyao Wang, Boxi Wu, Tu Zheng, Wang Yunhua, Zheng Yang

机构 * Fabu

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出DSC-Track方法,通过动态场景提示一致性提升3D多目标跟踪的鲁棒性,实验表明其在nuScenes基准上达到SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07768 2025-12-04 cs.CV 57%

Test-time Correction: An Online 3D Detection System via Visual Prompting

测试时校正:通过视觉提示的在线3D检测系统

Hanxue Zhang, Zetong Yang, Yanan Sun, Li Chen, Fei Xia, Fatma Güney, Hongyang Li

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Lab(上海人工智能实验室) GAC R&D Center(GAC研发中心) The University of Hong Kong(香港大学) Google(谷歌) Koç University(科克大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出一种通过视觉提示实现在线3D检测的测试时校正系统,旨在提升自动驾驶系统在部署后的实时纠错能力。

详情

展开后加载摘要…

URL PDF HTML 收藏