arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2025-12-19 至 2025-12-19 共收录 13 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 6 篇

2512.13107 2025-12-19 cs.CV cs.AI 79%

Diffusion-Based Restoration for Multi-Modal 3D Object Detection in Adverse Weather

基于扩散的多模态3D物体检测在恶劣天气中的修复

Zhijian He, Feifei Liu, Yuwei Li, Zhanpeng Luo, Jintao Cheng, Xieyuanli Chen, Xiaoyu Tang

机构 * School of Xingzhi College, South China Normal University(星智学院,华南师范大学) College of Big Data and Internet, Shenzhen Technology University(大数据与互联网学院,深圳科技大学) School of Data Science and Engineering, Xingzhi College, South China Normal University(数据科学与工程学院,星智学院,华南师范大学) Department of Electronic and Computer Engineering, Hong Kong University of Science and Technology(电子与计算机工程系,香港科技大学) College of Intelligence Science and Technology, National University of Defense Technology(智能科学与技术学院,国防科技大学)

专题命中 感知 :autonomous driving(abstract);BEV(abstract);LiDAR(abstract);分类 cs.CV、cs.AI

AI总结 DiffFusion通过基于扩散的修复和自适应跨模态融合,提升多模态3D物体检测在恶劣天气中的鲁棒性与清洁数据性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16123 2025-12-19 cs.CR cs.AI cs.CV 62%

Autoencoder-based Denoising Defense against Adversarial Attacks on Object Detection

基于自动编码器的对抗攻击防御方法用于目标检测

Min Geun Song, Gang Min Kim, Woonmin Kim, Yongsik Kim, Jeonghyun Sim, Sangbeom Park, Huy Kang Kim

机构 * School of Cybersecurity in Korea University(韩国大学网络安全学院)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 本文提出基于自动编码器的去噪方法,用于防御目标检测中的对抗攻击,实验表明该方法能有效恢复检测性能,无需模型重训练。

Comments 7 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16027 2025-12-19 cs.RO 57%

SWIFT-Nav: Stability-Aware Waypoint-Level TD3 with Fuzzy Arbitration for UAV Navigation in Cluttered Environments

SWIFT-Nav:具有模糊仲裁的稳定性感知 waypoint 级 TD3 用于 cluttered 环境中的 UAV 导航

Shuaidong Ji, Mahdi Bamdad, Francisco Cruz

机构 * School of Computer Science and Engineering, University of New South Wales(计算机科学与工程学院,新南威尔士大学) Escuela de Ingeniería, Universidad Central de Chile(工程学院,智利中央大学)

专题命中 感知 :LiDAR(abstract);分类 cs.RO

AI总结 SWIFT-Nav 通过结合 TD3、优先回放、校准探索和模糊安全规则,实现 UAV 在 cluttered 环境中的高效可靠导航。

Comments 10 pages, Accepted at Australasian Conference on Robotics and Automation (ACRA) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15971 2025-12-19 cs.CV 57%

From Words to Wavelengths: VLMs for Few-Shot Multispectral Object Detection

从词语到波长:用于少样本多光谱目标检测的视觉语言模型

Manuel Nkegoum, Minh-Tan Pham, Élisa Fromont, Bruno Avignon, Sébastien Lefèvre

机构 * Univ Bretagne Sud, IRISA, UMR 6074(布列塔尼大学,IRISA,UMR 6074) Univ Rennes, IRISA, UMR 6074(里尔大学,IRISA,UMR 6074) ATERMES UiT The Arctic University of Norway(北欧大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出利用视觉语言模型进行少样本多光谱目标检测,通过整合文本、视觉和热模态,在数据稀缺情况下实现高效检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14574 2025-12-19 cs.RO cs.ET 57%

Real-world Troublemaker: A 5G Cloud-controlled Track Testing Framework for Automated Driving Systems in Safety-critical Interaction Scenarios

现实中的麻烦制造者:一种5G云控制的测试框架用于自动驾驶系统的安全关键交互场景

Xinrui Zhang, Lu Xiong, Peizhi Zhang, Junpeng Huang, Yining Ma

专题命中 感知 :autonomous driving(abstract);分类 cs.RO

AI总结 本文提出一种基于5G云控制的测试框架,用于提升自动驾驶系统在安全关键交互场景中的测试精度和多样性。

Comments 13 pages,14 figures,2 tables

Journal ref IEEE Internet of Things Journal, vol. 12, no. 23, pp. 50617-50631, Dec. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21581 2025-12-19 cs.CV 57%

InScope: A New Real-world 3D Infrastructure-side Collaborative Perception Dataset for Open Traffic Scenarios

InScope:一种新的现实世界3D基础设施侧协作感知数据集用于开放交通场景

Xiaofei Zhang, Yining Li, Jinping Wang, Xiangyi Qin, Ying Shen, Zhengping Fan, Xiaojun Tan

机构 * School of Intelligent Systems Engineering, Sun Yat-sen University(智能系统工程学院,中山大学) Southern Marine Science and Engineering Guangdong Laboratory (Zhuhai)(广东海洋科学与工程实验室(珠海))

专题命中 感知 :LiDAR(abstract);分类 cs.CV

AI总结 InScope数据集通过部署多位置LiDAR系统,解决自动驾驶中的遮挡问题,提供开放交通场景下的协作感知基准测试和评估指标。

Journal ref Information Fusion, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 1 篇

2512.16069 2025-12-19 cs.RO 57%

A Task-Driven, Planner-in-the-Loop Computational Design Framework for Modular Manipulators

面向任务的、具有规划器的计算设计框架用于模块化机械臂

Maolin Lei, Edoardo Romiti, Arturo Laurenzi, Rui Dai, Matteo Dalle Vedove, Jiatao Ding, Daniele Fontanelli, Nikos Tsagarakis

机构 * Humanoids and Human Centered Mechatronics Research Line, Italian Institute of Technology (IIT) Genoa, Italy(意大利理工学院(IIT)热那亚人类与以人为中心的机电研究组) Department of Industrial Engineering, University of Trento, Trento, Italy(特伦托大学工业工程系)

专题命中 规划控制 :trajectory planning(abstract);分类 cs.RO

AI总结 本文提出了一种面向任务的模块化机械臂计算设计框架,通过整合轨迹规划与形态优化,实现高效灵活的机械臂设计。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 端到端驾驶 2 篇

2510.12796 2025-12-19 cs.CV cs.AI 81%

DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving

DriveVLA-W0:世界模型放大数据扩展定律在自动驾驶中的应用

Yingyan Li, Shuyao Shang, Weisong Liu, Bing Zhan, Haochen Wang, Yuqi Wang, Yuntao Chen, Xiaoman Wang, Yasong An, Chufeng Tang, Lu Hou, Lue Fan, Zhaoxiang Zhang

机构 * NLPR, Institute of Automation, Chinese Academy of Sciences (CASIA)(国家工程实验室、自动化研究所、中国科学院(CASIA)) Yinwang Intelligent Technology Co. Ltd.(云网智能科技有限公司)

专题命中 端到端驾驶 :autonomous driving(title);BEV(abstract);分类 cs.CV、cs.AI

AI总结 DriveVLA-W0通过世界建模预测未来图像,提升自动驾驶中数据扩展定律,实现更高效的驾驶智能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16178 2025-12-19 cs.CV cs.AI cs.RO 67%

Towards Closing the Domain Gap with Event Cameras

通过事件相机缩小领域差距

M. Oltan Sevinc, Liao Wu, Francisco Cruz

机构 * School of Computer Science and Engineering, University of New South Wales(新南威尔士大学计算机科学与工程学院) School of Mechanical and Manufacturing Engineering, University of New South Wales(新南威尔士大学机械与制造工程学院) Escuela de Ingeniería, Universidad Central de Chile(智利中央大学工程学院)

专题命中 端到端驾驶 :end-to-end driving(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 本文提出使用事件相机以解决昼夜光照差异带来的领域差距问题,展示其在不同光照条件下更稳定的性能和更优的跨领域表现。

Comments Accepted to Australasian Conference on Robotics and Automation (ACRA), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

4. BEV与占用 3 篇

2512.16818 2025-12-19 cs.CV 79%

DenseBEV: Transforming BEV Grid Cells into 3D Objects

DenseBEV:将BEV网格单元转换为3D对象

Marius Dähling, Sebastian Krebs, J. Marius Zöllner

机构 * NMS Non-Maximum Suppression IoU Intersection-over-Union FoV Field of View mAP mean Average Precision NDS nuScenes detection score ATE Average Translation Error ASE Average Scale Error AOE Average Orientation Error AVE Average Velocity Error AAE Average Attribute Error LET Longitudinal Error Tolerant APL Average Precision Longitudinal APH Average Precision Heading LSS Lift, Splat, Shoot BEV Bird’s-Eye-View DenseBEV: Transforming BEV Grid Cells into 3D Objects(NMS非最大抑制IoU交并比FoV视野mAP均值平均精度NDSnuScenes检测得分ATE平均平移误差ASE平均尺度误差AOE平均方位误差AVE平均速度误差AAE平均属性误差LET纵向误差容忍APL纵向平均精度APH平均方位精度LSS抬升、投射、射击BEV鸟视图DenseBEV:将BEV网格单元转换为3D对象)

专题命中 BEV与占用 :BEV(title,abstract);分类 cs.CV

AI总结 DenseBEV通过直接使用BEV特征单元作为锚点,提出了一种高效且直观的多摄像头3D目标检测方法,提升了小目标检测性能。

Comments 15 pages, 8 figures, accepted by WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26170 2025-12-19 cs.RO cs.CV 62%

Self-localization on a 3D map by fusing global and local features from a monocular camera

通过融合单目相机的全局和局部特征实现3D地图上的自定位

Satoshi Kikuchi, Masaya Kato, Tsuyoshi Tasaki

机构 * Meijo University(名古屋大学)

专题命中 BEV与占用 :autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 本研究提出结合CNN与视觉Transformer的方法,提升单目相机在动态障碍物环境下的3D地图自定位精度。

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23851 2025-12-19 cond-mat.str-el 50%

Revealing quantum phase string effect in doped Mott-insulator: a tensor network state approach

揭示掺杂莫特绝缘体中的量子相位字符串效应:一种张量网络态方法

Wayne Zheng, Jia-Xin Zhang, Zheng-Yuan Yue, Zheng-Cheng Gu, Zheng-Yu Weng

专题命中 BEV与占用 :occupancy(abstract)

AI总结 本文通过张量网络态方法揭示掺杂莫特绝缘体中量子相位字符串效应,发现其对自旋序和电荷压缩性有显著影响。

Comments 12 pages, 11 figures

Journal ref Phys. Rev. B 112, 214514 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 仿真评测 1 篇

2512.01194 2025-12-19 cs.RO 70%

RoboLoc: A Benchmark Dataset for Point Place Recognition and Localization in Indoor-Outdoor Integrated Environments

RoboLoc:用于室内-室外集成环境中的点位识别和定位的基准数据集

Jaejin Jeon, Seonghoon Ryoo, Sang-Duck Lee, Soomok Lee, Seungwoo Jeong

机构 * Department of Data, Network and AI, Ajou University(数据、网络与人工智能系,亚运会大学) Korea Railroad Research Institute(韩国铁路研究院) Department of Mobility Engineering, Ajou University(移动工程系,亚运会大学)

专题命中 仿真评测 :BEV(abstract);LiDAR(abstract);分类 cs.RO

AI总结 RoboLoc是一个用于室内外集成环境的点位识别和定位基准数据集,通过真实机器人轨迹和多领域转换,评估多种先进模型的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏