arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2025-11-24 至 2025-11-24 共收录 14 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 4 篇

2503.09878 2025-11-24 cs.CV cs.AI cs.RO 80%

CleverDistiller: Simple and Spatially Consistent Cross-modal Distillation

CleverDistiller: 简单且空间一致的跨模态知识蒸馏

Hariprasath Govindarajan, Maciej K. Wozniak, Marvin Klingner, Camille Maurice, B Ravi Kiran, Senthil Yogamani

专题命中 感知 :autonomous driving(abstract);LiDAR(abstract);occupancy(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 CleverDistiller通过简单有效的跨模态知识蒸馏方法,在自动驾驶任务中实现语义分割和3D目标检测的高性能表现。

Comments Accepted to BMVC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17455 2025-11-24 cs.CV 57%

Improving Multimodal Distillation for 3D Semantic Segmentation under Domain Shift

改进多模态蒸馏以应对激光雷达语义分割中的域移位

Björn Michele, Alexandre Boulch, Gilles Puy, Tuan-Hung Vu, Renaud Marlet, Nicolas Courty

机构 * CNRS, IRISA, Univ. Bretagne Sud(CNRS、IRISA、布列塔尼大学) LIGM, Ecole des Ponts, Univ Gustave Eiffel, CNRS(LIGM、巴黎理工学院、古斯塔夫·埃菲尔大学、CNRS)

专题命中 感知 :LiDAR(abstract);分类 cs.CV

AI总结 本研究提出改进多模态蒸馏方法,通过冻结预训练主干网络并训练MLP头,提升激光雷达语义分割在域移位下的性能。

Comments Accepted at BMVC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17094 2025-11-24 cs.CV 57%

Sparse Reasoning is Enough: Biological-Inspired Framework for Video Anomaly Detection with Large Pre-trained Models

稀疏推理已足够:基于生物启发的视频异常检测大预训练模型框架

He Huang, Zixuan Hu, Dongxiao Li, Yao Xiao, Ling-Yu Duan

机构 * School of Computer Science Peking University(北京大学计算机科学学院)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 ReCoVAD通过生物启发的双通路框架实现视频异常检测,利用稀疏推理降低计算成本,取得最佳无训练性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16998 2025-11-24 cs.CV 57%

VLM-Augmented Degradation Modeling for Image Restoration Under Adverse Weather Conditions

增强型退化建模用于恶劣天气下的图像修复

Qianyi Shao, Yuanfan Zhang, Renxiang Xiao, Liang Hu

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出了一种结合视觉-语言模型和隐式记忆库的统一模型,用于在恶劣天气下高效恢复图像,提升了修复精度和计算效率。

Journal ref Proc. 2025 30th International Conference on Automation and Computing (ICAC), pp. 1-6, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 5 篇

2511.17150 2025-11-24 cs.CV 86%

DiffRefiner: Coarse to Fine Trajectory Planning via Diffusion Refinement with Semantic Interaction for End to End Autonomous Driving

DiffRefiner: 通过扩散细化与语义交互实现从粗到细的轨迹规划用于端到端自动驾驶

Liuhan Yin, Runkun Ju, Guodong Guo, Erkang Cheng

机构 * Nullmax

专题命中 规划控制 :autonomous driving(title,abstract);trajectory planning(title);分类 cs.CV

AI总结 DiffRefiner通过两阶段框架结合扩散细化与语义交互,实现更精确的端到端自动驾驶轨迹规划,取得新纪录。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17496 2025-11-24 cs.RO cs.MA 57%

MDG: Masked Denoising Generation for Multi-Agent Behavior Modeling in Traffic Environments

MDG:面向交通环境多智能体行为建模的遮蔽去噪生成

Zhiyu Huang, Zewei Zhou, Tianhui Cai, Yun Zhang, Jiaqi Ma

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 规划控制 :autonomous driving(abstract);分类 cs.RO

AI总结 MDG通过遮蔽去噪生成方法,实现高效可控的多智能体轨迹生成,适用于自动驾驶和交通模拟中的行为建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17401 2025-11-24 cs.RO cs.HC 57%

Feasibility of Embodied Dynamics Based Bayesian Learning for Continuous Pursuit Motion Control of Assistive Mobile Robots in the Built Environment

基于具身动力学的贝叶斯学习在辅助移动机器人连续追击运动控制中的可行性

Xiaoshan Zhou, Carol C. Menassa, Vineet R. Kamat

专题命中 规划控制 :autonomous driving(abstract);分类 cs.RO

AI总结 本文提出基于具身动力学的贝叶斯学习方法,有效提升辅助移动机器人在复杂环境中的连续追击运动控制性能。

Comments 37 pages, 9 figures, and 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06182 2025-11-24 cs.RO 57%

OpenVLN: Open-world Aerial Vision-Language Navigation

OpenVLN: 开放世界空中视觉语言导航

Peican Lin, Gan Sun, Chenxi Liu, Fazeng Li, Weihong Ren, Yang Cong

机构 * School of Automation Science and Engineering, South China University of Technology(华南理工大学自动化科学与工程学院) State Key Laboratory of Robotics, Shenyang Institute of Automation, Chinese Academy of Sciences(中国科学院沈阳自动化研究所机器人重点实验室) State Key Laboratory of Robotics and System, School of Mechanical Engineering and Automation, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)机械工程与自动化学院机器人与系统重点实验室)

专题命中 规划控制 :trajectory planning(abstract);分类 cs.RO

AI总结 OpenVLN通过强化学习和长视距规划器提升无人机在复杂空中环境中的长视距导航能力。

Comments Content: 8 pages 4 figures, conference paper under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14085 2025-11-24 cond-mat.str-el 50%

Pressure-Induced B1 to B2 Phase Transition in CeN Studied by ab initio Correlation Matrix Renormalization Theory Calculations

CeN压力诱导B1到B2相变的ab initio相关矩阵重整化理论研究

Jun Liu, Jianhua Zhang, Yongxin Yao, Kai-Ming Ho, Cai-Zhuang Wang

专题命中 规划控制 :occupancy(abstract)

AI总结 通过ab initio相关矩阵重整化理论研究压力诱导CeN从B1到B2相变,揭示了4f电子局域到它inerant行为的转变及实验一致的相变特征。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 端到端驾驶 1 篇

2503.23463 2025-11-24 cs.CV 83%

OpenDriveVLA: Towards End-to-end Autonomous Driving with Large Vision Language Action Model

OpenDriveVLA: 向端到端自动驾驶迈进的大型视觉语言动作模型

Xingcheng Zhou, Xuyuan Han, Feng Yang, Yunpu Ma, Volker Tresp, Alois Knoll

机构 * Technical University of Munich(慕尼黑技术大学) Ludwig Maximilian University of Munich(慕尼黑路德维希-马克西米利安大学)

专题命中 端到端驾驶 :autonomous driving(title,abstract);trajectory planning(abstract);分类 cs.CV

AI总结 OpenDriveVLA基于开源大语言模型,通过多模态输入和分层视觉语言对齐,实现端到端自动驾驶中的高精度轨迹规划和驾驶任务回答。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. BEV与占用 2 篇

2511.16949 2025-11-24 cs.RO cs.CV 86%

MobileOcc: A Human-Aware Semantic Occupancy Dataset for Mobile Robots

MobileOcc: 一种面向移动机器人的人感知语义占用数据集

Junseo Kim, Guido Dumont, Xinyu Gao, Gang Chen, Holger Caesar, Javier Alonso-Mora

机构 * Delft University of Technology(代尔夫特理工大学)

专题命中 BEV与占用 :occupancy(title,abstract);autonomous driving(abstract);LiDAR(abstract);分类 cs.RO、cs.CV

AI总结 MobileOcc提出了一种面向移动机器人的人感知语义占用数据集,通过结合静态物体注释和新型网格优化框架,实现了对变形人体几何的重建与优化,并用于建立占用预测和行人速度预测的基准测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17210 2025-11-24 cs.CV 79%

FisheyeGaussianLift: BEV Feature Lifting for Surround-View Fisheye Camera Perception

鱼眼高斯提升:用于周围视鱼眼相机感知的BEV特征提升

Shubham Sonarghare, Prasad Deshpande, Ciaran Hogan, Deepika-Rani Kaliappan-Mahalingam, Ganesh Sistu

专题命中 BEV与占用 :BEV(title,abstract);分类 cs.CV

AI总结 本文提出一种失真感知的BEV分割框架,通过高斯参数化和可微溅射融合,实现鱼眼影像的高精度语义分割,无需失真校正。

Comments 8 pages, 3 figures, published in IMVIP 2025 conference

Journal ref Proceedings of the Irish Machine Vision and Image Processing Conference 2025 1 to 3 September 2025 Ulster University Derry Londonderry pages 50 to 57 ISBN 97800993420795

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 激光雷达 1 篇

2511.17269 2025-11-24 cs.CV cs.AI 84%

Range-Edit: Semantic Mask Guided Outdoor LiDAR Scene Editing

Range-Edit: 基于语义掩码的户外激光雷达场景编辑

Suchetan G. Uppur, Hemant Kumar, Vaibhav Kumar

机构 * GeoAI4Cities Lab(GeoAI4Cities实验室) IISER Bhopal(印度比哈尔理工学院)

专题命中 激光雷达 :LiDAR(title,abstract);autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 Range-Edit通过语义掩码指导生成高质量的激光雷达点云,提升自动驾驶系统的鲁棒性与泛化能力。

Comments 8 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 仿真评测 1 篇

2505.01094 2025-11-24 cs.LG cs.AI 57%

Multi-Objective Reinforcement Learning for Water Management

多目标强化学习在水资源管理中的应用

Zuzanna Osika, Roxana Rădulescu, Jazmin Zatarain Salazar, Frans Oliehoek, Pradeep K. Murukannaiah

机构 * Delft University of Technology(代尔夫特理工大学) Utrecht University(乌特勒支大学)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.AI

AI总结 本文提出利用多目标强化学习解决尼罗河流域水资源管理问题,发现专门方法在实际应用中优于现有MORL算法,揭示了其在现实场景中的可扩展性问题。

Comments Accepted to AAMAS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏