arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2025-12-12 至 2025-12-12 共收录 14 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 5 篇

2505.03539 2025-12-12 cs.CV cs.RO eess.IV 67%

Panoramic Out-of-Distribution Segmentation

全景异常检测分割

Mengfei Duan, Yuheng Zhang, Yihong Cao, Fei Teng, Kai Luo, Jiaming Zhang, Kailun Yang, Zhiyong Li

机构 * School of Artificial Intelligence and Robotics and the National Engineering Research Center of Robot Visual Perception and Control Technology, Hunan University(人工智能与机器人学院和机器人视觉感知与控制技术国家工程研究中心,湖南大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.RO、cs.CV、eess.IV

AI总结 本文提出全景异常检测分割任务及POS方法,通过文本引导的提示分布学习提升全景图像的异常检测与分割性能。

Comments Code and datasets will be available at https://github.com/MengfeiD/PanOoS

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10213 2025-12-12 eess.IV cs.RO 62%

Active Optics for Hyperspectral Imaging of Reflective Agricultural Leaf Sensors

主动光学用于反射农业叶片传感器的高光谱成像

Dexter Burns, Sanjeev Koppal

机构 * University of Florida Department of Electrical

专题命中 感知 :LiDAR(abstract);分类 cs.RO、eess.IV

AI总结 本文提出了一种低成本主动光学系统,用于高效定位和采样农业叶片传感器,实现高光谱成像和实时植物健康监测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10934 2025-12-12 cs.RO cs.LG 57%

Curriculum-Based Reinforcement Learning for Autonomous UAV Navigation in Unknown Curved Tubular Conduit

基于课程的学习强化学习用于自主无人机在未知弯曲管状通道中的导航

Zamirddine Mari, Jérôme Pasquet, Julien Seinturier

机构 * DGA Techniques Navales - Direction Générale de l’Armement(法国国防总局海军技术部) LIRMM, TETIS, CNRS, Université de Montpellier Paul-Valéry(蒙彼利埃大学保罗-瓦莱里耶大学) LIS, CNRS, Université de Toulon(土伦大学)

专题命中 感知 :LiDAR(abstract);分类 cs.RO

AI总结 本文提出基于课程学习的强化学习方法,使无人机在未知弯曲管状环境中实现自主导航,通过结合激光雷达和视觉信息,克服部分可观测性挑战,提升导航稳定性与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10305 2025-12-12 cs.AI 57%

InfoCom: Kilobyte-Scale Communication-Efficient Collaborative Perception with Information Bottleneck

InfoCom: 千字级通信高效协作感知与信息瓶颈

Quanmin Wei, Penglin Dai, Wei Li, Bingyi Liu, Xiao Wu

专题命中 感知 :autonomous driving(abstract);分类 cs.AI

AI总结 InfoCom通过信息瓶颈原理实现通信高效协作感知,显著降低通信开销,提升自动驾驶环境感知精度。

Comments Accepted by the 40th AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09881 2025-12-12 cs.CV 57%

Leveraging Depth and Language for Open-Vocabulary Domain-Generalized Semantic Segmentation

利用深度和语言实现开放词汇域通用语义分割

Siyu Chen, Ting Han, Chengzheng Fu, Changshe Zhang, Chaolei Wang, Jinhe Su, Guorong Cai, Meiliu Wu

机构 * Jimei University(集美大学) University of Glasgow(格拉斯哥大学) Sun Yat-sen University(中山大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Xidian University(西安电子科技大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 Vireo通过结合深度和语言信息,实现开放词汇域通用语义分割,提升跨领域和开放词汇的语义分割性能。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 3 篇

2512.10595 2025-12-12 cs.RO 57%

Motion Planning for Safe Landing of a Human-Piloted Parafoil

有人操控 parachutes 的安全着陆路径规划

Maximillian Fainkich, Kiril Solovey, Anna Clarke

机构 * Stephen B. Klein Faculty of Aerospace Engineering(斯蒂芬·B·克莱因航空航天工程学院) Viterbi Faculty of Electrical and Computer Engineering(维特比电气与计算机工程学院) Technion–Israel Institute of Technology(技术学院–以色列理工学院)

专题命中 规划控制 :trajectory planning(abstract);分类 cs.RO

AI总结 本研究提出了一种基于 SST 的算法,用于为有人操控滑翔伞计算安全轨迹,通过比较计算机生成和人类生成的解决方案,证明了计算机指导在提升飞行安全性和经济性方面的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08591 2025-12-12 cs.CV 57%

Joint2Human: High-quality 3D Human Generation via Compact Spherical Embedding of 3D Joints

Joint2Human: 通过紧凑的球面嵌入3D关节实现高质量3D人体生成

Muxin Zhang, Qiao Feng, Zhuo Su, Chao Wen, Zhou Xue, Kun Li

机构 * College of Intelligence and Computing, Tianjin University(智能与计算学院,天津大学) PICO IDL, ByteDance China(字节跳动中国PICO IDL) Li Auto(利亚德)

专题命中 规划控制 :occupancy(abstract);分类 cs.CV

AI总结 Joint2Human通过紧凑球面嵌入3D关节,结合2D扩散模型和多视角重绘策略,实现高质量3D人体生成,兼顾全局结构与局部细节。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21615 2025-12-12 eess.SY cs.LG cs.SY 50%

Adapting to Change: A Comparison of Continual and Transfer Learning for Modeling Building Thermal Dynamics under Concept Drifts

适应变化:持续学习与迁移学习在建筑热动态建模中的比较研究

Fabian Raisch, Max Langtry, Felix Koch, Ruchi Choudhary, Christoph Goebel, Benjamin Tischler

机构 * Technical University of Applied Sciences Rosenheim(应用技术大学罗斯海姆) Technical University of Munich(慕尼黑技术大学) University of Cambridge(剑桥大学)

专题命中 规划控制 :occupancy(abstract)

AI总结 本研究比较了持续学习与迁移学习在建筑热动态建模中的效果,提出了一种更高效的季节性记忆学习方法,提升了预测精度并应对动态变化。

Comments Currently under review

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 端到端驾驶 1 篇

2507.13162 2025-12-12 cs.CV cs.AI cs.LG 62%

Orbis: Overcoming Challenges of Long-Horizon Prediction in Driving World Models

Orbis:克服驾驶世界模型中长周期预测的挑战

Arian Mousakhan, Sudhanshu Mittal, Silvio Galesso, Karim Farid, Thomas Brox

专题命中 端到端驾驶 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 Orbis通过简单设计实现自动驾驶世界模型在长周期预测和复杂场景中的高性能,采用连续自回归模型优于离散token模型。

Comments Project page: https://lmb-freiburg.github.io/orbis.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏

4. BEV与占用 2 篇

2512.10419 2025-12-12 cs.CV 57%

TransLocNet: Cross-Modal Attention for Aerial-Ground Vehicle Localization with Contrastive Learning

TransLocNet: 跨模态注意力用于航空-地面车辆定位的对比学习

Phu Pham, Damon Conover, Aniket Bera

机构 * Department of Computer Science, Purdue University(计算机科学系,普渡大学) DEVCOM Army Research Laboratory(陆军研究实验室)

专题命中 BEV与占用 :LiDAR(abstract);分类 cs.CV

AI总结 TransLocNet通过跨模态注意力和对比学习实现航空-地面车辆定位,显著提升定位精度和鲁棒性。

Comments 8 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10097 2025-12-12 hep-ex physics.ins-det 50%

Enabling searches for long-lived particles at a future 10 TeV Muon Collider

在未来的10 TeV缪子对撞机上实现长寿命粒子的搜索

Mira Littmann, Mark Larson, Benjamin Rosser, Tate Flicker, Kane Huang, Leo Rozanov, Karri Folan Di Petrillo

专题命中 BEV与占用 :occupancy(abstract)

AI总结 该研究探讨了在10 TeV缪子对撞机中通过放宽时间要求来提高长寿命粒子探测灵敏度的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 激光雷达 2 篇

2512.10376 2025-12-12 cs.CV 79%

RaLiFlow: Scene Flow Estimation with 4D Radar and LiDAR Point Clouds

RaLiFlow: 基于4D雷达和激光雷达点云的场景流估计

Jingyun Fu, Zhiyu Xiang, Na Zhao

专题命中 激光雷达 :LiDAR(title,abstract);分类 cs.CV

AI总结 RaLiFlow是首个联合4D雷达和激光雷达的场景流学习框架,通过动态感知双向跨模态融合模块和精心设计的损失函数实现高效的雷达-激光雷达融合。

Comments Accepted by AAAI

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08170 2025-12-12 cs.RO cs.CV 62%

RAVES-Calib: Robust, Accurate and Versatile Extrinsic Self Calibration Using Optimal Geometric Features

RAVES-Calib: 一种鲁棒、准确且多功能的无目标外参自校准方法,利用最优几何特征

Haoxin Zhang, Shuaixin Li, Xiaozhou Zhu, Hongbo Chen, Wen Yao

机构 * School of Systems Science and Engineering, Sun Yat-Sen University(系统科学与工程学院,中山大学) Defense Innovation Institute, Chinese Academy of Military Science(国防创新研究院,中国人民解放军军事科学院) Intelligent Game and Decision Laboratory(智能游戏与决策实验室) College of Computer Science and Technology, Harbin Engineering University(计算机科学与技术学院,哈尔滨工程大学)

专题命中 激光雷达 :LiDAR(abstract);分类 cs.RO、cs.CV

AI总结 RAVES-Calib通过优化几何特征实现鲁棒且准确的LiDAR-相机外参自校准,适用于多种传感器并开源供社区使用。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 仿真评测 1 篇

2512.10925 2025-12-12 cs.LG cs.RO 57%

Digital Twin Supervised Reinforcement Learning Framework for Autonomous Underwater Navigation

数字孪生监督强化学习框架用于自主水下导航

Zamirddine Mari, Mohamad Motasem Nawaf, Pierre Drap

机构 * DGA Techniques Navales - Direction Générale de l’Armement(法国国防总局海军技术部) LIS, CNRS, Aix-Marseille University(里尔研究所、国家科学研究中心、阿维尼昂-马赛大学)

专题命中 仿真评测 :occupancy(abstract);分类 cs.RO

AI总结 本文提出基于PPO算法的数字孪生监督强化学习框架,用于提升水下自主导航的鲁棒性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏