arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-01-01 至 2026-01-01 共收录 18 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 8 篇

2512.24922 2026-01-01 cs.CV 70%

Semi-Supervised Diversity-Aware Domain Adaptation for 3D Object detection

半监督多样性感知领域适应用于3D目标检测

Bartłomiej Olber, Jakub Winter, Paweł Wawrzyński, Andrii Gamalii, Daniel Górniak, Marcin Łojek, Robert Nowak, Krystian Radlak

机构 * Warsaw University of Technology(华沙技术大学) IDEAS NCBR

专题命中 感知 :autonomous driving(abstract);LiDAR(abstract);分类 cs.CV

AI总结 本文提出了一种基于神经激活模式的半监督领域适应方法,通过少量多样化样本标注提升3D目标检测在跨领域应用中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24111 2026-01-01 cs.CV cs.RO 62%

Guided Diffusion-based Generation of Adversarial Objects for Real-World Monocular Depth Estimation Attacks

引导扩散生成对抗性物体用于现实世界单目深度估计攻击

Yongtao Chen, Yanbo Wang, Wentao Zhao, Guole Shen, Tianchen Deng, Jingchuan Wang

机构 * School of Automation and Intelligent Sensing, Institute of Medical Robotics, Shanghai Jiao Tong University(自动化与智能感知学院、医疗机器人研究院、上海交通大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 本文提出一种无需训练的生成对抗攻击框架,通过扩散模型生成自然且场景一致的对抗性物体,以提升自动驾驶系统中单目深度估计的对抗攻击效果和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17821 2026-01-01 cs.RO cs.AI cs.LG 62%

CAML: Collaborative Auxiliary Modality Learning for Multi-Agent Systems

CAML: 多智能体系统中的协同辅助模态学习

Rui Liu, Yu Shen, Peng Gao, Pratap Tokekar, Ming Lin

机构 * University of Maryland, College Park(马里兰大学 College Park 分校) Adobe Research(Adobe 研究院) North Carolina State University(北卡罗来纳州立大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.RO、cs.AI

AI总结 CAML通过多智能体协作和共享多模态数据,提升多模态学习在资源受限环境下的性能,实现事故检测和语义分割的显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12843 2026-01-01 cs.CV cs.AI 62%

SLTNet: Efficient Event-based Semantic Segmentation with Spike-driven Lightweight Transformer-based Networks

SLTNet: 面向事件感知语义分割的高效轻量级脉冲神经网络

Xianlei Long, Xiaxin Zhu, Fangming Guo, Wanyi Zhang, Qingyi Gu, Chao Chen, Fuqiang Gu

机构 * College of Computer Science, Chongqing University(重庆大学计算机学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 SLTNet通过脉冲驱动轻量级变压器网络实现高效事件感知语义分割,提升性能并降低能耗

Comments Accepted by IROS 2025 (2025 IEEE/RSJ International Conference on Intelligent Robots and Systems)

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24680 2026-01-01 cs.RO 57%

ReSPIRe: Informative and Reusable Belief Tree Search for Robot Probabilistic Search and Tracking in Unknown Environments

ReSPIRe: 信息性和可重用的信念树搜索用于未知环境中的机器人概率搜索与跟踪

Kangjie Zhou, Zhaoyang Li, Han Gao, Yao Su, Hangxin Liu, Junzhi Yu, Chang Liu

专题命中 感知 :trajectory planning(abstract);分类 cs.RO

AI总结 ReSPIRe通过分层粒子结构和可重用信念树搜索,在未知环境中实现高效且稳定的机器人目标搜索与跟踪。

Comments 17 pages, 12 figures, accepted to IEEE Transactions on Systems, Man, and Cybernetics: Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24243 2026-01-01 cs.CV 57%

MambaSeg: Harnessing Mamba for Accurate and Efficient Image-Event Semantic Segmentation

MambaSeg: 利用Mamba实现准确且高效的图像事件语义分割

Fuqiang Gu, Yuanke Li, Xianlei Long, Kangping Ji, Chao Chen, Qingyi Gu, Zhenliang Ni

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 MambaSeg通过双分支框架和双维交互模块,实现高效准确的多模态语义分割,适用于快速运动和低光条件下的图像事件分割任务。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24227 2026-01-01 cs.CV 57%

Mirage: One-Step Video Diffusion for Photorealistic and Coherent Asset Editing in Driving Scenes

Mirage: 驾驶场景中光实且一致的资产编辑一步视频扩散

Shuyun Wang, Haiyang Sun, Bing Wang, Hangjun Ye, Xin Yu

机构 * The University of Queensland(昆士兰大学) Xiaomi EV(小米电动车)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 Mirage提出了一种用于驾驶场景中光实且一致的资产编辑的一步视频扩散模型,通过引入时序无关的潜在特征和两阶段数据对齐策略,提升了视觉保真度和时间一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24073 2026-01-01 cs.NI 50%

CPePC: Cooperative and Predictive Popularity based Caching for Named Data Networks

CPePC:基于流行度的协同预测缓存用于命名数据网络

Pankaj Chaudhary, Neminath Hubballi, Sameer G. Kulkarni

专题命中 感知 :occupancy(abstract)

AI总结 CPePC通过社区划分和流行度预测优化缓存决策,提升命名数据网络性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 2 篇

2512.24426 2026-01-01 cs.RO 57%

Counterfactual VLA: Self-Reflective Vision-Language-Action Model with Adaptive Reasoning

反事实VLA:具有自反思能力的视觉-语言-动作模型与自适应推理

Zhenghao "Mark" Peng, Wenhao Ding, Yurong You, Yuxiao Chen, Wenjie Luo, Thomas Tian, Yulong Cao, Apoorva Sharma, Danfei Xu, Boris Ivanovic, Boyi Li, Bolei Zhou, Yan Wang, Marco Pavone

机构 * NVIDIA UCLA(加州大学洛杉矶分校) Stanford University(斯坦福大学)

专题命中 规划控制 :autonomous driving(abstract);分类 cs.RO

AI总结 CF-VLA通过自反思机制提升自动驾驶轨迹精度与安全性,实现自适应推理与因果修正。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08184 2026-01-01 physics.optics 50%

Online training and pruning of multi-wavelength photonic neural networks

多波长光子神经网络的在线训练与剪枝

Jiawei Zhang, Weipeng Zhang, Tengji Xu, Lei Xu, Eli A. Doris, Bhavin J. Shastri, Chaoran Huang, Paul R. Prucnal

专题命中 规划控制 :LiDAR(abstract)

AI总结 本研究提出了一种在线训练和剪枝方法,通过优化PNN准确性和调谐功率,提升基于MRR的光子处理器的可扩展性和能效。

Comments 21 pages, 5 figures

Journal ref Nanophotonics 14, 5035-5046 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. BEV与占用 3 篇

2412.08243 2026-01-01 cs.CV 83%

Hierarchical Context Alignment with Disentangled Geometric and Temporal Modeling for Semantic Occupancy Prediction

具有解耦几何和时间建模的层次上下文对齐用于语义占用预测

Bohan Li, Jiajun Deng, Yasheng Sun, Xiaofeng Wang, Xin Jin, Wenjun Zeng

机构 * Shanghai Jiao Tong University(上海交通大学) Eastern Institute of Technology(东部技术研究所) Ningbo Institute of Digital Twin(宁波数字孪生研究所) University of Adelaide(阿德莱德大学) Tokyo Institute of Technology(东京技术大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 BEV与占用 :occupancy(title,abstract);LiDAR(abstract);分类 cs.CV

AI总结 本文提出Hi-SOP方法,通过解耦几何和时间上下文进行层次化对齐,提升语义占用预测的准确性,在多个数据集上取得优异效果。

Comments IEEE TPAMI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20049 2026-01-01 cs.RO cs.AI 81%

Robust Robotic Exploration and Mapping Using Generative Occupancy Map Synthesis

使用生成占用地图合成的鲁棒机器人探索与建图

Lorin Achey, Alec Reed, Brendan Crowe, Bradley Hayes, Christoffer Heckman

专题命中 BEV与占用 :occupancy(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种基于生成占用地图合成的鲁棒机器人探索方法,通过实时融合预测提升地图质量和可通行性,实验表明其在不同环境中提升了探索一致性。

Comments arXiv admin note: text overlap with arXiv:2409.10681

Journal ref Auton Robot 50, 8 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24412 2026-01-01 eess.SP 50%

Low-complexity spectral shaping method for OFDM signals with dynamically adaptive emission mask

低复杂度的频谱成形方法用于OFDM信号的动态自适应发射掩码

Javier Giménez, José A. Cortés, Luis Díez

专题命中 BEV与占用 :occupancy(abstract)

AI总结 本文提出了一种低复杂度的动态自适应频谱成形方法,通过预优化脉冲和简单变换实现OFDM信号的频谱优化,无需解决NP难优化问题。

Comments 12 pages

Journal ref IEEE Transactions on Communications, Volume 71, Issue 4, April 2023, pp. 2351-2363

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 激光雷达 2 篇

2512.23972 2026-01-01 cs.RO 83%

SHIELD: Spherical-Projection Hybrid-Frontier Integration for Efficient LiDAR-based Drone Exploration

SHIELD:球面投影混合前沿集成用于高效的基于LiDAR的无人机探索

Liangtao Feng, Zhenchang Liu, Feng Zhang, Xuefeng Ren

机构 * Zhuoyi Intelligent Tech Co, Ltd.(卓奕智能科技有限公司)

专题命中 激光雷达 :LiDAR(title,abstract);occupancy(abstract);分类 cs.RO

AI总结 SHIELD通过球面投影和混合前沿方法提升基于LiDAR的无人机探索效率与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23983 2026-01-01 cs.CV 70%

DriveExplorer: Images-Only Decoupled 4D Reconstruction with Progressive Restoration for Driving View Extrapolation

DriveExplorer: 基于图像的解耦4D重建与渐进修复用于驾驶视角外推

Yuang Jia, Jinlong Wang, Jiayi Zhao, Chunlam Li, Shunzhou Wang, Wei Gao

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology(广东省级超高清沉浸媒体技术重点实验室) School of Electronic and Computer Engineering(电子与计算机工程学院) Shenzhen Graduate School, Peking University(北京大学深圳研究生院)

专题命中 激光雷达 :autonomous driving(abstract);LiDAR(abstract);分类 cs.CV

AI总结 DriveExplorer通过图像解耦和渐进修复实现驾驶视角外推,利用4D高斯框架和扩散模型提升重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 多传感器融合 1 篇

2512.24284 2026-01-01 cs.RO cs.AI 62%

DRL-TH: Jointly Utilizing Temporal Graph Attention and Hierarchical Fusion for UGV Navigation in Crowded Environments

DRL-TH:联合利用时序图注意力和层次融合用于拥挤环境下的无人地面车辆导航

Ruitong Li, Lin Zhang, Yuenan Zhao, Chengxin Liu, Ran Song, Wei Zhang

专题命中 多传感器融合 :LiDAR(abstract);分类 cs.RO、cs.AI

AI总结 DRL-TH通过结合时序图注意力和层次融合,提升无人地面车辆在拥挤环境中的导航性能和动态适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 仿真评测 1 篇

2512.23745 2026-01-01 cs.LG cs.SE 50%

A Comprehensive Study of Deep Learning Model Fixing Approaches

深度学习模型修复方法的全面研究

Hanmo You, Zan Wang, Zishuo Dong, Luanqi Mo, Jianjun Zhao, Junjie Chen

机构 * College of Intelligence and Computing, Tianjin University(智能与计算学院,天津大学) Kyushu University(九州大学)

专题命中 仿真评测 :autonomous driving(abstract)

AI总结 本文全面研究了深度学习模型修复方法,评估了不同层级方法的修复效果及对鲁棒性、公平性等属性的影响,指出模型级方法更优,但需关注副作用问题。

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 其他自动驾驶 1 篇

2410.13796 2026-01-01 cond-mat.mtrl-sci 50%

Geographic-style maps with a local novelty distance help navigate the materials space

具有局部新颖距离的地理风格地图帮助导航材料空间

Daniel E Widdowson, Vitaliy A Kurlin

专题命中 其他自动驾驶 :self-driving(abstract)

AI总结 本文提出了一种基于局部新颖距离的地理风格地图,用于快速导航材料空间,帮助自动驾驶实验室识别新颖材料。

Comments 20 pages, 13 figures. The paper has been published in Scientific Reports, v.15, 27588 (2025). The latest version is maintained at http://kurlin.org/projects/computational-materials-science/navigation-maps.pdf

Journal ref Scientific Reports, v.15, 27588 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏