arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

共收录 6072 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 6072 篇

2205.00613 2022-05-03 cs.CV cs.AI 66%

MUTR3D: A Multi-camera Tracking Framework via 3D-to-2D Queries

Tianyuan Zhang, Xuanyao Chen, Yue Wang, Yilun Wang, Hang Zhao

专题命中 感知 :autonomous driving(abstract,comments);分类 cs.CV、cs.AI

Comments Appear on CVPR 2022 Workshop on Autonomous Driving

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.08189 2021-11-05 cs.CV cs.LG cs.RO 66%

MOPT: Multi-Object Panoptic Tracking

Juana Valeria Hurtado, Rohit Mohan, Wolfram Burgard, Abhinav Valada

专题命中 感知 :LiDAR(abstract);分类 cs.RO、cs.CV;autonomous driving(journal_ref)

Comments Code & models are available at http://rl.uni-freiburg.de/research/panoptictracking

Journal ref The IEEE Conference on Computer Vision and Pattern Recognition (CVPR) Workshop on Scalability in Autonomous Driving, 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.11466 2019-04-26 cs.CV cs.LG cs.RO 66%

Sensor Fusion for Joint 3D Object Detection and Semantic Segmentation

Gregory P. Meyer, Jake Charland, Darshan Hegde, Ankit Laddha, Carlos Vallespi-Gonzalez

专题命中 感知 :LiDAR(abstract);分类 cs.RO、cs.CV;autonomous driving(comments)

Comments Accepted for publication at CVPR Workshop on Autonomous Driving 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.15781 2023-01-31 cs.CV 65%

Co-Training for Unsupervised Domain Adaptation of Semantic Segmentation Models

Jose L. Gómez, Gabriel Villalonga, Antonio M. López

专题命中 感知 :autonomous driving(abstract,journal_ref);分类 cs.CV;driving perception(journal_ref)

Comments Code available at https://github.com/JoseLGomez/Co-training_SemSeg_UDA. Paper accepted on Sensors at https://www.mdpi.com/1424-8220/23/2/621

Journal ref Sensors, Special Issue Machine Learning for Autonomous Driving Perception and Prediction (2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23140 2026-08-25 cs.CV cs.RO 新提交 62%

MIVIFI: Bridging Perspective and Fisheye Domains for Training Multi-View Fisheye Image Generation Models

MIVIFI:弥合透视域与鱼眼域以训练多视图鱼眼图像生成模型

Matthias Neuwirth-Trapp, Begüm Altunbas, Jiayi Wang, Yan Xia, Maarten Bieshaar, Xinyu Huang, Daniel Cremers

机构 * ETH Zurich(苏黎世联邦理工学院) Bosch Research(博世研究中心) Technical University of Munich(慕尼黑工业大学)

专题命中 感知 :occupancy(abstract);分类 cs.RO、cs.CV

AI总结 本研究针对多视图鱼眼图像生成问题,提出SyntheOcc-FE与MIVIFI两种方法,其中MIVIFI利用跨域学习缓解鱼眼数据稀缺问题,实现高保真的多视图鱼眼图像生成。

Comments Accepted at the IEEE International Conference on Intelligent Transportation Systems (ITSC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21099 2026-08-24 cs.CV cs.AI 新提交 62%

A2DINOv3: Rethinking Multi-Modal Object Detection via Socialized Collaboration

A2DINOv3:通过社会化协作重新思考多模态目标检测

Jiekang Feng, Zhihe Fan, Yunqi Zhu, Xinjie Yao, Yueying Zhang, Yike Gao, Ranxin Li, Guanzuo Chen

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 本文提出A2DINOv3框架,通过社会化协作协议让RGB与红外分支以异构专家模式选择性交互,结合零初始化策略,在四个多模态基准上实现了多模态目标检测的SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18715 2026-08-20 cs.CV cs.AI cs.LG 新提交 62%

The Impact of CutMix on Reliability and Robustness in Semantic Segmentation

CutMix对语义分割中可靠性与鲁棒性的影响

Steven Landgraf, Markus Ulrich

机构 * Institute of Photogrammetry and Remote Sensing (IPF), Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工学院摄影测量与遥感研究所)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 该研究探究CutMix对语义分割的影响,发现其对分割准确率影响微小,但可提升模型可靠性,尤其在分布偏移场景下,增强的是校准度与不确定性可信度,对安全关键应用意义重大。

Comments Accepted for publication in the ISPRS Annals (ISPRS Congress 2026, Toronto, Oral Presentation)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14603 2026-08-19 cs.NI cs.AI cs.CV cs.IT math.IT 版本更新 62%

HMS-SCP: Task-Oriented Multi-Scale Semantic Communication for V2X Cooperative Perception

通过语义感知协同感知扩展智能交通系统的安全 horizon

Chun-Yeow Yeoh, Chee Keong Tan, Joanne Mun-Yee Lim, Heng-Siong Lim

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 本文提出 HMS-SCP 框架,通过多尺度语义冗余与 JSCC 编码实现带宽效率与鲁棒性的平衡,在 V2X 环境中保障安全关键型协同感知的性能。

Comments 15 pages, 7 figures, 6 tables, Submitted to IEEE Transactions on Vehicular Technology (TVT)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08748 2026-08-19 cs.RO cs.AI 版本更新 62%

Visual Prompting for Robotic Manipulation with Annotation-Guided Pick-and-Place Using ACT

面向机器人操作的视觉提示:采用带标注引导的拾取与放置方法,基于ACT算法

Muhammad A. Muttaqien, Tomohiro Motoda, Ryo Hanai, Yukiyasu Domae

机构 * Embodied AI Research Team(具身人工智能研究团队) National Institute of AIST(国家信息与系统技术研究所)

专题命中 感知 :trajectory planning(abstract);分类 cs.RO、cs.AI

AI总结 针对便利店机器人拾取放置任务的挑战,提出带标注引导视觉提示的感知-行动流水线,采用ACT算法实现自适应操作,提升了零售环境下的抓取精度与适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16499 2026-08-18 cs.RO cs.CV 新提交 62%

OccamView: Object-Conditioned View Selection for Frame-Budgeted Active 3D Gaussian Reconstruction

OccamView:面向帧预算约束下主动式3D高斯重建的物体条件视角选择方法

Hongbo Gao, Wei Zhang, Zeyu Ni, Dihao Zhu, Ruifeng Li, Yunke Wang, Chang Xu

专题命中 感知 :occupancy(abstract);分类 cs.RO、cs.CV

AI总结 针对帧预算紧张时现有主动3D高斯重建方法易漏重建物体的问题,提出OccamView框架,通过物体条件视角选择与Geo-Floor机制优化规划,在多数据集上提升了重建表现。

Comments 7 pages, 5 figures. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16285 2026-08-18 cs.CV cs.AI 新提交 62%

Audio-Visual Segmentation via Depth-Guided Collaborative Modeling

基于深度引导协同建模的视听分割

Zhaojin Fu, Yuyang Hong, Qi Yang, Zili Wang, Kun Ding, Shiming Xiang, Bin Fan

机构 * School of Intelligent Science and Technology, University of Science and Technology Beijing(北京科技大学智能科学与技术学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 该研究针对现有视听分割方法未建模几何线索的问题,提出三模态框架DGCM-AVS,通过深度感知动态调制器与深度引导渐进融合模块优化,在AVSS数据集上实现M_J、M_F指标的显著提升。

Journal ref IEEE Transactions on Multimedia, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14724 2026-08-18 cs.CV cs.AI cs.LG 新提交 62%

Privacy-Preserving Dataset Curation for Kuala Lumpur Urban Traffic: Grounded Vision-Language Detection with Spatial Vehicle-Context Filtering

面向吉隆坡城市交通的隐私保护数据集构建:结合空间车辆上下文过滤的接地视觉-语言检测

Mohammed Abdul Al Arafat Tanzin, Rudzidatul Akmam Dziyauddin

机构 * Faculty of Artificial Intelligence, Universiti Teknologi Malaysia(马来西亚理工大学人工智能学院)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 针对吉隆坡热带城市交通场景的隐私保护数据集构建难题,提出结合Grounding DINO与空间车辆ROI包含引擎的自动化匿名化框架,在1266帧图像上实现约95%的匿名化成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13719 2026-08-17 cs.AI cs.RO 新提交 62%

Coverage Aware Active Evaluation for Failure Discovery with Paired Systems

面向配对系统故障发现的覆盖率感知主动评估

Anjali Parashar, Rachel Luo, Apoorva Sharma, Sushant Veer, Edward Schmerling, Carson Sobolewski, Mingxin Yu, Chuchu Fan, Marco Pavone

机构 * Laboratory of Information & Decision Systems (LIDS), MIT(麻省理工学院信息与决策系统实验室(LIDS)) NVIDIA Research(英伟达研究院)

专题命中 感知 :autonomous driving(abstract);分类 cs.RO、cs.AI

AI总结 该研究针对自主系统故障发现难题,提出结合代理评估与残差建模、支持感知互信息目标的自适应方法,在三类任务中发现的故障数是基线的两倍。

Comments 9 main pages followed by Appendix, total 21 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12826 2026-08-12 cs.CV cs.AI 版本更新 62%

DIMOS: Disentangling Instance-level Moving Object Segmentation

DIMOS: 解耦实例级运动目标分割

Hongxiang Huang, Hongwei Ren, Xiaopeng Lin, Yulong Huang, Zeke Xie, Bojun Cheng

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 提出双解耦特征提取框架分离图像与事件模态的外观和运动信息,并通过多粒度跨模态对齐实现有效融合,在运动实例分割任务中尤其对快速运动和低光下的小目标取得最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08025 2026-08-11 cs.RO cs.AI 新提交 62%

DA-NBV: A Direction-Aware Next-Best-View Planner for Efficient 3D Reconstruction of Ships at Sea

DA-NBV:一种用于海上船舶高效3D重建的方向感知最优下一个视点规划器

Jiaming Chen, Juntao Yang, Zhentao Zou, Qi Ming, Yi Yu, Zhihang Zhong, Xue Yang, Xue Jiang, Yue Zhou

专题命中 感知 :occupancy(abstract);分类 cs.RO、cs.AI

AI总结 针对海上船舶3D重建中现有NBV策略忽略方向观测历史的问题,本文提出DA-NBV策略,结合PAF等方法,在SeaShip-3D数据集与仿真环境下实现了更高效的船舶3D重建性能。

Comments 16pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07750 2026-08-11 cs.CV cs.AI 新提交 62%

Multi-Task Consistency-based Detection of Adversarial Attacks

基于多任务一致性的对抗攻击检测

Cong Chen, Jean-Philippe Monteuuis, Jonathan Petit

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 针对自动驾驶中DNNs易受对抗攻击且现有防御成本高的问题,提出基于多任务视觉任务输出一致性的高效检测方案,在BDD100k数据集上对PGD攻击的ROC-AUC达99.9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07579 2026-08-11 cs.CV cs.AI 新提交 62%

Geometry Beats Estimated Depth: RGB-Only Multi-Camera 3D Tracking under Sim2Real

几何胜过估计深度:Sim2Real 场景下仅用 RGB 的多相机 3D 跟踪

Abdullah Naeem, Anav Katwal, Ayon Dey, Noman Khan, Md Tamjidul Hoque

机构 * LSU New Orleans(路易斯安那州立大学新奥尔良分校) PinPark, Inc.(PinPark公司)

专题命中 感知 :LiDAR(abstract);分类 cs.CV、cs.AI

AI总结 在 Sim2Real 场景下,研究人员通过实验验证跨视图几何一致性而非单目深度精度决定仅用 RGB 的多相机 3D 跟踪性能,提出几何优先流水线并取得显著优于伪激光雷达方法的结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11554 2026-08-11 cs.RO cs.CV cs.LG 版本更新 62%

HyperDet: 3D Object Detection with Hyper 4D Radar Point Clouds

HyperDet: 基于超4D雷达点云的3D目标检测

Yichun Xiao, Runwei Guan, Jin Jin, Fangqiang Ding

机构 * University of Edinburgh(爱丁堡大学) HKUST (GZ)(香港科技大学(广州)) University of Oxford(牛津大学) MIT(麻省理工学院)

专题命中 感知 :LiDAR(abstract);分类 cs.RO、cs.CV

AI总结 提出一种与检测器无关的框架HyperDet,通过构建任务感知的超4D雷达点云,利用时空累积、跨传感器验证和多普勒引导的运动补偿以及前景生成增强,显著提升仅用雷达的3D目标检测性能。

Comments 11 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07154 2026-08-10 cs.RO cs.AI 新提交 62%

Representation Handoffs for OpenArm-Based Laboratory Mobile Manipulation

基于OpenArm的实验室移动操作的表示交接

Yang Shen, Chonghao Cheng, Ziyi Zhao, Jialuo Zhu, Zhenyi Yi, Qi Zhao, Jian Yang, Yuhui Shi, Chin-Teng Lin

专题命中 感知 :LiDAR(abstract);分类 cs.RO、cs.AI

AI总结 本研究提出基于OpenArm的实验室移动操作原型,通过表示交接整合多模块,可暴露部署阻碍并为具身系统整合提供调试接口。

Comments Robotics: Science and Systems (RSS) Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26651 2026-07-30 cs.CV cs.AI 新提交 62%

Physically Real-time Infrared Attack against Optical Flow Estimation Networks

面向光流估计网络的物理实时红外攻击

Shen You, Wei Jiang, Jiarui Liu, Yijian Ye, Qiuzhen Lin, Xiangtao Li, Ka-Chun Wong

机构 * City University of Hong Kong(香港城市大学) University of Electronic Science and Technology(电子科技大学) Shenzhen University(深圳大学) Jilin University(吉林大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 该研究提出一种利用红外光的物理实时攻击方法,通过动态显示对抗样本破坏光流估计网络,在多种场景下均能有效削弱网络的光流估计能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26121 2026-07-30 cs.RO cs.AI cs.CY 新提交 62%

Towards Trustworthy Embodied Intelligence: A Systems Framework and Graded Trustworthiness Levels

面向可信赖的具身智能:一个系统框架与分级可信赖性水平

Xinyu Yang, Tianxing Chen, Honghao Su, Minxuan Wang, Chenze Yu, Zhangzheng Tu, Yue Chen, Yuxiao Huo, Lingfeng Zhang, Yan Huang, Yan Qin, Shaolong Zhu, Qiwei Liang, Hekun Tian, Shujia Liu, Guangyu Chen, Junhao Gong, Zixuan Li, Wenwei Lin, Zijian Lin, Wenxuan Zhu, Eric J Chen, Yue Yuan, Qize Yu, Jiaqi Liang, Haowen Yan, Hengfei Zhao, Weijie Wan, Zikun Xiao, Junyuan Tang, Baijun Chen, Kai-Chong Lei, Kaixuan Wang, Kailun Su, Zanxin Chen, Yao Mu, Renjing Xu, Chuqiao Lyu, Qi Xiong, Ping Luo, Wenbo Ding

机构 * THU(清华大学) PKU(北京大学) HKUST (GZ)(香港科技大学(广州))

专题命中 感知 :autonomous driving(abstract);分类 cs.RO、cs.AI

AI总结 该研究提出具身智能可信赖性的四层系统框架,构建涵盖多维度的可信赖性水平层级,为具身智能的可信赖部署、评估等提供依据。

Comments Website: https://xsparkai.com/sparklab/towards-trustworthy-eai

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17724 2026-07-21 cs.RO cs.AI cs.MA 新提交 62%

Lifelong Multi-Subsystem Pickup and Delivery with Buffer-Limited Handover Stations

具有缓冲区受限交接站的终身多子系统取货与送货

Chuanlong Zang, Isabelle Barz, Anna Mannucci, Philipp Schillinger, Florian Lier, Wolfgang Hönig

机构 * Robert Bosch GmbH(罗伯特·博世有限公司) Technical University of Berlin(柏林工业大学) Robotics Institute Germany (RIG)(德国机器人研究所)

专题命中 感知 :occupancy(abstract);分类 cs.RO、cs.AI

AI总结 研究终身多子系统取货与送货中协调子系统载荷转移的问题,提出交接感知预留与路由(HARR)方法,通过共享日历和缓冲区预测协调行动,模拟显示该方法能显著提高吞吐量、减少积压并降低规划时间,提升运输稳定性。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17351 2026-07-21 cs.AI cs.RO 新提交 62%

DeeperRadar: End-to-End MIMO Radar Design and Multi-Modal Fusion for Autonomous Vehicle Perception

深度雷达:用于自动驾驶车辆感知的端到端MIMO雷达设计与多模态融合

Eli Goldenshluger, Barak Pinkovich, Chaim Baskin

机构 * Technion–Israel Institute of Technology(以色列理工学院) Ben-Gurion University of the Negev(内盖夫本-古里安大学)

专题命中 感知 :LiDAR(abstract);分类 cs.RO、cs.AI

AI总结 深度雷达以雷达为中心,通过端到端学习稀疏采集模式,共同设计雷达传感与多模态3D检测。其可学习的MIMO设计模块在融合网络中训练,由其他传感器监督。在RADIal数据集上评估,能发现稀疏配置,降低成本与复杂性,表明最优设计取决于融合堆栈和感知任务。

Comments Accepted for publication at the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15620 2026-07-20 cs.RO cs.AI 新提交 62%

AEGIS: Assay-Aware Protocol Validation and Runtime Monitoring for Open-Source Liquid Handling Robots

AEGIS:用于开源液体处理机器人的检测感知协议验证和运行时监测

Priyanka V. Setty, Arvind Ramanathan, Ian Foster, Rick Stevens

机构 * Data Science and Learning Division, Argonne National Laboratory(阿贡国家实验室数据科学与学习部) Department of Computer Science, University of Chicago(芝加哥大学计算机科学系)

专题命中 感知 :self-driving(abstract);分类 cs.RO、cs.AI

AI总结 研究开源液体处理机器人运行问题,提出AEGIS两层防护系统。一层结合检测规则库与大语言模型验证协议,二层用主成分分析模型监测运行轨迹,经实验验证有效,统一了检测感知验证与视觉监测,且开源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14248 2026-07-17 cs.CV eess.IV 新提交 62%

3D Lane Detection with Odometry for High-Speed Vehicle Racing

用于高速赛车的带里程计的3D车道检测

Omoruyi Atekha, John Subosits, Marcus Greiff

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、eess.IV

AI总结 研究高速赛车场景下的3D车道检测问题,通过新数据集比较多种方法,提出改进措施,利用多摄像头集成及里程计等提升性能,相比其他方法提高了F1分数并降低误差,在车辆部署中取得良好指标。

Comments 14 pages, IROS paper, includes extended abstract

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14005 2026-07-16 cs.CV cs.RO 新提交 62%

M$^\text{4}$World: A Multi-view Multimodal Driving World Model for Interactive Object Manipulation and Minute-long Streaming

M$^\text{4}$World:用于交互式对象操纵和分钟级流的多视图多模态驾驶世界模型

Ke Cheng, Hanqiao Ye, Lei Shi, Yahui Liu, Yunhan Shen, Jingtao Dong, Zhenke Wang, Wenxuan Ao, Weixiang Xu, Kaining Huang, Shuhan Shen

专题命中 感知 :LiDAR(abstract);分类 cs.RO、cs.CV

AI总结 针对现有驾驶世界生成方法局限,提出M$^\text{4}$World模型,通过灵活接口与多阶段训练实现对象操纵及长时流稳定,引入后训练与生成模型,并用新管道评估,实验证明其在驾驶模拟中有高质量、可控性与稳定性。

Comments 24 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07370 2026-07-10 cs.RO cs.AI cs.HC cs.LG 新提交 62%

Behavior Foundations for Quadruped Robots: ABot-C0 Technical Report

四足机器人的行为基础:ABot-C0技术报告

Xufeng Zhao, Fuzhi Yang, Jianhui Chen, Li Gao, Zhang Meng, Jie Gao, Yao Zheng, Congyang Zhao, Tianxiong Lv, Menglin Yang, Minqi Gu, Yaru Zhao, Wenyu Liu, Honglin Han, Shihui Su, Zixiao Tang, Liu Liu, Mu Xu, Yang Cai, Wenbin Tang

机构 * Alibaba Group(阿里巴巴集团)

专题命中 感知 :LiDAR(abstract);分类 cs.RO、cs.AI

AI总结 该研究聚焦四足机器人运动控制,提出ABot-C0通用系统,构建数据金字塔生成运动片段,训练流匹配通用策略展示跟踪缩放定律,采用特定框架推动全地形遍历运动,经实验验证其能让四足机器人迈向产品级行为智能。

Comments Abot-C0 project page will be released soon

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07357 2026-07-09 cs.RO cs.AI 新提交 62%

HumAIN: Human-Aware Implicit Social Robot Navigation

HumAIN:人类感知的隐式社交机器人导航

Daeun Song, Nhat Le, Jeffrey Chen, Mohammad Nazeri, Amirreza Payandeh, Rohan Chandra, Reuth Mirsky, Ross Mead, Ling Xiao, Xuesu Xiao

机构 * Ewha Womans University(梨花女子大学) George Mason University(乔治梅森大学) University of Virginia(弗吉尼亚大学) Tufts University(塔夫茨大学) Semio(Semio公司) Hokkaido University(北海道大学)

专题命中 感知 :trajectory planning(abstract);分类 cs.RO、cs.AI

AI总结 研究提出HumAIN框架,通过知识蒸馏将隐式社交线索融入机器人导航规划。利用基于Transformer的教师模型学习强大表示,蒸馏到轻量级学生模型。实验表明该方法能有效提升轨迹预测指标,在资源受限平台实现类人导航意识。

Comments 8 pages, 4 figures. Accepted to the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05955 2026-07-08 cs.CV cs.AI 新提交 62%

NegROI: Click-Centric Uncertainty-Guided Refinement with Scene-Conditioned Negative Prompts for Robust Interactive 3D Segmentation

NegROI:基于场景条件负提示的以点击为中心的不确定性引导细化用于稳健交互式3D分割

Shuheng Zhang, Feng Wu

机构 * School of Computer Science and Technology, University of Science and Technology of China(中国科学技术大学计算机科学与技术学院)

专题命中 感知 :LiDAR(abstract);分类 cs.CV、cs.AI

AI总结 研究针对交互式3D分割中粗体素分辨率及背景误报问题,提出NegROI框架,结合点击中心多分辨率细化与场景条件负提示,通过不确定性驱动选择性细化、负提示建模及边界感知硬负挖掘,提升点击效率、减少误报并增强跨数据集鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07254 2026-07-02 cs.CV cs.RO 版本更新 62%

Towards Accurate State Estimation: Motion Dynamics Kalman Filter for 3D Multi-Object Tracking

迈向精确状态估计:用于3D多目标跟踪的运动动力学卡尔曼滤波器

Mohamed Nagy, Naoufel Werghi, Bilal Hassan, Jorge Dias, Majid Khonji

机构 * Khalifa University(哈利法大学) New York University of Abu Dhabi(纽约大学阿布扎比分校)

专题命中 感知 :self-driving(abstract);分类 cs.RO、cs.CV

AI总结 提出运动动力学卡尔曼滤波器(MD-KF),通过将连续测量间运动变化建模为高斯分布并自适应调整加权运动模型,克服恒定运动假设,在保持模型单一性的同时提升遮挡和静止目标的状态估计精度与计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏