arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 8673 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 8673 篇

2402.17372 2026-01-22 cs.CV 57%

Coupled Laplacian Eigenmaps for Locally-Aware 3D Rigid Point Cloud Matching

耦合拉普拉斯特征映射用于局部感知的3D刚性点云匹配

Matteo Bastico, Etienne Decencière, Laurent Corté, Yannick Tillier, David Ryckelynck

机构 * Mines Paris, Université PSL(巴黎 Mines 学院,巴黎大学) Centre des Matériaux (MAT), UMR7633 CNRS(材料中心(MAT),CNRS UMR7633) Centre de Morphologie Mathématique (CMM)(数学形态学中心(CMM)) Centre de Mise en Forme des Matériaux (CEMEF), UMR7635 CNRS(材料成型中心(CEMEF),CNRS UMR7635)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出基于耦合拉普拉斯特征映射的3D点云匹配方法,通过考虑局部结构提升匹配精度,应用于物体异常检测和骨侧估计任务。

Comments This paper has been accepted at Computer Vision and Patter Recognition (CVPR) 2024

Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, 2024, pp. 3447-3458

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13304 2026-01-21 cs.CV 57%

CausalSpatial: A Benchmark for Object-Centric Causal Spatial Reasoning

CausalSpatial: 一个用于以对象为中心的因果空间推理的基准

Wenxin Ma, Chenlong Wang, Ruisheng Yuan, Hao Chen, Nanru Dai, S. Kevin Zhou, Yijun Yang, Alan Yuille, Jieneng Chen

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.CV

AI总结 CausalSpatial提出一个基准测试,评估模型在因果空间推理中的能力,揭示当前MLLMs在3D场景中处理‘如果’问题的不足,并提出COW模型以改进基于物理现实的推理。

Comments Code is available: https://github.com/CausalSpatial/CausalSpatial

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13250 2026-01-21 cs.RO 57%

Diffusion-based Inverse Model of a Distributed Tactile Sensor for Object Pose Estimation

基于扩散的分布式触觉传感器逆模型用于物体姿态估计

Ante Marić, Giammarco Caroleo, Alessandro Albini, Julius Jankowski, Perla Maiolino, Sylvain Calinon

机构 * Idiap Research Institute(Idiap研究机构) École Polytechnique Fédérale de Lausanne(瑞士联邦理工学院) Oxford Robotics Institute(牛津机器人研究所)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 本文提出基于扩散模型的分布式触觉传感器逆模型,用于在无视觉数据情况下提高物体姿态估计的精度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10521 2026-01-21 cs.CV 57%

BikeActions: An Open Platform and Benchmark for Cyclist-Centric VRU Action Recognition

BikeActions: 一个面向骑行者的VRU动作识别开放平台和基准

Max A. Buettner, Kanak Mazumder, Luca Koecher, Mario Finkbeiner, Sebastian Niebler, Fabian B. Flohr

机构 * Munich University of Applied Sciences(慕尼黑应用科学大学) Intelligent Vehicles Lab (IVL)(智能车辆实验室)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 BikeActions通过多模态数据集和开放平台,提升骑行者意图识别的准确性和研究的可扩展性。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12796 2026-01-21 cs.RO 57%

Contact-Aware Neural Dynamics

接触感知神经动力学

Changwei Jing, Jai Krishna Bandi, Jianglong Ye, Yan Duan, Pieter Abbeel, Xiaolong Wang, Sha Yi

机构 * UC San Diego(圣迭戈大学) Amazon FAR (Frontier AI & Robotics)(亚马逊前沿人工智能与机器人实验室)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于接触信息的神经动力学模型,通过利用现实数据改进仿真到现实的对齐,提升状态预测和策略优化的准确性。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00332 2026-01-21 cs.AI cs.CE 57%

When Hallucination Costs Millions: Benchmarking AI Agents in High-Stakes Adversarial Financial Markets

当幻觉成本百万:在高风险对抗性金融市场中基准测试AI代理

Zeshi Dai, Zimo Peng, Zerui Cheng, Ryan Yihe Li

机构 * Surf AI, Cybertino Lab(Surf AI,Cybertino 实验室) Princeton University(普林斯顿大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 CAIA基准测试揭示了AI在对抗性金融市场中的能力缺口,指出当前模型在面对虚假信息和不可逆决策时表现不佳,强调对抗鲁棒性对可信AI的重要性。

Comments 15 pages, 5 figures, 4 tables; Accepted to AAAI 2026 (AI-4-Finance Workshop - Oral, top 10%); In submission to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00442 2026-01-21 cs.RO cs.SY eess.SY nlin.AO 57%

Decentralised, Self-Organising Drone Swarms using Coupled Oscillators

去中心化且自组织的无人机群使用耦合振荡器

Kevin Quinn, Cormac Molloy, Harun Šiljak

机构 * EEE Department Trinity College Dublin Dublin, Ireland(电子工程系 三一学院都柏林 爱尔兰)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出利用耦合振荡器实现去中心化且自组织的无人机群,提升灵活性和适应性,同时增强弹性和扩展性。

Comments Accepted for 2025 8th International Balkan Conference on Communications and Networking (Balkancom)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11574 2026-01-19 cs.CV 57%

Evaluating Foundation Models' 3D Understanding Through Multi-View Correspondence Analysis

通过多视角对应分析评估基础模型的3D理解

Valentina Lilova, Toyesh Chakravorty, Julian I. Bibo, Emma Boccaletti, Brandon Li, Lívia Baxová, Cees G. M. Snoek, Mohammadreza Salehi

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出一种无需微调的3D场景理解基准,评估基础模型在多视角下的3D推理能力,展示DINO编码器在大视角变化下的竞争力。

Comments NeurIPS 2025 UniReps workshop, to be published in PMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10592 2026-01-16 cs.CV 57%

Action100M: A Large-scale Video Action Dataset

Action100M:一个大规模视频动作数据集

Delong Chen, Tejaswi Kasarla, Yejin Bang, Mustafa Shukor, Willy Chung, Jade Yu, Allen Bolourchi, Theo Moutakanni, Pascale Fung

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.CV

AI总结 Action100M通过自动化流程生成大规模视频动作数据集,用于提升视频理解和世界建模的可扩展研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08355 2026-01-16 cs.CV 57%

Semantic Misalignment in Vision-Language Models under Perceptual Degradation

视觉-语言模型在感知退化下的语义错位

Guo Cheng

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.CV

AI总结 本研究探讨了视觉-语言模型在感知退化下的语义错位问题,发现传统分割指标的下降并未影响下游行为,揭示了像素鲁棒性与多模态语义可靠性之间的脱节。

Comments 10 pages, 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10143 2026-01-16 cs.AI q-fin.TR 57%

History Is Not Enough: An Adaptive Dataflow System for Financial Time-Series Synthesis

历史并不足够:一种适应性数据流系统用于金融时间序列合成

Haochong Xia, Yao Long Teng, Regan Tan, Molei Qin, Xinrun Wang, Bo An

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学计算机与数据科学学院) School of Computing and Information Systems, Singapore Management University, Singapore(新加坡管理大学计算机与信息系统学院)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 本文提出了一种适应性数据流系统,通过整合机器学习自适应控制,提升金融时间序列合成的鲁棒性和收益表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09652 2026-01-15 cs.CV 57%

AquaFeat+: an Underwater Vision Learning-based Enhancement Method for Object Detection, Classification, and Tracking

AquaFeat+: 一种基于水下视觉学习的增强方法,用于目标检测、分类和跟踪

Emanuel da Costa Silva, Tatiana Taís Schein, José David García Ramos, Eduardo Lawson da Silva, Stephanie Loi Brião, Felipe Gomes de Oliveira, Paulo Lilles Jorge Drews-Jr

机构 * Centro de Ciências Computacionais (C3), Universidade Federal do Rio Grande (FURG), Brazil(巴西里约格兰德联邦大学计算科学研究中心(C3)) Instituto de Ciências Exatas e Tecnologia (ICET), Universidade Federal do Amazonas (UFAM), Brazil(巴西亚马逊联邦大学精确科学与技术研究所(ICET))

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 AquaFeat+是一种基于水下视觉学习的增强方法,通过端到端训练提升目标检测、分类和跟踪的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09287 2026-01-15 cs.CR cs.LG eess.SP 57%

Explainable Autoencoder-Based Anomaly Detection in IEC 61850 GOOSE Networks

基于可解释自动编码器的IEC 61850 GOOSE网络异常检测

Dafne Lozano-Paredes, Luis Bote-Curiel, Juan Ramón Feijóo-Martínez, Ismael Gómez-Talal, José Luis Rojo-Álvarez

机构 * Universidad Rey Juan Carlos(雷奥恩卡洛斯大学) Red Eléctrica (REDEIA Group)(电力公司(REDEIA小组)) Centro de Investigación for Data, Complex Networks and Cybersecurity Sciences(数据、复杂网络和网络安全科学研究中心)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.LG

AI总结 本文提出一种基于可解释自动编码器的IEC 61850 GOOSE网络异常检测框架,通过多视图分析和特征重建实现高检测率与低误报率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09265 2026-01-15 cs.CV 57%

GaussianFluent: Gaussian Simulation for Dynamic Scenes with Mixed Materials

GaussianFluent: 用于混合材料动态场景的高斯模拟

Bei Huang, Yixin Chen, Ruijie Lu, Gang Zeng, Hongbin Zha, Yuru Pei, Siyuan Huang

机构 * State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室) State Key Laboratory of General Artificial Intelligence, BIGAI(北京大学通用人工智能国家重点实验室,BIGAI)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 GaussianFluent通过生成模型和优化的CD-MPM方法,实现了混合材料动态场景的高保真实时渲染和脆性断裂模拟。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12735 2026-01-14 cs.CV 57%

Backdoor Attacks on Open Vocabulary Object Detectors via Multi-Modal Prompt Tuning

通过多模态提示调优对开放词汇目标检测器进行后门攻击

Ankita Raj, Chetan Arora

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 TrAP通过多模态提示调优对开放词汇目标检测器实施后门攻击,利用轻量级提示标记植入恶意行为,提升攻击成功率并改进下游任务性能。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21495 2026-01-14 cs.RO 57%

CLAMP: Crowdsourcing a LArge-scale in-the-wild haptic dataset with an open-source device for Multimodal robot Perception

CLAMP:通过开源设备收集大规模真实场景触觉数据集以实现多模态机器人感知

Pranav N. Thakkar, Shubhangi Sinha, Karan Baijal, Yuhan, Bian, Leah Lackey, Ben Dodson, Heisen Kong, Jueun Kwon, Amber Li, Yifei Hu, Alexios Rekoutis, Tom Silver, Tapomayukh Bhattacharjee

机构 * Cornell University(康奈尔大学) Horace Mann School(霍拉曼学校)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 CLAMP通过开源设备收集大规模真实场景触觉数据集,训练多模态触觉编码器,实现材料识别和机器人操作任务的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14725 2026-01-14 cs.RO cs.HC 57%

Using Mobile AR for Rapid Feasibility Analysis for Deployment of Robots: A Usability Study with Non-Expert Users

利用移动AR进行机器人部署的快速可行性分析:非专家用户的可用性研究

Krzysztof Zielinski, Slawomir Tadeja, Bruce Blumberg, Mikkel Baun Kjærgaard

机构 * Faculty of Engineering, University of Southern Denmark(南部丹麦大学工程学院) Universal Robots A/S(Universal Robots公司) Department of Engineering, University of Cambridge(剑桥大学工程学院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本研究提出了一种基于移动AR的非专家用户可用性工具,用于快速评估机器人部署的可行性,通过实验表明该工具在十分钟内可完成复杂分析,且用户认知负荷低,具有高可用性。

Comments Accepted in IEEE RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07558 2026-01-13 cs.RO 57%

FlyCo: Foundation Model-Empowered Drones for Autonomous 3D Structure Scanning in Open-World Environments

FlyCo:基于基础模型的无人机自主3D结构扫描系统

Chen Feng, Guiyong Zheng, Tengkai Zhuang, Yongqian Wu, Fangzhan He, Haojia Li, Juepeng Zheng, Shaojie Shen, Boyu Zhou

机构 * Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology(香港科技大学电子与计算机工程系) School of Artificial Intelligence, Sun Yat-sen University(中山大学人工智能学院) Department of Mechanical and Energy Engineering, Southern University of Science and Technology(南方科技大学机械与能源工程系) Differential Robotics, Hangzhou, China(杭州差分机器人)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 FlyCo通过整合基础模型实现无人机自主3D扫描,提升开放世界环境下的目标定位与预测效率。

Comments 34 pages, 24 figures, 9 tables. Video: https://www.youtube.com/playlist?list=PLqjZjnqsCyl40rw3y15Yzc7Mdo-z1y2j8

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07186 2026-01-13 cs.RO 57%

PROTEA: Securing Robot Task Planning and Execution

PROTEA:保障机器人任务规划与执行的安全性

Zainab Altaweel, Mohaiminul Al Nahian, Jake Juettner, Adnan Siraj Rakin, Shiqi Zhang

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 PROTEA通过LLM-as-a-Judge机制评估机器人任务计划的安全性,解决维度和历史挑战,提升任务规划系统的鲁棒性和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06573 2026-01-13 cs.AI cs.MM 57%

QMAVIS: Long Video-Audio Understanding using Fusion of Large Multimodal Models

QMAVIS:利用大多模态模型融合实现长视频音频理解

Zixing Lin, Jiale Wang, Gee Wah Ng, Lee Onn Mak, Chan Zhi Yang Jeriel, Jun Yang Lee, Yaohao Li

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University, Singapore(南洋理工大学)

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.AI

AI总结 QMAVIS通过融合大型多模态模型、大型语言模型和语音识别模型,实现了长视频音频理解,展示了在VideoMME数据集上38.75%的性能提升,并在其他数据集上表现出竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01753 2026-01-13 cs.RO eess.SP 57%

AgriLiRa4D: A Multi-Sensor UAV Dataset for Robust SLAM in Challenging Agricultural Fields

AgriLiRa4D:一种多传感器无人机数据集,用于在具有挑战性的农业田间实现鲁棒SLAM

Zhihao Zhan, Yuhang Ming, Shaobin Li, Jie Yuan

机构 * School of Electronic Science and Engineering, Nanjing University(南京大学电子科学与工程学院) TopXGun Robotics(TopXGun机器人公司) School of Computer Science, Hangzhou Dianzi University(杭州电子科技大学计算机科学学院)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 AgriLiRa4D提供多传感器数据集,用于在农业环境中实现鲁棒SLAM,支持多种SLAM研究和评估

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10766 2026-01-13 cs.CV 57%

Expert Consensus-based Video-Based Assessment Tool for Workflow Analysis in Minimally Invasive Colorectal Surgery: Development and Validation of ColoWorkflow

基于专家共识的视频评估工具用于微创结直肠手术的工作流程分析:ColoWorkflow的开发与验证

Pooja P Jain, Pietro Mascagni, Giuseppe Massimiani, Nabani Banik, Marta Goglia, Lorenzo Arboit, Britty Baby, Andrea Balla, Ludovica Baldari, Gianfranco Silecchia, Claudio Fiorillo, CompSurg Colorectal Experts Group, Sergio Alfieri, Salvador Morales-Conde, Deborah S Keller, Luigi Boni, Nicolas Padoy

机构 * University of Strasbourg, CNRS, INSERM, ICube, UMR7357, Strasbourg, France(斯特拉斯堡大学,CNRS,INSERM,ICube,UMR7357,法国斯特拉斯堡) Department of Medical-Surgical Sciences and Translational Medicine, Faculty of Medicine and Psychology, Sapienza University of Rome, Italy(医学与外科科学与转化医学系,医学与心理学学院,罗马萨皮恩扎大学,意大利) University Hospital Virgen Macarena, University of Sevilla, Seville, Spain(圣地亚哥医院,塞维利亚大学,西班牙塞维利亚) Department of General and Minimally Invasive Surgery, Fondazione IRCCS Ca' Granda Ospedale Maggiore Policlinico, Milan, Italy(普通外科与微创外科部门,IRCCS卡格拉奥斯皮奇亚诺医院,米兰,意大利) Arizona State University, Tempe, AZ, USA(亚利桑那州立大学,Tempe,美国亚利桑那)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 ColoWorkflow是一种基于专家共识的视频评估工具,用于微创结直肠手术的工作流程分析,通过标准化培训和提升手术质量。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05491 2026-01-12 cs.RO 57%

Assembling Solar Panels by Dual Robot Arms Towards Full Autonomous Lunar Base Construction

双机械臂组装太阳能板以实现完全自主月球基地建设

Luca Nunziante, Kentaro Uno, Gustavo H. Diaz, Shreya Santra, Alessandro De Luca, Kazuya Yoshida

机构 * Department of Computer, Control and Management Engineering, Sapienza University of Rome(计算机、控制与管理工程系,罗马萨皮恩扎大学) Space Robotics Lab. (SRL) in Department of Aerospace Engineering, Graduate School of Engineering, Tohoku University(航空航天工程系研究生院空间机器人实验室(SRL),东北大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种双机械臂系统,通过视觉、控制和硬件系统的整合,实现了太阳能板模块的自主组装,为月球基地建设提供了关键技术方案。

Comments This is the authors' version of a paper accepted for publication in IEEE/SICE International Symposium on System Integration (SII), 2025, (c) IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05014 2026-01-09 cs.RO 57%

The RoboSense Challenge: Sense Anything, Navigate Anywhere, Adapt Across Platforms

RoboSense挑战:感知一切,导航任何地方,跨平台适应

Lingdong Kong, Shaoyuan Xie, Zeying Gong, Ye Li, Meng Chu, Ao Liang, Yuhao Dong, Tianshuai Hu, Ronghe Qiu, Rong Li, Hanjiang Hu, Dongyue Lu, Wei Yin, Wenhao Ding, Linfeng Li, Hang Song, Wenwei Zhang, Yuexin Ma, Junwei Liang, Zhedong Zheng, Lai Xing Ng, Benoit R. Cottereau, Wei Tsang Ooi, Ziwei Liu, Zhanpeng Zhang, Weichao Qiu, Wei Zhang, Ji Ao, Jiangpeng Zheng, Siyu Wang, Guang Yang, Zihao Zhang, Yu Zhong, Enzhu Gao, Xinhan Zheng, Xueting Wang, Shouming Li, Yunkai Gao, Siming Lan, Mingfei Han, Xing Hu, Dusan Malic, Christian Fruhwirth-Reisinger, Alexander Prutsch, Wei Lin, Samuel Schulter, Horst Possegger, Linfeng Li, Jian Zhao, Zepeng Yang, Yuhang Song, Bojun Lin, Tianle Zhang, Yuchen Yuan, Chi Zhang, Xuelong Li, Youngseok Kim, Sihwan Hwang, Hyeonjun Jeong, Aodi Wu, Xubo Luo, Erjia Xiao, Lingfeng Zhang, Yingbo Tang, Hao Cheng, Renjing Xu, Wenbo Ding, Lei Zhou, Long Chen, Hangjun Ye, Xiaoshuai Hao, Shuangzhi Li, Junlong Shen, Xingyu Li, Hao Ruan, Jinliang Lin, Zhiming Luo, Yu Zang, Cheng Wang, Hanshi Wang, Xijie Gong, Yixiang Yang, Qianli Ma, Zhipeng Zhang, Wenxiang Shi, Jingmeng Zhou, Weijun Zeng, Kexin Xu, Yuchen Zhang, Haoxiang Fu, Ruibin Hu, Yanbiao Ma, Xiyan Feng, Wenbo Zhang, Lu Zhang, Yunzhi Zhuge, Huchuan Lu, You He, Seungjun Yu, Junsung Park, Youngsun Lim, Hyunjung Shim, Faduo Liang, Zihang Wang, Yiming Peng, Guanyu Zong, Xu Li, Binghao Wang, Hao Wei, Yongxin Ma, Yunke Shi, Shuaipeng Liu, Dong Kong, Yongchun Lin, Huitong Yang, Liang Lei, Haoang Li, Xinliang Zhang, Zhiyong Wang, Xiaofeng Wang, Yuxia Fu, Yadan Luo, Djamahl Etchegaray, Yang Li, Congfei Li, Yuxiang Sun, Wenkai Zhu, Wang Xu, Linru Li, Longjie Liao, Jun Yan, Benwu Wang, Xueliang Ren, Xiaoyu Yue, Jixian Zheng, Jinfeng Wu, Shurui Qin, Wei Cong, Yao He

机构 * Technical Committee(技术委员会) Challenge & Workshop Organizers(挑战与研讨会组织者)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 RoboSense 2025挑战通过统一五个研究领域,推动机器人感知在多样化场景下的鲁棒性和适应性,提升真实环境中的感知可靠性与行动稳健性。

Comments Official IROS 2025 RoboSense Challenge Report; 51 pages, 37 figures, 5 tables; Competition Website at https://robosense2025.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07505 2026-01-09 cs.LG 57%

PEAR: Planner-Executor Agent Robustness Benchmark

PEAR:规划-执行代理鲁棒性基准

Shen Dong, Mingxuan Zhang, Pengfei He, Li Ma, Bhavani Thuraisingham, Hui Liu, Yue Xing

机构 * Michigan State University(密歇根州立大学) Purdue University(普渡大学) University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.LG

AI总结 PEAR基准通过评估规划-执行多智能体系统的鲁棒性,揭示了规划器弱点对任务性能的影响及鲁棒性与性能的权衡。

Comments arXiv admin note: This submission has been withdrawn by arXiv administrators due to incorrect authorship. Author list truncated

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03713 2026-01-08 cs.CV 57%

BREATH-VL: Vision-Language-Guided 6-DoF Bronchoscopy Localization via Semantic-Geometric Fusion

BREATH-VL:基于视觉-语言引导的6自由度支气管镜定位:通过语义-几何融合

Qingyao Tian, Bingyu Yang, Huai Liao, Xinyan Huang, Junyong Li, Dong Yi, Hongbin Liu

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Department of Pulmonary and Critical Care Medicine, The First Affiliated Hospital of Sun Yat-sen University(中山大学附属第一医院呼吸与危重症医学科) Centre of AI and Robotics, Hong Kong Institute of Science & Innovation, Chinese Academy of Sciences(香港科学院人工智能与机器人中心) School of Biomedical Engineering and Imaging Sciences, King’s College London(伦敦国王学院生物医学工程与影像科学学院)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 BREATH-VL通过融合语义和几何信息,实现高精度的6自由度支气管镜定位,减少定位误差并提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03447 2026-01-08 cs.RO 57%

Cost-Effective Radar Sensors for Field-Based Water Level Monitoring with Sub-Centimeter Accuracy

用于场基水位监测的低成本雷达传感器(亚厘米级精度)

Anna Zavei-Boroda, J. Toby Minear, Kyle Harlow, Dusty Woods, Christoffer Heckman

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出利用低成本雷达传感器实现亚厘米级水位监测,通过实地测试和统计滤波技术提升精度,为无人机和机器人自主监测提供可行方案。

Comments 10 pages, 6 figures. Preliminary results presented as a poster at an academic conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23412 2026-01-08 cs.AI 57%

MindWatcher: Toward Smarter Multimodal Tool-Integrated Reasoning

MindWatcher:迈向更智能的多模态工具集成推理

Jiawei Chen, Xintian Shen, Lihao Zheng, Zhenwei Shao, Handong Cui, Chaoqun Du, Li Gong, Feng Gu, Xuefeng Hao, Wei He, Jiabang He, Yi Hu, Bin Huang, Shanshan Li, Qizhen Li, Jing Luo, Zide Liu, Xiaobo Liu, Ning Mao, Lifu Mu, Xuhao Pan, Zhiheng Qu, Chang Ren, Xudong Rao, Haoyi Sun, Qian Wang, Shuai Wang, Zhichao Wang, Wei Wang, Lian Wen, Jiqing Zhan, Hongfu Yang, Sheng Yang, Jiajun Yang, Pengfei Yu, Hongyuan Zhang, Bin Zhang, Chunpeng Zhou, Zheng Zhou, Shucheng Zhou, Shuo Xie, Yun Zhu, Hao Ma, Tao Wei, Pan Zhou, Wei Chen

机构 * Li Auto Inc(力汽车公司)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 MindWatcher是一种能够自主调用工具并进行多模态推理的智能体,通过高效训练和高质量数据集提升了多步骤决策任务的性能。

Comments Technique Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16953 2026-01-08 cs.AI cs.LO 57%

Navigating Taxonomic Expansions of Entity Sets Driven by Knowledge Bases

在知识库驱动下导航实体集的分类扩展

Giovanni Amendola, Pietro Cofone, Marco Manna, Aldo Ricioppo

机构 * University of Calabria(卡拉布里亚大学) University of Cyprus(塞浦路斯大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 本文提出了一种基于逻辑的框架,通过扩展图结构实现由知识库驱动的实体集分类扩展,并通过高效推理任务支持局部增量导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19204 2026-01-08 cs.CY cs.AI 57%

Towards the Terminator Economy: Assessing Job Exposure to AI through LLMs

迈向终止经济:通过大语言模型评估工作对AI的暴露

Emilio Colombo, Fabio Mercorio, Mario Mezzanzanica, Antonio Serino

机构 * Dept of International Economics, Institutions and Development, Catholic University of Milan(国际经济学、机构与发展系,米兰天主教大学) Dept of Statistics and Quantitative Methods, University of Milano-Bicocca, Italy(统计与定量方法系,米兰-比科卡大学,意大利) CRISP Research Centre, University of Milano-Bicocca, Italy(CRISP研究中心,米兰-比科卡大学,意大利) Dept of Economics, Management and Statistics, University of Milano-Bicocca(经济学、管理与统计系,米兰-比科卡大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI

AI总结 通过大语言模型评估工作对AI的暴露度,揭示AI对就业和生产力的积极影响及职业间互补性。

Comments 10 pages. Accepted for publication at IJCAI 2025. Final version available at https://doi.org/10.24963/ijcai.2025/1066

Journal ref Proceedings of the 34th International Joint Conference on Artificial Intelligence (IJCAI 2025), article no. 1066

详情

展开后加载摘要…

URL PDF HTML 收藏