arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-02-06 至 2026-02-06 共收录 9 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 9 篇

2406.17835 2026-02-06 cs.LG cs.AI 81%

The Use of AI-Robotic Systems for Scientific Discovery

利用人工智能-机器人系统进行科学发现

Alexander H. Gower, Konstantin Korovin, Daniel Brunnsåker, Filip Kronström, Gabriel K. Reder, Ievgeniia A. Tiukova, Ronald S. Reiserer, John P. Wikswo, Ross D. King

机构 * Chalmers University of Technology(查尔姆斯理工大学) The University of Manchester(曼彻斯特大学) KTH Royal Institute of Technology(皇家理工学院) Vanderbilt University(范德比大学) University of Cambridge(剑桥大学)

专题命中 机器人数据与评测 :robotic(title);robotics(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了人工智能-机器人系统在科学发现中的应用,通过映射机器人科学家的活动到机器学习范式,论证了科学方法与主动学习的相似性,并展示了Genesis系统在系统生物学研究中的应用。

Comments 23 pages, book chapter

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18639 2026-02-06 cs.RO 80%

Constraint-Aware Discrete-Time PID Gain Optimization for Robotic Joint Control Under Actuator Saturation

考虑约束的离散时间PID增益优化用于受执行器饱和影响的机器人关节控制

Ojasva Mishra, Xiaolong Wu, Min Xu

机构 * Downingtown STEM Academy(Downingtown STEM学院) Carnegie Mellon University(卡内基梅隆大学) School of Computer Science(计算机科学学院)

专题命中 机器人数据与评测 :robotic(title);robotics(abstract,comments);分类 cs.RO

AI总结 本文提出了一种考虑约束的离散时间PID增益优化方法,通过混合认证的贝叶斯优化工作流程提升机器人关节控制的鲁棒性。

Comments Pending IEEE Transactions on Robotics Publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05249 2026-02-06 cs.AI 79%

Automatic Cognitive Task Generation for In-Situ Evaluation of Embodied Agents

为在场评估具身智能体而自动产生认知任务

Xinyi He, Ying Yang, Chuanjian Fu, Sihan Guo, Songchun Zhu, Lifeng Fan, Zhenliang Zhang, Yujia Peng

机构 * Peking University(北京大学) State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室) BIGAI

专题命中 机器人数据与评测 :embodied agent(title,abstract);分类 cs.AI

AI总结 本文提出TEA系统,通过动态在场任务生成方法评估具身智能体在未见环境中的能力,揭示模型在基本感知和3D交互方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06038 2026-02-06 cs.RO cs.AI cs.CV cs.LG cs.MA 72%

CommCP: Efficient Multi-Agent Coordination via LLM-Based Communication with Conformal Prediction

CommCP:通过基于大语言模型的通信实现高效的多智能体协调

Xiaopan Zhang, Zejin Wang, Zhixu Li, Jianpeng Yao, Jiachen Li

机构 * Trustworthy Autonomous Systems Laboratory at the University of California, Riverside, CA, USA(加州大学河滨分校可信自主系统实验室)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.AI、cs.CV;robotics(comments)

AI总结 CommCP通过基于大语言模型的通信框架,提升多智能体协作任务的成功率和探索效率。

Comments IEEE International Conference on Robotics and Automation (ICRA 2026); Project Website: https://comm-cp.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05555 2026-02-06 cs.CV cs.RO 62%

IndustryShapes: An RGB-D Benchmark dataset for 6D object pose estimation of industrial assembly components and tools

IndustryShapes: 一个用于工业装配组件和工具6D物体姿态估计的RGB-D基准数据集

Panagiotis Sapoutzoglou, Orestis Vaggelis, Athina Zacharia, Evangelos Sartinas, Maria Pateraki

机构 * National Technical University of Athens(希腊国家技术大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 IndustryShapes是首个提供RGB-D静态上boarding序列的工业装配组件和工具6D姿态估计基准数据集,包含多样化的复杂场景和多模态数据,用于评估实例级和新物体姿态估计方法。

Comments To appear in ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05552 2026-02-06 cs.RO cs.CV 62%

VLN-Pilot: Large Vision-Language Model as an Autonomous Indoor Drone Operator

VLN-Pilot: 大型视觉-语言模型作为自主室内无人机操作员

Bessie Dominguez-Dager, Sergio Suescun-Ferrandiz, Felix Escalona, Francisco Gomez-Donoso, Miguel Cazorla

机构 * University Institute for Compute Research(计算研究大学研究所) University of Alicante(阿利坎特大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 VLN-Pilot利用大型视觉-语言模型实现自主室内无人机导航,通过自然语言指令和视觉感知结合,提高飞行任务的自主性和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05441 2026-02-06 cs.RO cs.AI 62%

Benchmarking Affordance Generalization with BusyBox

通过BusyBox评估具身泛化能力

Dean Fortier, Timothy Adamson, Tess Hellebrekers, Teresa LaScala, Kofi Ennin, Michael Murray, Andrey Kolobov, Galen Mullins

机构 * Microsoft Research(微软研究院) Mississippi State University(密苏里州立大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI

AI总结 本文提出BusyBox基准,用于评估VLA模型在具身泛化能力上的表现,通过模块化设计挑战模型对新物体的操作能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05577 2026-02-06 cs.CV 57%

LocateEdit-Bench: A Benchmark for Instruction-Based Editing Localization

LocateEdit-Bench:基于指令的编辑本地化基准测试

Shiyu Wu, Shuyan Li, Jing Li, Jing Liu, Yequan Wang

机构 * Institute of Automation, Chinese Academy of Sciences, Beijing, China(中国科学院自动化研究所) Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学) School of EEECS, Queen's University Belfast, Northern Ireland, UK(女王大学 Belfast 电子工程与计算机科学学院) Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Peking University, Beijing, China(北京大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 LocateEdit-Bench是一个针对基于指令的编辑本地化问题设计的大规模数据集,整合了四种先进编辑模型,用于评估和推动伪造本地化方法的发展。

Comments 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12972 2026-02-06 cs.HC cs.SE 50%

TaskAudit: Detecting Functiona11ity Errors in Mobile Apps via Agentic Task Execution

TaskAudit: 通过代理任务执行检测移动应用中的功能性错误

Mingyuan Zhong, Xia Chen, Davin Win Kyi, Chen Li, James Fogarty, Jacob O. Wobbrock

专题命中 机器人数据与评测 :navigation(abstract)

AI总结 TaskAudit通过代理任务执行检测移动应用中的功能性错误,识别出更多常见的可访问性问题。

Comments CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏