arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-02-17 至 2026-02-17 共收录 21 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 21 篇

2601.02456 2026-02-17 cs.RO 89%

InternVLA-A1: Unifying Understanding, Generation and Action for Robotic Manipulation

InternVLA-A1:统一理解、生成和行动以实现机器人操作

Junhao Cai, Zetao Cai, Jiafei Cao, Yilun Chen, Zeyu He, Lei Jiang, Hang Li, Hengjie Li, Yang Li, Yufei Liu, Yanan Lu, Qi Lv, Haoxiang Ma, Jiangmiao Pang, Yu Qiao, Zherui Qiu, Yanqing Shen, Xu Shi, Yang Tian, Bolun Wang, Hanqing Wang, Jiaheng Wang, Tai Wang, Xueyuan Wei, Chao Wu, Yiman Xie, Boyang Xing, Yuqiang Yang, Yuyin Yang, Qiaojun Yu, Feng Yuan, Jia Zeng, Jingjing Zhang, Shenghan Zhang, Shi Zhang, Zhuoma Zhaxi, Bowen Zhou, Yuanzhen Zhou, Yunsong Zhou, Hongrui Zhu, Yangkun Zhu, Yuchen Zhu

机构 * InternVLA-A1 Team(InternVLA-A1团队)

专题命中 机器人数据与评测 :manipulation(title,abstract);robotic(title,abstract);world model(abstract);分类 cs.RO

AI总结 InternVLA-A1通过统一的Transformer架构,结合语义理解和动态预测能力,提升了机器人操作任务的性能。

Comments Homepage: https://internrobotics.github.io/internvla-a1.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14721 2026-02-17 cs.AI 79%

WebWorld: A Large-Scale World Model for Web Agent Training

WebWorld: 一个大规模的世界模型用于网络代理训练

Zikai Xiao, Jianhong Tu, Chuhang Zou, Yuxin Zuo, Zhi Li, Peng Wang, Bowen Yu, Fei Huang, Junyang Lin, Zuozhu Liu

机构 * Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学)

专题命中 机器人数据与评测 :world model(title,abstract);分类 cs.AI

AI总结 WebWorld是一个大规模开放网络模拟器,通过大规模训练实现网络代理的有效训练,展示了在多个领域中的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14174 2026-02-17 cs.RO 79%

Direction Matters: Learning Force Direction Enables Sim-to-Real Contact-Rich Manipulation

方向至关重要:学习力的方向使模拟到现实的接触丰富操作成为可能

Yifei Yang, Anzhe Chen, Zhenjie Zhu, Kechun Xu, Yunxuan Mao, Yufei Wei, Lu Chen, Rong Xiong, Yue Wang

机构 * Zhejiang University(浙江大学) Zhejiang Humanoid Robot Innovation Center(浙江人形机器人创新中心)

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出了一种通过学习力方向来提升模拟到现实接触丰富操作性能的方法,利用专家设计的控制器逻辑和有限状态机,在四个真实任务中实现了更高的成功率和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13999 2026-02-17 cs.RO 79%

It Takes Two to Tango: A Holistic Simulator for Joint Order Scheduling and Multi-Agent Path Finding in Robotic Warehouses

双人探戈也需要两人:一种综合模拟器用于机器人仓库中的联合订单调度和多智能体路径寻找

Haozheng Xu, Wenhao Li, Zifan Wei, Bo Jin, Hongxing Bai, Ben Yang, Xiangfeng Wang

机构 * East China Normal University(东华大学) Tongji University(同济大学) Zhejiang Galaxis Technology Group Co.,Ltd(浙江伽利西科技集团有限公司) Shenzhen Loop Area Institute (SLAI)(深圳环 area 研究院)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 WareRover是一种综合模拟器,通过闭环优化接口紧密耦合订单调度与多智能体路径寻找,为机器人仓库的鲁棒协调提供挑战性测试环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13844 2026-02-17 cs.CV 79%

Synthetic Dataset Generation and Validation for Robotic Surgery Instrument Segmentation

用于机器人手术器械分割的合成数据集生成与验证

Giorgio Chiesa, Rossella Borra, Vittorio Lauro, Sabrina De Cillis, Daniele Amparore, Cristian Fiori, Riccardo Renzulli, Marco Grangetto

机构 * University of Turin, Italy(都灵大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.CV

AI总结 本文提出了一种生成和验证用于机器人手术器械分割的合成数据集的方法,通过自动化流程生成逼真数据,并验证其在模型训练中的有效性。

Comments Accepted at ISBI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13833 2026-02-17 cs.RO 79%

Semantic-Contact Fields for Category-Level Generalizable Tactile Tool Manipulation

语义接触场用于类别级可泛化的触觉工具操作

Kevin Yuchen Ma, Heng Zhang, Weisi Lin, Mike Zheng Shou, Yan Wu

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.RO

AI总结 SCFields通过融合视觉语义与密集接触估计,实现类别级可泛化的触觉工具操作,显著优于视觉和原始触觉基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01389 2026-02-17 cs.RO 79%

Instance-Guided Unsupervised Domain Adaptation for Robotic Semantic Segmentation

实例引导的无监督领域适应用于机器人语义分割

Michele Antonazzi, Lorenzo Signorelli, Matteo Luperto, Nicola Basilico

机构 * Department of Computer Science, University of Milan(计算机科学系,米兰大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出了一种实例引导的无监督领域适应方法,通过生成多视图一致的伪标签并利用基础模型进行细化,提升机器人语义分割的适应性能。

Comments Accepted for publication at ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00527 2026-02-17 cs.RO 79%

DeCo: Task Decomposition and Skill Composition for Zero-Shot Generalization in Long-Horizon 3D Manipulation

DeCo:用于长周期3D操作零样本泛化任务分解与技能组合

Zixuan Chen, Junhui Yin, Yangtao Chen, Jing Huo, Pinzhuo Tian, Jieqi Shi, Yiwen Hou, Yinchuan Li, Yang Gao

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院) School of Computing, National University of Singapore(新加坡国立大学计算机学院) Huawei Noah’s Ark Lab (AI Lab), China(华为诺亚实验室(AI实验室))

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.RO

AI总结 DeCo通过任务分解与技能组合提升长周期3D操作任务的零样本泛化能力,显著提高多个模型在新任务上的成功率。

Comments RAL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13252 2026-02-17 cs.RO cs.NI 79%

DORA: Dataflow Oriented Robotic Architecture

面向数据流的机器人架构

Xiaodong Zhang, Baorui Lv, Xavier Tao, Xiong Wang, Jie Bao, Yong He, Yue Chen, Zijiang Yang

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 DORA通过显式数据依赖规范和零拷贝传输,提升机器人系统在数据密集型任务中的通信效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11526 2026-02-17 cs.RO cs.AI 73%

Foundation Models in Autonomous Driving: A Survey on Scenario Generation and Scenario Analysis

自动驾驶中的基础模型:场景生成与场景分析的综述

Yuan Gao, Mattia Piccinini, Yuchen Zhang, Dingrui Wang, Korbinian Moller, Roberto Brusnicki, Baha Zarrouki, Alessio Gambi, Jan Frederik Totz, Kai Storms, Steven Peters, Andrea Stocco, Bassam Alrifaee, Marco Pavone, Johannes Betz

专题命中 机器人数据与评测 :navigation(abstract);world model(abstract);分类 cs.RO、cs.AI

AI总结 本文综述了基础模型在自动驾驶场景生成与分析中的应用,探讨了相关模型、方法及挑战。

Comments IEEE Open Journal of Intelligent Transportation Systems

Journal ref IEEE Open Journal of Intelligent Transportation Systems, 03 February 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13806 2026-02-17 cs.CV cs.RO 73%

Gaussian Sequences with Multi-Scale Dynamics for 4D Reconstruction from Monocular Casual Videos

具有多尺度动态的高斯序列用于从单目随意视频中进行4D重建

Can Li, Jie Gu, Jingmin Chen, Fangzhou Qiu, Lei Sun

机构 * Nankai University(南开大学) Rightly Robotics

专题命中 机器人数据与评测 :robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出了一种基于多尺度动态的高斯序列方法,用于从单目随意视频中实现准确且一致的4D重建,通过多级运动组合和多模态先验约束提升重建保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04955 2026-02-17 cs.RO cs.AI 73%

Experimental Evaluation of ROS-Causal in Real-World Human-Robot Spatial Interaction Scenarios

在真实人类-机器人空间交互场景中对ROS-Causal的实验评估

Luca Castri, Gloria Beraldo, Sariah Mghames, Marc Hanheide, Nicola Bellotto

机构 * School of Computer Science, University of Lincoln, UK(林肯大学计算机科学学院) Dept. of Information Engineering, University of Padua, Italy(帕多瓦大学信息工程系) National Research Council of Italy(意大利国家研究理事会)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本研究评估了ROS-Causal框架在真实人类-机器人空间交互场景中的性能,通过模拟和实验室实验验证其在因果发现和机器人部署中的有效性。

Comments Published at 2024 IEEE International Conference on Robot and Human Interactive Communication (RO-MAN)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04641 2026-02-17 cs.CV cs.AI cs.LG 67%

Simulating the Real World: A Unified Survey of Multimodal Generative Models

模拟现实世界:多模态生成模型的统一综述

Yuqi Hu, Longguang Wang, Xian Liu, Ling-Hao Chen, Yuwei Guo, Yukai Shi, Ce Liu, Anyi Rao, Zeyu Wang, Hui Xiong

机构 * Thrust of Artificial Intelligence, The Hong Kong University of Science and Technology (Guangzhou)(人工智能前沿技术研究所,香港科学与技术大学(广州)) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology Hong Kong SAR(计算机科学与工程系,香港科学与技术大学香港特别行政区) MMLab, The Hong Kong University of Science and Technology(多模态实验室,香港科学与技术大学) School of Electronics and Communication Engineering, Shenzhen Campus of Sun Yat-sen University(电子与通信工程学院,中山大学深圳校区) The Chinese University of Hong Kong, Hong Kong, China(香港中文大学,香港,中国) Tsinghua University, Guangdong, China(清华大学,广东,中国) Bosch (China) Investment Co., Ltd., Shanghai, China(博世(中国)投资有限公司,上海,中国)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文首次系统性地统一研究了2D、视频、3D和4D生成,为多模态生成模型和现实世界模拟提供了统一框架的综述。

Comments Repository for the related papers at https://github.com/ALEEEHU/World-Simulator

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13440 2026-02-17 cs.CV cs.RO 66%

Learning on the Fly: Replay-Based Continual Object Perception for Indoor Drones

实时学习:基于回放的连续物体感知用于室内无人机

Sebastian-Ion Nae, Mihai-Eugen Barbu, Sebastian Mocanu, Marius Leordeanu

机构 * National University of Science and Technology Politehnica Bucharest, Romania(罗马尼亚布加勒斯特多项技术大学) Institute of Mathematics ``Simion Stoilow'' of the Romanian Academy, Romania(罗马尼亚科学院模拟昂斯数学研究所) NORCE Norwegian Research Center, Norway(挪威NORCE研究中心)

专题命中 机器人数据与评测 :robotics(abstract,comments);分类 cs.RO、cs.CV

AI总结 本研究提出基于回放的连续学习方法,通过室内无人机视频数据集评估,证明在有限内存预算下FAR方法能有效提升物体感知性能。

Comments Accepted at European Robotics Forum (ERF) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12763 2026-02-17 cs.CV cs.LG 62%

A Survey on Human Interaction Motion Generation

人类交互运动生成的综述

Kewei Sui, Anindita Ghosh, Inwoo Hwang, Bing Zhou, Jian Wang, Chuan Guo

机构 * Snap Inc. Saarland Informatics Campus, DFKI, MPI Informatics(萨尔兰州信息学校区、DFKI、MPI信息学) Seoul National University(首尔国立大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV、cs.LG

AI总结 本文综述了人类交互运动生成领域的研究,系统回顾了现有方法、数据集及评估指标,并探讨了未来研究方向。

Comments The repository listing relevant papers is accessible at: https://github.com/soraproducer/Awesome-Human-Interaction-Motion-Generation

Journal ref International Journal of Computer Vision, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13900 2026-02-17 cs.RO 57%

UAV-SEAD: State Estimation Anomaly Dataset for UAVs

UAV-SEAD:无人机状态估计异常数据集

Aykut Kabaoglu, Sanem Sariel

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 UAV-SEAD数据集通过真实飞行日志提升无人机状态估计异常检测研究

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11079 2026-02-17 cs.AI 57%

ARCTraj: A Dataset and Benchmark of Human Reasoning Trajectories for Abstract Problem Solving

ARCTraj:抽象问题解决中人类推理轨迹的数据集和基准

Sejin Kim, Hayan Choi, Seokki Lee, Sundong Kim

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI

AI总结 ARCTraj通过记录人类推理轨迹,提供了一种结构化且可解释的框架,用于研究抽象问题解决中的推理过程,推动可解释性和可推广智能的发展。

Comments KDD 2026 (Datasets and Benchmarks) accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02356 2026-02-17 cs.CR cs.AI 57%

Measuring Physical-World Privacy Awareness of Large Language Models: An Evaluation Benchmark

评估大型语言模型的物理世界隐私意识:一种评估基准

Xinjie Shen, Mufei Li, Pan Li

机构 * Georgia Tech(佐治亚理工学院)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.AI

AI总结 EAPrivacy评估基准揭示大型语言模型在物理世界隐私意识方面存在严重缺陷,需更稳健的物理感知对齐。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02873 2026-02-17 cs.AI 57%

It's the Thought that Counts: Evaluating the Attempts of Frontier LLMs to Persuade on Harmful Topics

想法才是关键:评估前沿大语言模型在有害话题上的说服尝试

Matthew Kowal, Jasper Timm, Jean-Francois Godbout, Thomas Costello, Antonio A. Arechar, Gordon Pennycook, David Rand, Adam Gleave, Kellin Pelrine

机构 * Université de Montréal, MILA(蒙特利尔大学,MILA) Carnegie Mellon University(卡内基梅隆大学) MIT, Center for Research and Teaching in Economics(麻省理工学院,经济研究与教学中心) Cornell University, University of Regina(康奈尔大学, Regina大学) Cornell University, MIT(康奈尔大学,麻省理工学院)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 本文提出APE基准测试,评估前沿大语言模型在有害话题上的说服意愿,揭示模型在有害情境下尝试说服的倾向及风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13656 2026-02-17 cs.RO 57%

A Kung Fu Athlete Bot That Can Do It All Day: Highly Dynamic, Balance-Challenging Motion Dataset and Autonomous Fall-Resilient Tracking

一个全天候的功夫运动员机器人:高度动态、平衡挑战性的动作数据集和自主防跌跟踪

Zhongxiang Lei, Lulu Cao, Xuyang Wang, Tianyi Qian, Jinyan Liu, Xuesong Li

机构 * Beijing Institute of Technology(北京理工大学) QIYUAN Lab(启元实验室)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出KungFuAthlete数据集,通过高动态武术动作训练视频,结合单策略学习实现运动跟踪与跌倒恢复,提升人形机器人在高动态环境中的自主性和鲁棒性。

Comments 18 pages, 8 figures,5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17168 2026-02-17 cs.NE cs.AI 57%

Enabling Population-Level Parallelism in Tree-Based Genetic Programming for GPU Acceleration

在GPU加速中实现基于树的遗传编程的群体级并行性

Zhihong Wu, Lishuang Wang, Kebin Sun, Zhuozhao Li, Ran Cheng

机构 * Department of Computer Science and Engineering, Southern University of Science and Technology(计算机科学与工程系,南方科技大学) Department of Data Science and Artificial Intelligence, and the Department of Computing, The Hong Kong Polytechnic University(数据科学与人工智能系及计算系,香港理工大学) The Hong Kong Polytechnic University Shenzhen Research Institute(香港理工大学深圳研究院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.AI

AI总结 EvoGP通过群体级并行执行实现基于树的遗传编程在GPU加速中的高效执行,提供高吞吐量和改进的可扩展性。

Comments Accepted by IEEE TEVC

详情

展开后加载摘要…

URL PDF HTML 收藏