arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-02-09 至 2026-02-09 共收录 53 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 12 篇

2602.06512 2026-02-09 cs.RO 87%

Beyond the Majority: Long-tail Imitation Learning for Robotic Manipulation

超越多数:用于机器人操作的长尾模仿学习

Junhong Zhu, Ji Zhang, Jingkuan Song, Lianli Gao, Heng Tao Shen

机构 * University of Electronic Science and Technology of China(电子科技大学) Southwest Jiaotong University(西南交通大学) Tongji University(同济大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title);分类 cs.RO;robotics(comments)

AI总结 本文提出APA方法,通过从数据丰富的头部任务迁移知识以提升机器人操作中数据稀缺的尾部任务性能。

Comments accept by IEEE International Conference on Robotics and Automation (ICRA 2026), 8 pages, 6 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01238 2026-02-09 cs.RO cs.AI cs.LG 85%

A Taxonomy for Evaluating Generalist Robot Manipulation Policies

机器人通用操作策略评估的分类

Jensen Gao, Suneel Belkhale, Sudeep Dasari, Ashwin Balakrishna, Dhruv Shah, Dorsa Sadigh

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract,comments);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出STAR-Gen分类,旨在系统化评估机器人操作策略的泛化能力,通过视觉、语义和行为三个维度,结合现实案例研究揭示泛化评估的挑战与改进方向。

Comments IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06504 2026-02-09 cs.RO cs.CV 81%

MultiGraspNet: A Multitask 3D Vision Model for Multi-gripper Robotic Grasping

MultiGraspNet:一种多任务3D视觉模型用于多机械手抓取

Stephany Ortuno-Chanelo, Paolo Rabino, Enrico Civitelli, Tatiana Tommasi, Raffaello Camoriano

机构 * VANDAL Laboratory, Department of Control and Computer Engineering, Politecnico di Torino(沃纳达实验室,控制与计算机工程系,都灵理工大学) Comau S.p.A., Advanced Automation Solutions(Comau S.p.A.,先进自动化解决方案) Istituto Italiano di Tecnologia(意大利技术研究所)

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO、cs.CV

AI总结 MultiGraspNet是一种多任务3D视觉模型,通过统一框架同时预测平行和真空机械手的抓取姿态,提升机器人在复杂环境中的抓取能力和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06572 2026-02-09 cs.RO 79%

The Law of Task-Achieving Body Motion: Axiomatizing Success of Robot Manipulation Actions

任务达成身体运动定律:机器人操作动作成功的公理化规范

Malte Huerkamp, Jonas Dech, Michael Beetz

机构 * AICOR Institute for Artificial Intelligence University of Bremen(人工智能研究所大学不莱梅)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出任务达成身体运动定律,通过公理化规范确保机器人操作动作在语义、因果和可行性方面的正确性,支持运动合成与故障诊断。

Comments 9 pages, 3 figures, submitted to the 2026 International Joint Conference on Artificial Intelligence (IJCAI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06341 2026-02-09 cs.RO 79%

HiWET: Hierarchical World-Frame End-Effector Tracking for Long-Horizon Humanoid Loco-Manipulation

HiWET:分层世界框架末端跟踪用于长周期人形机器人运动与操作

Zhanxiang Cao, Liyun Yan, Yang Zhang, Sirui Chen, Jianming Ma, Tianyue Zhan, Shengcheng Fu, Yufei Jia, Cewu Lu, Yue Gao

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 HiWET通过分层强化学习框架实现世界框架下的精确末端跟踪,结合运动学流形先验提升人形机器人长周期运动与操作的稳定性与精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06243 2026-02-09 cs.RO cs.HC 79%

A Dialogue-Based Human-Robot Interaction Protocol for Wheelchair and Robotic Arm Integrated Control

基于对话的人机交互协议:轮椅与机械臂集成控制

Guangping Liu, Nicholas Hawkins, Billy Madden, Tipu Sultan, Madi Babaiasl

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出一种基于对话的人机交互协议,通过轮椅和机械臂的集成控制提升脊髓损伤和上肢障碍患者的生活质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.06130 2026-02-09 cs.CY cs.SI physics.soc-ph 78%

Quantifying the Vulnerabilities of the Online Public Square to Adversarial Manipulation Tactics

量化在线公共广场对对抗操纵策略的脆弱性

Bao Tran Truong, Xiaodan Lou, Alessandro Flammini, Filippo Menczer

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 研究量化了在线公共广场对对抗操纵策略的脆弱性,发现入侵社区最易导致低质量内容传播,但针对特定目标可缓解影响。

Comments Main text: 22 pages, 7 figures, 103 references. Appendix: 5 pages, 6 figures

Journal ref PNAS Nexus, 3(7): pgae258. 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06653 2026-02-09 cs.RO cs.AI 73%

RAPID: Reconfigurable, Adaptive Platform for Iterative Design

RAPID: 可重构、自适应平台用于迭代设计

Zi Yin, Fanhong Li, Shurui Zheng, Jia Liu

机构 * Zi Yin Fanhong Li Shurui Zheng Jia Liu

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 RAPID通过模块化硬件和软件栈实现机器人操作策略的快速迭代与多模态配置的高效实验

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06395 2026-02-09 cs.CR cs.AI cs.LG 62%

Empirical Analysis of Adversarial Robustness and Explainability Drift in Cybersecurity Classifiers

对抗鲁棒性与可解释性漂移的实证分析:在网络安全分类器中的应用

Mona Rajhans, Vishal Khawarey

机构 * Palo Alto Networks(帕洛阿尔托网络公司) Quicken Inc(Quicken公司)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 本文通过实证研究分析了网络安全分类器中对抗鲁棒性与可解释性漂移的问题,提出鲁棒性指数指标,并展示了对抗训练对提升鲁棒性的效果。

Comments Accepted for publication in 18th ACM International Conference on Agents and Artificial Intelligence (ICAART 2026), Marbella, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11692 2026-02-09 cs.RO cs.CV 62%

FloPE: Flower Pose Estimation for Precision Pollination

FloPE:用于精准传粉的花朵姿态估计

Rashik Shrestha, Madhav Rijal, Trevor Smith, Yu Gu

机构 * West Virginia University(西弗吉尼亚大学)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 FloPE通过3D高斯点划法生成合成数据集,实现低计算成本下的高精度花朵姿态估计,提升机器人传粉效率。

Comments Accepted to IROS 2025. Project page: https://wvu-irl.github.io/flope-irl/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07626 2026-02-09 cond-mat.mes-hall cond-mat.dis-nn cond-mat.quant-gas quant-ph 50%

Tailoring Bound State Geometry in High-Dimensional Non-Hermitian Systems

在高维非厄运系统中定制束缚态几何

Ao Yang, Zixi Fang, Kai Zhang, Chen Fang

专题命中 机器人操作 :manipulation(abstract)

AI总结 在高维非厄运系统中,通过几何依赖的皮肤效应,实现了对束缚态几何结构的调控,使其从凹陷转变为凸起,并为实验操控束缚态提供了理论支持。

Comments 14 pages, 4 figures

Journal ref Commun Phys 8, 124 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06099 2026-02-09 cond-mat.mtrl-sci 50%

Novel non-thermal Ablation Mechanics in the Laser Ablation of Silicon

硅激光烧蚀中的新型非热消融机制

Dominic Klein, Simon Kümmel, Johannes Roth

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过超快激光烧蚀硅,揭示了新型非热消融机制,并利用热尖峰模型和分子动力学模拟,结合激发依赖性的Tersoff势能函数,系统性地构建了硅的激发依赖性相图。

Comments The article has been published in High Performance Computing in Science and Engineering '23, eds. Th. Ludwig, P. Bastian, M.M. Resch, Springer Nature (2026) pages 133-147. Unfortunately, Fig. 2 (b) in the book is wrong due to a typesetting error

Journal ref High Performance Computing in Science and Engineering '23, eds. Th. Ludwig, P. Bastian, M.M. Resch, Springer Nature (2026) pages 133-147

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 15 篇

2602.06459 2026-02-09 cs.RO 83%

User-Centric Object Navigation: A Benchmark with Integrated User Habits for Personalized Embodied Object Search

以用户为中心的对象导航:一个整合用户习惯的基准,用于个性化身体对象搜索

Hongcheng Wang, Jinyu Zhu, Hao Dong

机构 * School of Computer Science, Peking University(北京大学计算机学院) School of Electronics Engineering and Computer Science, Peking University(北京大学电子工程与计算机科学学院)

专题命中 具身导航 :navigation(title,abstract);robotics(abstract);分类 cs.RO

AI总结 本文提出User-Centric Object Navigation基准,通过整合用户习惯提升个性化物体导航性能。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06356 2026-02-09 cs.RO cs.SY eess.SY 83%

Nipping the Drift in the Bud: Retrospective Rectification for Robust Vision-Language Navigation

在源头遏制漂移:面向鲁棒视觉语言导航的回顾性校正

Gang He, Zhenyang Liu, Kepeng Xu, Li Xu, Tong Qiao, Wenxin Yu, Chang Wu, Weiying Xie

机构 * Xidian University(西安电子科技大学) Southwest University of Science and Technology(西南科技大学)

专题命中 具身导航 :navigation(title,abstract);embodied agent(abstract);分类 cs.RO

AI总结 BudVLN通过回顾性校正和决策条件监督合成,有效缓解视觉语言导航中的分布偏移问题,提升鲁棒性与导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06427 2026-02-09 cs.CV cs.RO 81%

Bridging the Indoor-Outdoor Gap: Vision-Centric Instruction-Guided Embodied Navigation for the Last Meters

弥合室内外差距:基于视觉的指令引导的具身导航用于最后几米

Yuxiang Zhao, Yirong Yang, Yanqing Zhu, Yanfen Shen, Chiyu Wang, Zhining Gu, Pei Shi, Wei Guo, Mu Xu

机构 * AMAP CV Lab, Alibaba Group(AMAP CV实验室,阿里巴巴集团)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出了一种无先验的指令驱动具身导航方法,通过视觉引导实现室内外无缝过渡,提升最后一公里配送的导航能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17815 2026-02-09 cs.RO 79%

Less Is More: Scalable Visual Navigation from Limited Data

少即是多:从有限数据实现可扩展的视觉导航

Yves Inglin, Jonas Frey, Changan Chen, Marco Hutter

机构 * ETH Zurich(苏黎世联邦理工学院) Stanford University(斯坦福大学) UC Berkeley(伯克利加州大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出Less is More方法,通过结合有限专家示范与规划器生成的监督,实现高效视觉导航。

Comments v2: Minor text edits, reference formatting fixes, and project page link added

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06380 2026-02-09 cs.RO cs.SY eess.SY 70%

A Consistency-Improved LiDAR-Inertial Bundle Adjustment

改进一致性 的 LiDAR-惯性束调整

Xinran Li, Shuaikang Zheng, Pengcheng Zheng, Xinyang Wang, Jiacheng Li, Zhitian Li, Xudong Zou

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空信息研究所) University of Chinese Academy of Sciences(中国科学院大学) Aerospace Information Technology University(航空信息科技大学) QiLu Aerospace Information Research Institute, Chinese Academy of Sciences(齐鲁航空信息研究所) School of Electronic, Electrical and Communication Engineering(电子电气与通信工程学院)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.RO

AI总结 本文提出改进一致性的 LiDAR-惯性束调整方法,通过定制参数化和估计器提升 SLAM 系统的准确性和可观测性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10204 2026-02-09 cs.RO cs.SY eess.SY 61%

REACT: Real-time Entanglement-Aware Coverage Path Planning for Tethered Underwater Vehicles

REACT:用于系留水下机器人的实时纠缠感知覆盖路径规划

Abdelhakim Amer, Mohit Mehindratta, Yury Brodskiy, Bilal Wehbe, Erdal Kayacan

机构 * Artificial Intelligence in Robotics Laboratory (AiR Lab), Department of Electrical and Computer Engineering, Aarhus University(人工智能机器人实验室(AiR实验室),电气与计算机工程系,阿arhus大学) NestAI EIVA a/s(EIVA公司) Deutsches Forschungszentrum für Künstliche Intelligenz GmbH (DFKI)(德国人工智能研究中心(DFKI)) Automatic Control Group, Department of Electrical Engineering and Information Technology, Paderborn University(自动控制组,电气工程与信息科技系,帕德博恩大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO;robotics(comments)

AI总结 REACT通过实时纠缠感知覆盖路径规划,实现了安全高效的水下结构检查,比传统方法快20%完成任务。

Comments Accepted for publication at International Conference on Robotics & Automation 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06405 2026-02-09 cs.CV cs.NE 57%

A neuromorphic model of the insect visual system for natural image processing

一种用于自然图像处理的昆虫视觉系统类脑模型

Adam D. Hines, Karin Nordström, Andrew B. Barron

机构 * School of Natural Sciences, Macquarie University(麦考瑞大学自然科学学院) QUT Centre for Robotics, Queensland University of Technology(昆士兰科技大学机器人中心) College of Medicine and Public Health, Flinders University(弗林德斯大学医学院与公共卫生学院)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 本文提出了一种生物启发的昆虫视觉系统类脑模型,通过自监督对比学习实现稀疏表示学习,适用于自然图像处理和花卉识别任务。

Comments 21 pages, 7 figures, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22894 2026-02-09 cs.CR cs.AI 57%

DECEPTICON: How Dark Patterns Manipulate Web Agents

DECEPTICON:暗模式如何操纵网络代理

Phil Cuvin, Hao Zhu, Diyi Yang

机构 * Stanford University(斯坦福大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 DECEPTICON研究揭示暗模式通过引导代理轨迹对网络代理构成重大风险,表明需加强防御措施以应对操纵性设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02735 2026-02-09 cs.CR cs.AI 57%

Meta SecAlign: A Secure Foundation LLM Against Prompt Injection Attacks

Meta SecAlign: 一种针对提示注入攻击的 secure LLM 基础

Sizhe Chen, Arman Zharmagambetov, David Wagner, Chuan Guo

机构 * FAIR at Meta(Meta 的 FAIR 部门) UC Berkeley(加州大学伯克利分校)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 Meta SecAlign 是首个开源的 LLM,具备内置的模型级防御,实现了商业级性能,且在复杂代理任务中表现优异,同时在提示注入攻击中展现出更高的安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06647 2026-02-09 cs.CL eess.AS 50%

Reading Between the Waves: Robust Topic Segmentation Using Inter-Sentence Audio Features

在波涛间阅读:利用跨句音频特征实现鲁棒性话题分割

Steffen Freisinger, Philipp Seeberger, Tobias Bocklet, Korbinian Riedhammer

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出利用跨句音频特征进行鲁棒性话题分割,通过多模态方法提升分割性能,并在多个数据集上验证了其有效性。

Comments Accepted to IEEE ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06618 2026-02-09 eess.SY cs.SY 50%

Structured Learning for Electromagnetic Field Modeling and Real-Time Inversion

结构化学习用于电磁场建模与实时反演

Antonio Bernardes, Jasan Zughaibi, Michael Muehlebach, Bradley J. Nelson

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出基于多层感知机的结构化学习方法,用于高精度电磁场建模与实时反演,实现了快速闭合形式的最小范数反演,提升了复杂系统中的磁控制性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06517 2026-02-09 physics.soc-ph 50%

Smart On-Street Parking: Survey of Actual Implementations in Cities and Insights from Practitioners

智能街边停车:全球城市中的实际实施调查与从业者洞察

Enock Ndunda, Alexandre Nicolas

专题命中 具身导航 :navigation(abstract)

AI总结 本文调查了全球25个智能停车实施案例,分析了技术选择、实施规模及目标差异,指出硬件耐用性和政治意愿影响实施效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06472 2026-02-09 math.OC 50%

Distributed Circumferential Coverage Control in Non-Convex Annulus Environments

非凸环形区域中分布式周向覆盖控制

Chao Zhai

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出了一种分布式周向覆盖控制方法,通过构建黎曼度量和虚拟分区杆实现非凸环形区域的负载均衡与覆盖控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06376 2026-02-09 eess.SP 50%

Xona Pulsar Single-Satellite Positioning: System Perspective and Experimental Validation

Xona Pulsar 单卫星定位:系统视角与实验验证

Thyagaraja Marathe, Tyler G. R. Reid, Srinivas Tantry, Michael O'Meara

专题命中 具身导航 :navigation(abstract)

AI总结 Xona Pulsar 系统通过单卫星定位技术实现资源受限环境下的高精度导航,无需外部辅助,适用于城市峡谷等复杂场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05151 2026-02-09 physics.optics physics.app-ph 50%

Self-aligned optical microcomb emerging between octave separated lasers

自对准的光学微梳在八度分离激光之间形成

Grégory Moille, Pradyoth Shandilya, Jordan Stone, River Beard, Shao-Chien Ou, Zongda Li, Mark Harrington, Kaikai Liu, Robert Rockmore, Curtis R. Menyuk, Daniel J. Blumenthal, Sean P. Krzyzewski, Miro Erkintalo, Kartik Srinivasan

专题命中 具身导航 :navigation(abstract)

AI总结 通过自对准架构,利用八度分离激光在集成谐振器中生成强低噪声微梳,实现紧凑光学频率合成、毫米波生成和时钟读取。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身推理 4 篇

2602.06949 2026-02-09 cs.RO cs.AI cs.CV cs.LG 85%

DreamDojo: A Generalist Robot World Model from Large-Scale Human Videos

DreamDojo:从大规模人类视频中学习通用机器人世界模型

Shenyuan Gao, William Liang, Kaiyuan Zheng, Ayaan Malik, Seonghyeon Ye, Sihyun Yu, Wei-Cheng Tseng, Yuzhu Dong, Kaichun Mo, Chen-Hsuan Lin, Qianli Ma, Seungjun Nah, Loic Magne, Jiannan Xiang, Yuqi Xie, Ruijie Zheng, Dantong Niu, You Liang Tan, K. R. Zentner, George Kurian, Suneel Indupuru, Pooya Jannaty, Jinwei Gu, Jun Zhang, Jitendra Malik, Pieter Abbeel, Ming-Yu Liu, Yuke Zhu, Joel Jang, Linxi "Jim" Fan

机构 * NVIDIA HKUST(香港科技大学) UC Berkeley(加州大学伯克利分校) Stanford(斯坦福大学) KAIST(韩国科学技术院) UofT(多伦多大学) UCSD(加州大学圣地亚哥分校) UT Austin(德克萨斯大学奥斯汀分校)

专题命中 具身推理 :world model(title,abstract);robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 DreamDojo通过大规模人类视频学习通用机器人世界模型,解决动作标签稀缺问题,实现高精度物理理解和实时交互。

Comments Project page: https://dreamdojo-world.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06923 2026-02-09 cs.LG cs.AI physics.class-ph 81%

From Kepler to Newton: Inductive Biases Guide Learned World Models in Transformers

从开普勒到牛顿:归纳偏置引导变换器中的学习世界模型

Ziming Liu, Sophia Sanborn, Surya Ganguli, Andreas Tolias

机构 * Stanford University(斯坦福大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文通过引入归纳偏置,使通用变换器能够学习世界模型,从开普勒到牛顿,实现从曲线拟合到物理定律发现的转变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06521 2026-02-09 cs.CV cs.RO 81%

DriveWorld-VLA: Unified Latent-Space World Modeling with Vision-Language-Action for Autonomous Driving

DriveWorld-VLA: 基于视觉-语言-动作的统一潜在空间世界建模用于自动驾驶

Feiyang jia, Lin Liu, Ziying Song, Caiyan Jia, Hangjun Ye, Xiaoshuai Hao, Long Chen

机构 * School of Computer Science(计算机科学学院) Beijing Key Laboratory of Traffic Data Mining(交通数据挖掘重点实验室) Beijing Jiaotong University(北京交通大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.RO、cs.CV

AI总结 DriveWorld-VLA通过统一视觉-语言-动作与潜在空间世界建模,提升自动驾驶中的决策与前瞻性想象能力。

Comments 20 pages, 7 tables, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏