arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-01-29 至 2026-01-29 共收录 42 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 15 篇

2601.20555 2026-01-29 cs.RO eess.SP 85%

Vibro-Sense: Robust Vibration-based Impulse Response Localization and Trajectory Tracking for Robotic Hands

Vibro-Sense: 机器人手部基于振动的冲击响应定位与轨迹跟踪的鲁棒方法

Wadhah Zai El Amri, Nicolás Navarro-Guerrero

机构 * Leibniz Universität Hannover(莱比锡洪堡大学) L3S Research Center(L3S研究中心)

专题命中 机器人操作 :robotic(title,abstract);robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 Vibro-Sense通过低成本振动声学传感实现机器人手部的高精度触觉定位与轨迹跟踪,展示了复杂物理接触动态的有效解码方法。

Comments Under Review: Springer Autonomous Robots Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20452 2026-01-29 econ.GN physics.soc-ph q-fin.EC q-fin.TR 78%

Manipulation in Prediction Markets: An Agent-based Modeling Experiment

预测市场中的操控:基于代理的建模实验

Bridget Smart, Ebba Mark, Anne Bastian, Josefina Waugh

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 该研究通过基于代理的模拟实验,探讨了高预算代理如何在预测市场中引入价格扭曲,并分析了市场中从众行为和学习率对价格波动的影响。

Comments Open source code for the agent-based model and Dash application available at https://github.com/ebbam/power_prediction/ 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01052 2026-01-29 cs.RO 77%

Autonomous Grasping On Quadruped Robot With Task Level Interaction

四足机器人上的自主抓取与任务级交互

Muhtadin, Mochammad Hilmi Rusydiansyah, Mauridhi Hery Purnomo, I Ketut Eddy Purnama, Chastine Fatichah

机构 * Department of Electrical Engineering, Institut Teknologi Sepuluh Nopember, Surabaya, Indonesia(电气工程系,十月份十号技术大学,Surabaya,印度尼西亚) Department of Computer Engineering, Institut Teknologi Sepuluh Nopember, Surabaya, Indonesia(计算机工程系,十月份十号技术大学,Surabaya,印度尼西亚) Department of Informatics, Institut Teknologi Sepuluh Nopember, Surabaya, Indonesia(信息系,十月份十号技术大学,Surabaya,印度尼西亚)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本研究提出一种基于任务级交互的四足机器人自主抓取系统,通过硬件集成、分层控制和网络界面实现导航、物体检测和抓取任务,实验表明其在真实环境中的抓取成功率高达75%。

Comments This work has been submitted to the IEEE for possible publication

Journal ref 2025 International Conference on Computer Engineering, Network and Intelligent Multimedia (CENIM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20776 2026-01-29 cs.RO 70%

Learning From a Steady Hand: A Weakly Supervised Agent for Robot Assistance under Microscopy

从稳定的手学习:一种弱监督的机器人助手用于显微镜下的机器人辅助

Huanyu Tian, Martin Huber, Lingyun Zeng, Zhe Han, Wayne Bennett, Giuseppe Silvestri, Gerardo Mendizabal-Ruiz, Tom Vercauteren, Alejandro Chavez-Badiola, Christos Bergeles

机构 * School of Biomedical Engineering & Imaging Sciences, King’s College London(生物医学工程与成像科学学院,伦敦国王学院)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出了一种弱监督的机器人助手,通过融合校准感知与阻抗控制,提升了显微镜下生物医学微操作的精度和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20262 2026-01-29 cs.RO 70%

Shallow-π: Knowledge Distillation for Flow-based VLAs

Shallow-π:基于流的视觉-语言-动作模型的知识蒸馏

Boseong Jeon, Yunho Choi, Taehan Kim

机构 * Samsung Research South Korea(三星韩国研究)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 Shallow-π通过知识蒸馏显著减少基于流的VLA模型的transformer深度,实现更快的推理速度和更高的性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19972 2026-01-29 cs.RO 70%

Just in time Informed Trees: Manipulability-Aware Asymptotically Optimized Motion Planning

及时知情树:面向可 manipulability 的渐进优化运动规划

Kuanqi Cai, Liding Zhang, Xinwen Su, Kejia Chen, Chaoqun Wang, Sami Haddadin, Alois Knoll, Arash Ajoudani, Luis Figueredo

机构 * Human-Robot Interfaces and Interaction(HRI2), Istituto Italiano Di Tecnologia (IIT)(人机交互(HRI2),意大利技术研究所(IIT)) Swiss Federal Technology Institute of Lausanne (EPFL)(洛桑联邦理工学院(EPFL)) Technical University of Munich(慕尼黑技术大学) School of Control Science and Engineering, Shandong University(控制科学与工程学院,山东大学) School of Computer Science, University of Nottingham, UK(计算机科学学院,诺丁汉大学(英国))

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 JIT*算法通过两个核心模块提升运动规划效率,优化路径发现并减少奇异点风险,适用于高维机器人路径规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23530 2026-01-29 cs.SD cs.AI cs.LG eess.AS 62%

Learning Linearity in Audio Consistency Autoencoders via Implicit Regularization

通过隐式正则化在音频一致性自编码器中学习线性性

Bernardo Torres, Manuel Moussallam, Gabriel Meseguer-Brocal

机构 * LTCI, Telecom Paris, Institut Polytechnique de Paris(LTCI,电信巴黎,巴黎高等理工学院) Deezer Research(Deezer研究)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 通过隐式正则化在音频一致性自编码器中诱导线性性,实现更直观高效的音频处理

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20682 2026-01-29 cs.RO 57%

Tendon-based modelling, estimation and control for a simulated high-DoF anthropomorphic hand model

基于肌腱的建模、估计与控制方法用于模拟的高自由度仿人手模型

Péter Polcz, Katalin Schäffer, Miklós Koller

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于肌腱的仿人手估计与控制方法,通过非线性优化和雅可比控制器实现手势跟踪,无需直接关节传感。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20425 2026-01-29 cs.CV 57%

Quartet of Diffusions: Structure-Aware Point Cloud Generation through Part and Symmetry Guidance

四重扩散:通过部件和对称性指导的结构感知点云生成

Chenliang Zhou, Fangcheng Zhong, Weihao Xia, Albert Miao, Canberk Baykal, Cengiz Oztireli

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 四重扩散通过部件和对称性指导,实现了结构感知的点云生成,首次在生成过程中整合并强制执行对称性和部件先验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20850 2026-01-29 cond-mat.supr-con cond-mat.mtrl-sci 50%

Field induced superconductivity in a magnetically doped two-dimensional crystal

磁场诱导二维晶体中的超导性

Adrian Llanos, Veronica Show, Reiley Dorrian, Joseph Falson

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过二维晶体中的磁性杂质与磁场相互作用,实现了磁场诱导超导性,并揭示了低温下磁性杂质调控的竞争配对机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20703 2026-01-29 cond-mat.mtrl-sci 50%

Manipulating ferroelectricity without electrical bias: A perspective

无需电偏置操控铁电性:一种观点

Bixin Yan, Valentine Gillioz, Ipek Efe, Morgan Trassin

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文探讨无需电偏置操控铁电性,通过化学工程表面贡献、机械压力与flexoelectricity结合,提出极化状态调控的新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20184 2026-01-29 cs.CR cs.DC 50%

Securing AI Agents in Cyber-Physical Systems: A Survey of Environmental Interactions, Deepfake Threats, and Defenses

在物理信息系统中保障AI代理:环境交互、深度伪造威胁及防御的综述

Mohsen Hatami, Van Tuan Pham, Hozefa Lakadawala, Yu Chen

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文综述了物理信息系统中AI代理的安全威胁,重点分析了环境交互、深度伪造攻击及MCP漏洞,并提出基于SENTINEL框架的防御策略与挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19982 2026-01-29 hep-ph cs.SC hep-th 50%

FORM Version 5.0

FORM 版本 5.0

J. Davies, T. Kaneko, C. Marinissen, T. Ueda, J. A. M. Vermaseren

专题命中 机器人操作 :manipulation(abstract)

AI总结 FORM 5.0 通过集成图生成器、高精度浮点支持和 FLINT 库接口,提升了符号运算与数值计算的性能与功能。

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19968 2026-01-29 cs.CR 50%

What is the AGI in Offensive Security ?

进攻性安全中的AGI是什么?

Youngwoong Cho

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文探讨进攻性安全中的AGI,提出将任务归结为符号语言操作,并通过状态机和符号代理模型分析交互编码问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19486 2026-01-29 physics.app-ph physics.optics 50%

Engineering Spatial Dispersion to Synthesize Arbitrary Spatial Filters Based on Metagratings

工程空间色散以基于超构格栅合成任意空间滤波器

Jinyong Kim, Minseok Kim

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出利用非均匀超构格栅工程化空间色散,实现任意空间滤波器的高效合成。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 7 篇

2601.20831 2026-01-29 cs.AI cs.RO 81%

MemCtrl: Using MLLMs as Active Memory Controllers on Embodied Agents

MemCtrl: 使用 MLLMs 作为具身智能体的主动内存控制器

Vishnu Sashank Dorbala, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学 College Park分校)

专题命中 具身导航 :embodied agent(title,abstract);分类 cs.RO、cs.AI

AI总结 MemCtrl 通过使用 MLLMs 的可训练内存头 μ 实现在线内存修剪,提升具身智能体在复杂指令下的任务完成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20149 2026-01-29 cs.RO cs.SY eess.SY 74%

A Taylor Series Approach to Correct Localization Errors in Robotic Field Mapping using Gaussian Processes

利用高斯过程的泰勒级数方法纠正机器人场映射中的定位误差

Muzaffar Qureshi, Tochukwu Elijah Ogri, Kyle Volle, Rushikesh Kamalapurkar

专题命中 具身导航 :robotic(title);分类 cs.RO

AI总结 本文提出利用泰勒级数方法纠正机器人场映射中的定位误差,通过高斯过程的可微性实现实时修正,提升预测精度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21293 2026-01-29 cs.RO cs.HC 57%

Quadrupped-Legged Robot Movement Plan Generation using Large Language Model

四足机器人运动计划生成使用大语言模型

Muhtadin, Vincentius Gusti Putu A. B. M., Ahmad Zaini, Mauridhi Hery Purnomo, I Ketut Eddy Purnama, Chastine Fatichah

机构 * Institut Teknologi Sepuluh Nopember(十月份十号技术学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出利用大语言模型生成四足机器人运动计划,通过分布式架构和实时传感器融合实现直观自然语言导航,实验显示系统在多种场景中成功率超过90%。

Journal ref 2025 International Conference on Computer Engineering, Network and Intelligent Multimedia (CENIM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19851 2026-01-29 cs.RO 57%

Where Did I Leave My Glasses? Open-Vocabulary Semantic Exploration in Real-World Semi-Static Environments

我放哪里了我的眼镜?在现实世界半静态环境中进行开放式词汇语义探索

Benjamin Bogenberger, Oliver Harrison, Orrin Dahanaggamaarachchi, Lukas Brunke, Jingxing Qian, Siqi Zhou, Angela P. Schoellig

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本研究提出了一种适用于半静态环境的开放式词汇语义探索系统,通过概率模型和大语言模型推理实现高效对象导航和地图维护。

Journal ref IEEE RA-L, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17461 2026-01-29 cs.CV cs.CL 57%

Diagnosing Vision Language Models' Perception by Leveraging Human Methods for Color Vision Deficiencies

通过利用人类方法诊断视觉语言模型的感知能力:针对色觉缺陷的色觉研究

Kazuki Hayashi, Shintaro Ozaki, Yusuke Sakai, Hidetaka Kamigaito, Taro Watanabe

机构 * Nara Institute of Science and Technology(奈良科学技术研究所)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 本研究通过Ishihara测试评估视觉语言模型对色觉差异的感知能力,发现模型无法再现色觉缺陷个体的感知结果,揭示了多模态AI在包容性部署中的不足。

Comments Accepted to appear in the main conference of EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20547 2026-01-29 eess.SP 50%

Vehicular Wireless Positioning -- A Survey

车辆无线定位——综述

Sharief Saleh, Satyam Dwivedi, Russ Whiton, Peter Hammarberg, Musa Furkan Keskin, Julia Equi, Hui Chen, Florent Munier, Olof Eriksson, Fredrik Gunnarsson, Fredrik Tufvesson, Henk Wymeersch

专题命中 具身导航 :navigation(abstract)

AI总结 本文综述了车辆应用中无线定位技术的发展、现状及未来方向,涵盖卫星、蜂窝及IEEE标准技术,分析了定位需求、技术演变和传感器融合方法。

Comments Under review at IEEE Communications Surveys & Tutorials

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20468 2026-01-29 cs.HC 50%

Opportunities of Touch-Enabled Spherical Displays to support Climate Conversations

触觉增强的球形显示屏支持气候对话的机会

Mathis Brossier, Mina Mani, Agathe Malbet, Konrad Schönborn, Lonni Besançon

专题命中 具身导航 :navigation(abstract)

AI总结 触觉增强的球形显示屏通过直观交互提升博物馆和科学中心的气候教育体验,为未来技术发展提供指导。

Comments Submitted to Posters of CHI'26

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身推理 2 篇

2601.20540 2026-01-29 cs.CV 83%

Advancing Open-source World Models

推进开源世界模型

Robbyant Team, Zelin Gao, Qiuyu Wang, Yanhong Zeng, Jiapeng Zhu, Ka Leong Cheng, Yixuan Li, Hanlin Wang, Yinghao Xu, Shuailei Ma, Yihang Chen, Jie Liu, Yansong Cheng, Yao Yao, Jiayi Zhu, Yihao Meng, Kecheng Zheng, Qingyan Bai, Jingye Chen, Zehong Shen, Yue Yu, Xing Zhu, Yujun Shen, Hao Ouyang

机构 * Robbyant Team(Robbyant 团队)

专题命中 具身推理 :world model(title,abstract);robot learning(abstract);分类 cs.CV

AI总结 LingBot-World是一个开源世界模拟器,具备高保真度、长期记忆和实时交互能力,旨在推动内容创作、游戏和机器人学习等领域的应用。

Comments Project page: https://technology.robbyant.com/lingbot-world; Code: https://github.com/robbyant/lingbot-world

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20208 2026-01-29 cs.RO cs.CV 73%

TRACER: Texture-Robust Affordance Chain-of-Thought for Deformable-Object Refinement

TRACER: 适用于变形物体细化的纹理鲁棒触觉链

Wanjun Jia, Kang Li, Fan Yang, Mengfei Duan, Wenrui Chen, Yiming Jiang, Hui Zhang, Kailun Yang, Zhiyong Li, Yaonan Wang

机构 * School of Artificial Intelligence and Robotics, Hunan University(人工智能与机器人学院,湖南大学) National Engineering Research Center of Robot Visual Perception and Control Technology, Hunan University(机器人视觉感知与控制技术国家工程研究中心,湖南大学)

专题命中 具身推理 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 TRACER通过纹理鲁棒触觉链框架,提升变形物体在复杂纹理下的触觉识别精度和长视界任务成功率。

Comments The source code and dataset will be made publicly available at https://github.com/Dikay1/TRACER

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 机器人基础模型 1 篇

2510.05580 2026-01-29 cs.AI cs.RO 62%

MetaVLA: Unified Meta Co-training For Efficient Embodied Adaption

MetaVLA:统一的元学习协同训练用于高效的具身适应

Chen Li, Zhantao Yang, Han Zhang, Fangyi Chen, Chenchen Zhu, Anudeepsekhar Bolimera, Marios Savvides

机构 * Carnegie Mellon University(卡内基梅隆大学) Meta Reality Labs, USA(Meta现实实验室(美国))

专题命中 机器人基础模型 :embodied agent(abstract);分类 cs.RO、cs.AI

AI总结 MetaVLA通过统一的元学习协同训练方法,实现高效的具身适应,提升任务泛化能力并降低训练成本。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 模仿学习与强化学习 3 篇

2510.12312 2026-01-29 cs.LG cs.AI 81%

Deep SPI: Safe Policy Improvement via World Models

深度SPI:通过世界模型实现安全策略改进

Florent Delgrange, Raphael Avalos, Willem Röpke

机构 * AI Lab, Vrije Universiteit Brussel(人工智能实验室,布鲁塞尔自由大学) Cohere

专题命中 模仿学习与强化学习 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 DeepSPI通过结合世界模型和表示学习,提出了一种在线策略改进算法,在保持理论保证的同时在ALE-57基准中表现优异。

Comments ICLR 2026, 10 pages main text, 21 pages appendix (excluding references)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20701 2026-01-29 cs.RO 70%

One Step Is Enough: Dispersive MeanFlow Policy Optimization

一步即可:分散均流策略优化

Guowei Zou, Haitao Wang, Hejun Wu, Yukun Qian, Yuhang Wang, Weibing Li

机构 * School of Computer Science and Engineering, Sun Yat-sen University, Guangzhou, China(中山大学计算机科学与工程学院) Guangdong Key Laboratory of Big Data Analysis and Processing(大数据分析与处理广东省重点实验室)

专题命中 模仿学习与强化学习 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 DMPO通过单步生成、分散正则化和强化学习微调,在实时机器人控制中实现高效动作生成,性能超越多步基线。

Comments Code and project page: https://guowei-zou.github.io/dmpo-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19969 2026-01-29 cs.RO cs.LG 62%

E2HiL: Entropy-Guided Sample Selection for Efficient Real-World Human-in-the-Loop Reinforcement Learning

E2HiL: 基于熵引导的高效真实世界人机协同强化学习样本选择

Haoyuan Deng, Yuanjiang Xue, Haoyang Du, Boyang Zhou, Zhenyu Wu, Ziwei Wang

机构 * Nanyang Technological University, Singapore(南洋理工大学) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

AI总结 E2HiL通过熵引导的样本选择方法,提高了真实世界人机协同强化学习的样本效率和成功率,减少了人工干预需求。

Comments Project page: https://e2hil.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 机器人数据与评测 9 篇

2601.20846 2026-01-29 cs.RO 79%

End-to-end example-based sim-to-real RL policy transfer based on neural stylisation with application to robotic cutting

端到端基于神经风格迁移的示例驱动sim-to-real强化学习策略迁移方法及其在机器人切割中的应用

Jamie Hathaway, Alireza Rastegarpanah, Rustam Stolkin

机构 * Extreme Robotics Lab, School of Metallurgy and Materials, University of Birmingham(极端机器人实验室、冶金与材料学院、伯明翰大学) The Faraday Institution, Quad One, Harwell Science and Innovation Campus(法拉第机构、Quad One、哈威尔科学与创新校园) School of Computer Science and Digital Technologies, Aston University(计算机科学与数字技术学院、阿斯顿大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出了一种基于神经风格迁移的端到端sim-to-real强化学习策略迁移方法,通过合成训练数据提升机器人切割任务的性能和鲁棒性。

Comments 14 pages, 9 figures. Submitted to Nature Scientific Reports

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.07060 2026-01-29 cs.RO 79%

Memory-Maze: Scenario Driven Visual Language Navigation Benchmark for Guiding Blind People

Memory-Maze: 为引导视障人士的场景驱动视觉语言导航基准

Masaki Kuribayashi, Kohei Uehara, Allan Wang, Daisuke Sato, Simon Chu, Shigeo Morishima

机构 * Waseda University(早稻田大学) Miraikan - The National Museum of Emerging Science and Innovation(Mirai Kan - 国家新兴科学与创新博物馆) Carnegie Mellon University(卡内基梅隆大学)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 Memory-Maze是一个针对视障人士导航的场景驱动视觉语言导航基准,通过模拟记忆中的路线指令场景,评估模型处理记忆中不完整和模糊指令的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏