arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-01-19 至 2026-01-19 共收录 45 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2601.11421 2026-01-19 cs.RO cs.AI 84%

The Great March 100: 100 Detail-oriented Tasks for Evaluating Embodied AI Agents

伟大的百日行进100:100个注重细节的任务用于评估具身体验人工智能代理

Ziyu Wang, Chenyuan Liu, Yushun Xiang, Runhao Zhang, Qingbo Hao, Hongliang Lu, Houyu Chen, Zhizhong Feng, Kaiyue Zheng, Dehao Ye, Xianchao Zeng, Xinyu Zhou, Boran Wen, Jiaxin Li, Mingyu Zhang, Kecheng Zheng, Qian Zhu, Ran Cheng, Yong-Lu Li

机构 * SJTU(上海交通大学) SII(上海人工智能研究院) Robbyant

专题命中 机器人学习 :embodied AI(title);robot learning(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 GM-100通过100个精心设计的任务全面评估具身体验人工智能代理的能力,推动机器人数据集任务设计的多样性和复杂性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 15 篇

2601.05810 2026-01-19 cs.CV cs.AI cs.LG cs.RO 84%

SceneFoundry: Generating Interactive Infinite 3D Worlds

SceneFoundry: 生成交互式无限3D世界

ChunTeng Chen, YiChen Hsu, YiWen Liu, WeiFang Sun, TsaiChing Ni, ChunYi Lee, Min Sun, YuanFu Yang

机构 * National Yang Ming Chiao Tung University(国家阳明交通大学) National Tsing Hua University(国立清华大学) NVIDIA AI Technology Center(NVIDIA AI技术中心) National Taiwan University(国立台湾大学)

专题命中 机器人操作 :embodied AI(abstract);manipulation(abstract);navigation(abstract);robotic(abstract)

AI总结 SceneFoundry通过语言引导的扩散框架生成功能性强的3D环境,用于机器人训练和具身智能研究。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10827 2026-01-19 cs.RO cs.AI cs.SY eess.SY 82%

Approximately Optimal Global Planning for Contact-Rich SE(2) Manipulation on a Graph of Reachable Sets

近似最优的接触丰富SE(2)操作在可达集图上的全局规划

Simin Liu, Tong Zhao, Bernhard Paus Graesdal, Peter Werner, Jiuguang Wang, John Dolan, Changliu Liu, Tao Pang

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人学院) Robotics and AI Institute(机器人与人工智能研究所) CSAIL, Massachusetts Institute of Technology(麻省理工学院计算机科学与人工智能实验室)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI;robotics(comments)

AI总结 本文提出了一种近似最优的接触丰富SE(2)操作全局规划方法,通过构建可达集图实现高效运动规划,显著提升了任务效率和成功率。

Comments 17 pages, 14 figures; under submission to IEEE Transactions on Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19814 2026-01-19 stat.ME cs.AI 79%

Causal Inference under Threshold Manipulation: Bayesian Mixture Modeling and Heterogeneous Treatment Effects

阈值操纵下的因果推断:贝叶斯混合建模与异质性处理效应

Kohsuke Kubota, Shonosuke Sugasawa

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.AI

AI总结 本文提出了一种贝叶斯混合建模方法,用于在阈值操纵下估计因果效应,并扩展至分层贝叶斯框架以估计异质性处理效应。

Comments Paper accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11076 2026-01-19 cs.RO cs.AI 76%

A3D: Adaptive Affordance Assembly with Dual-Arm Manipulation

A3D:基于双臂操作的自适应可达性组装

Jiaqi Liang, Yue Chen, Qize Yu, Yan Shen, Haipeng Zhang, Hao Dong, Ruihai Wu

专题命中 机器人操作 :manipulation(title);分类 cs.RO、cs.AI

AI总结 A3D通过自适应可达性学习和双臂协作,实现家具组装任务的高效泛化。

Comments AAAI2026 oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10781 2026-01-19 cs.CV 70%

Future Optical Flow Prediction Improves Robot Control & Video Generation

未来光流预测改进机器人控制与视频生成

Kanchana Ranasinghe, Honglu Zhou, Yu Fang, Luyu Yang, Le Xue, Ran Xu, Caiming Xiong, Silvio Savarese, Michael S Ryoo, Juan Carlos Niebles

机构 * Salesforce AI Research(Salesforce AI研究院) Stony Brook University(石溪大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.CV

AI总结 FOFPred通过统一的视觉-语言模型和扩散架构,实现高效的未来光流预测,提升机器人控制与视频生成的性能。

Comments Project Site (Code, Models, Demo): https://fofpred.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11500 2026-01-19 cs.LG 57%

QUPID: A Partitioned Quantum Neural Network for Anomaly Detection in Smart Grid

QUPID:一种用于智能电网异常检测的分区量子神经网络

Hoang M. Ngo, Tre' R. Jeter, Jung Taek Seo, My T. Thai

机构 * University of Florida, Gainesville, FL, USA(佛罗里达大学) Gachon University, Seongnam-daero 1342, Seongnam-si, Republic of Korea(加尔贡大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 QUPID是一种用于智能电网异常检测的分区量子神经网络,通过量子增强的特征表示和差分隐私技术提升异常检测的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11447 2026-01-19 cs.CR cs.AR cs.LG 57%

IMS: Intelligent Hardware Monitoring System for Secure SoCs

IMS:面向安全SoC的智能硬件监控系统

Wadid Foudhaili, Aykut Rencber, Anouar Nechi, Rainer Buchty, Mladen Berekovic, Andres Gomez, Saleh Mulhem

机构 * Institute of Computer and Network Engineering,TU Braunschweig, Braunschweig, Germany(布拉unsch维格技术大学计算机与网络工程学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 本文提出IMS系统,利用神经网络实时检测AXI协议违规,实现高准确率与低延迟,适用于资源受限的边缘环境安全监控。

Comments The final version is accepted for publication at the Design, Automation & Test in Europe Conference (DATE) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15304 2026-01-19 cs.CL cs.AI 57%

Adversarial Poetry as a Universal Single-Turn Jailbreak Mechanism in Large Language Models

对抗性诗歌作为大型语言模型中的通用单轮绕过机制

Piercosma Bisconti, Matteo Prandi, Federico Pierucci, Francesco Giarrusso, Marcantonio Bracale Syrnikov, Marcello Galisai, Vincenzo Suriani, Olga Sorokoletova, Federico Sartore, Daniele Nardi

机构 * DEXAI – Icaro Lab(DEXAI–Icaro实验室) Sapienza University of Rome(罗马Sapienza大学) Sant’Anna School of Advanced Studies(Sant’Anna高级研究学校) VU Amsterdam(阿姆斯特丹VU)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 对抗性诗歌被证明能有效绕过大型语言模型的安全机制,其攻击成功率显著高于传统方法,揭示了现有安全措施的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11410 2026-01-19 physics.optics 50%

Resolving topological obstructions to vectorial structured field control

消除矢量结构场控制中的拓扑障碍

An Aloysius Wang, Yuxi Cai, Yifei Ma, Patrick S Salter, Chao He

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出了一种新的数学框架,用于分析矢量结构场控制中的拓扑困难,并确定克服这些困难所需的最小深度,以优化矢量场控制和物质场生成设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10679 2026-01-19 physics.gen-ph 50%

New XOR & XNOR Operations in Instantaneous Noise-Based Logic

即时噪声逻辑中的新XOR与XNOR运算

Nasir Kenarangui, Arthur Powalka, Laszlo Kish

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出了一种基于即时噪声逻辑的XOR和XNOR运算方法,通过模拟验证了其在计算速度和硬件复杂性方面的改进潜力。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11249 2026-01-19 physics.app-ph physics.optics 50%

Metagratings on Low-Cost Substrates for Efficient Anomalous Reflection: Addressing Dielectric Loss

低成本基板上的元格栅用于高效异常反射:解决介电损耗问题

Oz Diker, Ariel Epstein

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出了一种在低成本基板上设计高效元格栅的方法,通过考虑介电损耗优化光束操控效率,并通过实验验证了其有效性。

Comments 16 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00031 2026-01-19 econ.TH 50%

The Gatekeeping Expert's Dilemma

守门专家的困境

Shunsuke Matsuno

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文通过财务审计案例,提出战略模糊性是解决守门专家在透明与保密间的两难困境的有效方法,解释了审计师为何接受客户报告及守门人有效性的原因。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06331 2026-01-19 physics.optics 50%

Inverse design of Mie resonators with minimal backscattering

Mie共振器的逆设计以最小化后向散射

Vladimir Igoshin, Alexey Kokhanovskiy, Mihail Petrov

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文通过逆设计方法实现了具有接近零后向散射的Mie共振器,利用广义Kerker效应和多极消去条件,为纳米光子结构设计提供了新思路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02831 2026-01-19 cond-mat.mtrl-sci cond-mat.mes-hall cond-mat.str-el 50%

Nonvolatile optical control of interlayer stacking order in 1T-TaS2

非易失性光学控制1T-TaS2的层间堆叠顺序

Junde Liu, Pei Liu, Liu Yang, Sung-Hoon Lee, Mojun Pan, Famin Chen, Jierui Huang, Bei Jiang, Mingzhe Hu, Yuchong Zhang, Zhaoyang Xie, Gang Wang, Mengxue Guan, Wei Jiang, Huaixin Yang, Jianqi Li, Chenxia Yun, Zhiwei Wang, Sheng Meng, Yugui Yao, Tian Qian, Xun Shi

专题命中 机器人操作 :manipulation(abstract)

AI总结 通过非易失性光学控制,研究揭示了1T-TaS2中层间堆叠顺序的超快转变机制及相干调控方法。

Journal ref npj Quantum Mater. 11, 6 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.08521 2026-01-19 cond-mat.mes-hall cond-mat.other 50%

Nonlinear chiral photocurrent in parity-violating magnetic Weyl semimetals

非对称磁性韦尔半金属中的非线性手性光电流

Shiva Heidari, Reza Asgari

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究揭示了非对称磁性韦尔半金属中非线性手性光电流的产生机制,展示了磁化方向旋转对拓扑非线性光电流响应的影响。

Journal ref Phys. Rev. B 106, 195148 (2022)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 7 篇

2507.22145 2026-01-19 gr-qc astro-ph.IM physics.app-ph physics.ins-det 78%

High-Precision Relativistic Time Scales for Cislunar Navigation

高精度的月球轨道导航时尺度

Slava G. Turyshev

专题命中 具身导航 :navigation(title,abstract)

AI总结 本文提出了一种高精度的相对论时间尺度框架,用于月球轨道导航,通过高阶球谐分析和潮汐效应,实现皮秒级时间同步和厘米级导航精度。

Comments 49 pages, 6 tables

Journal ref ApJ 997:97 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11335 2026-01-19 cs.RO cs.SY eess.SY 74%

Distributed Control Barrier Functions for Safe Multi-Vehicle Navigation in Heterogeneous USV Fleets

分布式控制屏障函数用于异构无人艇编队的安全多车导航

Tyler Paine, Brendan Long, Jeremy Wenger, Michael DeFilippo, James Usevitch, Michael Benjamin

机构 * Massachusetts Institute of Technology(麻省理工学院) MIT Lincoln Laboratory(MIT林肯实验室) Woods Hole Oceanographic Institution(伍兹霍尔海洋研究所) Charles Stark Draper Laboratory(查尔斯·斯塔克·德拉珀实验室) Brigham Young University

专题命中 具身导航 :navigation(title);分类 cs.RO

AI总结 本文提出了一种基于控制屏障函数的分布式安全控制方法,用于异构无人艇编队的避碰问题,通过模拟和实验证明其在不同平台和人类操作员行为下的有效性。

Comments 8 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10725 2026-01-19 cs.RO math.OC 74%

Multi-Agent Formation Navigation Using Diffusion-Based Trajectory Generation

基于扩散的多智能体编队导航

Hieu Do Quang, Chien Truong-Quoc, Quoc Van Tran

机构 * Department of Mechatronics, School of Mechanical Engineering, Hanoi University of Science and Technology(机械工程系,河内科学与技术大学)

专题命中 具身导航 :navigation(title);分类 cs.RO

AI总结 本文提出基于扩散模型的多智能体编队导航方法,通过生成领头者中点轨迹实现平滑运动,有效应对复杂环境中的编队控制问题。

Comments 8 pages, 3 figures, full version of a paper submitted to a conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11143 2026-01-19 cs.RO cs.AI 68%

Learning Quadrupedal Locomotion for a Heavy Hydraulic Robot Using an Actuator Model

为重载液压机器人学习四足运动的致动器模型

Minho Lee, Hyeonseok Kim, Jin Tak Kim, Sangshin Park, Jeong Hyun Lee, Jungsan Cho, Jemin Hwangbo

机构 * Robotics and Artificial Intelligence Lab, KAIST(机器人与人工智能实验室,韩国科学技术院) Robotics Team, HYUNDAI Rotem(HYUNDAI Rotem机器人团队) Hydraulic Robot Laboratory, Human-Centric Robotics R&D Department, Korea Institue of Industrial Technology(液压机器人实验室,人本机器人研发部门,韩国工业技术研究院)

专题命中 具身导航 :robotics(abstract,comments);分类 cs.RO、cs.AI

AI总结 本研究提出了一种基于液压动力学的分析致动器模型,用于重载液压四足机器人在RL中的运动控制,实现了稳定的sim-to-real转移。

Comments 9 pages, Accepted to IEEE Robotics and Automation Letters (RA-L) 2025

Journal ref IEEE Robotics and Automation Letters (Volume: 10, Issue: 12, December 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10003 2026-01-19 cs.HC 50%

Beyond the Silence: How Men Navigate Infertility Through Digital Communities and Data Sharing

超越沉默:男性如何通过数字社区和数据共享应对不育

Tawfiq Ammari, Zarah Khondoker, Yihan Wang, Nikki Roda

专题命中 具身导航 :navigation(abstract)

AI总结 本研究探讨男性通过数字社区和数据共享应对不育问题,发现社区作为混合空间,提供医学建议、情感支持和管理功能,跨帖者在不同社区间起到导航和导师作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07128 2026-01-19 cs.CL 50%

DeepSeek-R1 Thoughtology: Let's think about LLM Reasoning

DeepSeek-R1 思维学:让我们思考LLM推理

Sara Vera Marjanović, Arkil Patel, Vaibhav Adlakha, Milad Aghajohari, Parishad BehnamGhader, Mehar Bhatia, Aditi Khandelwal, Austin Kraft, Benno Krojer, Xing Han Lù, Nicholas Meade, Dongchan Shin, Amirhossein Kazemnejad, Gaurav Kamath, Marius Mosbach, Karolina Stańczak, Siva Reddy

专题命中 具身导航 :world model(abstract)

AI总结 DeepSeek-R1通过多步骤推理链实现复杂问题解决,研究揭示其推理性能的'甜点'及潜在安全漏洞。

Comments 135 pages, Published to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.05053 2026-01-19 eess.SY cs.SY 50%

Constructive Observer Design for Visual Simultaneous Localisation and Mapping

构造性观测器设计用于视觉同时定位与建图

Pieter van Goor, Robert Mahony, Tarek Hamel, Jochen Trumpf

专题命中 具身导航 :robotics(abstract)

AI总结 本文提出了一种基于新型李群的构造性观测器设计方法,用于实现视觉同时定位与建图,通过非线性观测器实现了近半全局渐近稳定的误差动态。

Comments 17 pages, 8 figures. Published in IFAC Automatica

Journal ref Automatica 132 (2021): 109803

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 具身推理 3 篇

2506.00070 2026-01-19 cs.RO cs.AI 81%

Robot-R1: Reinforcement Learning for Enhanced Embodied Reasoning in Robotics

Robot-R1: 通过强化学习提升机器人中的具身推理

Dongyoung Kim, Sumin Park, Huiwon Jang, Jinwoo Shin, Jaehyung Kim, Younggyo Seo

机构 * KAIST(韩国科学技术院) Yonsei University(延世大学) UC Berkeley(加州大学伯克利分校) RLWRLD

专题命中 具身推理 :robotics(title,abstract);分类 cs.RO、cs.AI

AI总结 Robot-R1通过强化学习提升机器人中的具身推理,优于SFT方法并超越GPT-4o在低级动作控制推理任务中

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10905 2026-01-19 cs.LG stat.ME 79%

Action Shapley: A Training Data Selection Metric for World Model in Reinforcement Learning

动作夏普利:用于强化学习世界模型的训练数据选择度量

Rajat Ghosh, Debojyoti Dutta

机构 * Nutanix Inc.(Nutanix公司)

专题命中 具身推理 :world model(title,abstract);分类 cs.LG

AI总结 本文提出动作夏普利度量,用于高效选择强化学习世界模型的训练数据,通过随机动态算法提升计算效率并改进数据选择性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15946 2026-01-19 cs.LG cs.AR hep-ex 57%

AIE4ML: An End-to-End Framework for Compiling Neural Networks for the Next Generation of AMD AI Engines

AIE4ML:一个端到端框架,用于为下一代AMD AI引擎编译神经网络

Dimitrios Danopoulos, Enrico Lupi, Chang Sun, Sebastian Dittmeier, Michael Kagan, Vladimir Loncar, Maurizio Pierini

机构 * Institute of Physics Belgrade, Serbia(塞尔维亚贝尔格莱物理研究所) Physikalisches Institut, Heidelberg University, Germany(德国海德堡大学物理研究所) SLAC National Accelerator Laboratory, Menlo Park, CA, USA(美国Menlo Park加州SLAC国家加速器实验室)

专题命中 具身推理 :world model(abstract);分类 cs.LG

AI总结 AIE4ML是一个端到端框架,用于将AI模型自动转换为优化的固件,以在AMD AIE-ML设备上实现高效神经网络执行,同时支持向前兼容新架构,提供高效率和低延迟性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 机器人基础模型 1 篇

2601.11250 2026-01-19 cs.RO 57%

VLAgents: A Policy Server for Efficient VLA Inference

VLAgents: 一种高效的VLA推理政策服务器

Tobias Jülg, Khaled Gamal, Nisarga Nilavadi, Pierre Krack, Seongjin Bien, Michael Krawez, Florian Walter, Wolfram Burgard

机构 * University of Technology Nuremberg(图恩大学) Technical University of Munich(慕尼黑技术大学)

专题命中 机器人基础模型 :robotics(abstract);分类 cs.RO

AI总结 VLAgents是一种高效的VLA推理政策服务器,通过统一协议和上下文适应通信层,提升了机器人中VLAs的部署效率和性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 模仿学习与强化学习 1 篇

2601.10911 2026-01-19 cs.LG 79%

Realistic Curriculum Reinforcement Learning for Autonomous and Sustainable Marine Vessel Navigation

现实课程强化学习用于自主可持续海洋船舶导航

Zhang Xiaocai, Xiao Zhe, Liang Maohan, Liu Tao, Li Haijiang, Zhang Wenbin

专题命中 模仿学习与强化学习 :navigation(title,abstract);分类 cs.LG

AI总结 本文提出基于现实课程强化学习的框架,结合数据驱动的海洋模拟和机器学习预测模块,以实现自主且可持续的船舶导航。

Comments Present in The 40th Annual AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 人机交互与遥操作 1 篇

2601.10721 2026-01-19 cs.RO 57%

Collaborative Continuum Robots: A Survey

协作连续机器人:综述

Xinyu Li, Qian Tang, Guoxin Yin, Gang Zheng, Jessica Burgner-Kahrs, Cesare Stefanini, Ke Wu

专题命中 人机交互与遥操作 :robotics(abstract);分类 cs.RO

AI总结 本文综述了协作连续机器人在协作模式、结构设计、建模与控制方面的最新进展,并探讨了该领域的发展挑战与未来机遇。

详情

展开后加载摘要…

URL PDF HTML 收藏

8. 机器人数据与评测 10 篇

2601.11266 2026-01-19 cs.RO 88%

Skill-Aware Diffusion for Generalizable Robotic Manipulation

面向可泛化的机器人操作技能感知扩散

Aoshen Huang, Jiaming Chen, Jiyu Cheng, Ran Song, Wei Pan, Wei Zhang

机构 * School of Control Science and Engineering, Shandong University(控制科学与工程学院,山东大学) Department of Computer Science, The University of Manchester(计算机科学系,曼彻斯特大学)

专题命中 机器人数据与评测 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 SADiff通过整合技能层面信息提升机器人操作的泛化能力,引入IsaacSkill数据集进行评估与迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏