arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 987 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 987 篇

2608.05746 2026-08-07 cs.RO 新提交 85%

Acoustic-driven millimetric helical robot: ultrasonic synergistic manipulation in confined fluidic environment

声驱动毫米级螺旋机器人:受限流体环境中的超声协同操控

Hanlin Wang, Xin Wang, Xinwei Wei, Jiaxu Liu, Le Wang, Shengze Cai, Chao Xu

机构 * Zhejiang University(浙江大学) Huzhou Institute of Zhejiang University(浙江大学湖州研究院) Huzhou Normal University(湖州师范学院) Huzhou Vocational and Technical College(湖州职业技术学院)

专题命中 机器人操作 :manipulation(title,abstract);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 该研究提出协调多声场方法,利用声辐射力与声流协同实现毫米级螺旋机器人在受限流体环境的可控运动,提升了操控性,为相关生物医学应用提供支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02990 2026-08-05 cs.RO 新提交 85%

EmbodiedVAE: Disentangled Video VAE for Efficient and Controllable Embodied Manipulation

EmbodiedVAE:用于高效可控具身操作的解耦视频变分自编码器

Jiayi Luo, Hanxin Zhu, Chen Gao, Jiankun Wang, Cong Wang, Tianyu He, Jianxin Li, Zhibo Chen

机构 * Beihang University(北京航空航天大学) Zhongguancun Academy(中关村学院) University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学) CASIA, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所(CASIA)) Microsoft Research Asia(微软亚洲研究院)

专题命中 机器人操作 :manipulation(title,abstract);world model(abstract);robotic(abstract);分类 cs.RO

AI总结 针对现有潜在扩散模型适配具身操作场景的缺陷,提出EmbodiedVAE视频变分自编码器,通过双编码器架构与最优传输一致性模块实现更优重建质量、压缩率及精确动作控制。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01733 2026-08-04 cs.RO 新提交 85%

TWINS: A Tactile Wearable Isomorphic Arm Networked System for Contact-Rich Manipulation Learning

TWINS:用于接触丰富操作学习的触觉可穿戴同构臂联网系统

Takahide Kitamura, Masaki Murooka, Natsuki Yamanobe, Yukiyasu Domae

机构 * National Institute of Advanced Industrial Science and Technology (AIST)(独立行政法人产业技术综合研究所(AIST))

专题命中 机器人操作 :manipulation(title,abstract);robot learning(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出TWINS触觉可穿戴同构臂联网系统,用于解决现有机器人难以完成身体表面接触操作的问题,通过采集演示数据训练模仿学习策略,实现了身体表面触觉引导的接触丰富操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26809 2026-07-30 cs.RO 新提交 85%

Practice Makes Policies: Bootstrapping and Consolidating Robotic Capabilities from Zero Human Demonstrations

熟能生巧:从零人类演示中引导与整合机器人能力

Jialiang Li, Yuhan Wang, Haojun Li, Gaojing Zhang, Yangtian Ye, Qipeng Liu, Haotian Liang, Wenzhao Lian

专题命中 机器人操作 :robotic(title,abstract);embodied agent(abstract);manipulation(abstract);分类 cs.RO

AI总结 本研究提出HERO自改进层级具身智能体,通过整合启发式推理等技术,实现机器人从零人类演示自主演进操作能力,减少数据收集人工干预并提升多样化任务操作稳健性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16310 2026-07-21 cs.RO 新提交 85%

Real-Time sEMG-Based Telecontrol of an Assistive Robotic Arm Using a 1D Convolutional Neural Network

基于一维卷积神经网络的实时表面肌电辅助机器人手臂遥操作

Edgar Manacorda, Mena Samir Kama Abouseffien, Olivier Lecompte, Amandine Gesta, Abolfazl Mohebbi

机构 * Polytechnique Montréal(蒙特利尔综合理工大学)

专题命中 机器人操作 :robotic(title,abstract);robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 研究上肢运动障碍者用sEMG控制辅助机器人手臂的问题,核心方法是基于一维卷积神经网络,主要贡献是实现高分类性能、稳定实时行为,证明sEMG遥操作可行性,强调整合多技术的重要性,为后续研究指明方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31836 2026-07-01 cs.RO 新提交 85%

RoboTacDex: A Dexterous Visual-Tactile-Action Dataset for Humanoid Manipulation

RoboTacDex:用于人形机器人操作的灵巧视觉-触觉-动作数据集

Xinyi Wang, Donghan Li, Zi'Ang Chen, Chong Yu, Chen Xin, Peng Ye, Yingkai Sun, Tao Chen

机构 * Fudan University(复旦大学) ByteDance Intelligent Creation(字节跳动智能创作) The Chinese University of Hong Kong(香港中文大学)

专题命中 机器人操作 :manipulation(title,abstract);robot learning(abstract);robotic(abstract);分类 cs.RO

AI总结 提出RoboTacDex,一个包含6k轨迹、19个任务、23种技能和22个物体的大规模多模态灵巧操作数据集,基于Unitree G1人形机器人构建,提供多视角RGB-D、触觉反馈和语义标注,并评估了三种模仿学习模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23685 2026-06-23 cs.RO 新提交 85%

LaST-HD: Learning Latent Physical Reasoning from Scalable Human Data for Robot Manipulation

LaST-HD:从可扩展人类数据中学习潜在物理推理以进行机器人操作

Jiaming Liu, Yinxi Wang, Chenyang Gu, Siyuan Qian, Xiangju Mi, Hao Chen, Jiawei Chen, Qingpo Wuwu, Xiaoqi Li, Nuowei Han, Yiming Zhang, Xuheng Zhang, Yang Yue, Yeqing Yang, Lei Wang, Peng Jia, Hao Tang, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室) The Chinese University of Hong Kong(香港中文大学) Simplexity Robotics Aether Tech

专题命中 机器人操作 :manipulation(title,abstract);robot learning(abstract);world model(abstract);分类 cs.RO

AI总结 提出LaST-HD框架,通过将人手与机器人演示在共享潜在推理空间中对齐,利用未配对轨迹训练世界模型合成统一潜在目标,实现跨形态物理动力学内化,并开发低成本数据手套OOL Glove,结合混合训练策略,仅用少量人类数据即可达到高泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19980 2026-06-19 cs.AI 新提交 85%

ENPIRE: Agentic Robot Policy Self-Improvement in the Real World

ENPIRE: 现实世界中智能体机器人策略的自我改进

Wenli Xiao, Jia Xie, Tonghe Zhang, Haotian Lin, Letian "Max" Fu, Haoru Xue, Jalen Lu, Yi Yang, Cunxi Dai, Zi Wang, Jimmy Wu, Guanzhi Wang, S. Shankar Sastry, Ken Goldberg, Linxi "Jim" Fan, Yuke Zhu, Guanya Shi

机构 * NVIDIA(英伟达) CMU(卡内基梅隆大学) UC Berkeley(加州大学伯克利分校)

专题命中 机器人操作 :robot policy(title);robotics(abstract);manipulation(abstract);robotic(abstract)

AI总结 提出ENPIRE框架,通过环境重置、策略执行、结果验证和迭代优化的闭环反馈,使编码智能体自主改进机器人操作策略,在灵巧操作任务上达到99%成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14083 2026-06-15 cs.RO 新提交 85%

The N2D Haptic Glove: A Multi-Finger Glove for 2D Directional Force Feedback for Contact Rich Manipulation

N2D 触觉手套:用于接触丰富操作的多指二维方向力反馈手套

Yao-Ting Huang, Jake Honma, Omar Hernandez, Logan Li, Kaitlin Calimbahin, Bryce Hackel, Michael C. Yip

机构 * University of California San Diego(加州大学圣地亚哥分校)

专题命中 机器人操作 :manipulation(title,abstract);robot learning(abstract);robotic(abstract);分类 cs.RO

AI总结 提出 N2D 触觉手套,通过绞盘驱动在指尖提供二维弯曲-伸展力反馈,显著降低遥操作中的接触力误差并提高一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13677 2026-06-12 cs.RO cs.AI cs.CV cs.LG 新提交 85%

Mana: Dexterous Manipulation of Articulated Tools

Mana: 铰接工具的灵巧操作

Zhao-Heng Yin, Guanya Shi, Pieter Abbeel, C. Karen Liu

机构 * UC Berkeley(加州大学伯克利分校) CMU(卡内基梅隆大学) Stanford University(斯坦福大学) Amazon FAR(亚马逊FAR)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 提出Mana框架,将灵巧操作重解释为动画问题,通过粗到细的流水线自动生成操作轨迹,实现铰接工具的零样本仿真到现实迁移。

Comments Project Page: https://zhaohengyin.github.io/mana

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10645 2026-06-10 cs.CV 新提交 85%

ManiSplat: Manipulation Trajectory Synthesis from Monocular Video via Decoupled 3D Gaussian Splatting

ManiSplat: 基于解耦3D高斯泼溅的单目视频操作轨迹合成

Wenhao Hu, Haonan Zhou, Liu Liu, Yun Du, Xinjie Wang, Ziang Li, Zhizhong Su, Gaoang Wang

机构 * Zhejiang University(浙江大学) Horizon Robotics(地平线机器人)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);robotic(abstract);分类 cs.CV

AI总结 提出ManiSplat框架,通过图结构解耦表示和任务导向时空对齐,从单目视频重建可控的3D高斯数字孪生,支持机器人操作任务与策略学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07608 2026-07-09 cs.RO cs.CV 新提交 85%

Dual Latent Memory in Vision-Language-Action Models for Robotic Manipulation

用于机器人操作的视觉-语言-动作模型中的双潜记忆

Hongyu Qu, Jianzhe Gao, Xiaobin Hu, Shaohuan Yang, Xinlei Yu, Rui Yan, Wenguan Wang, Xiangbo Shu, Shuicheng Yan

机构 * Nanjing University of Science and Technology(南京理工大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学)

专题命中 机器人操作 :manipulation(title);robotic(title);分类 cs.RO、cs.CV

AI总结 研究针对主流VLA模型处理长期任务的不足,提出LaMem-VLA框架,通过四个协调组件将历史经验重构为潜记忆令牌并与VLA推理直接交织,实现在同一潜空间处理历史经验,经实验验证该框架具有优越性。

Comments Project page: https://github.com/quhongyu/LaMem-VLA

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08657 2026-06-09 cs.RO cs.AI 新提交 85%

Latent Diffusion Policy: Shaping Latent Spaces for Diffusion-Based Robotic Manipulation

潜在扩散策略:为基于扩散的机器人操作塑造潜在空间

Zhexuan Zhou, Yichen Lai, Jinhao Zhang, Huizhe Li, Youmin Gong, Jie Mei

机构 * National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学)

专题命中 机器人操作 :manipulation(title);robotic(title);分类 cs.RO、cs.AI

AI总结 提出两阶段框架LDP,通过CVAE编码器吸收场景理解,在预浓缩的潜在空间中进行流匹配,简化学习并提升多臂协调任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15863 2026-08-18 cs.RO cs.AI cs.CL cs.CV cs.MM 新提交 85%

Scaling Manual-Grounded Appliance Manipulation with Data Synthesis and Unified Planning

通过数据合成与统一规划扩展基于手册的家电操作规模

Yuxing Long, Lei Kang, Ziyan Yu, Yuzheng Gao, Bin Cheng, Jiyao Zhang, Xiaoqi Li, Haolin Yang, Dongjiang Li, Hui Shen, Hao Dong

机构 * Center on Frontiers of Computing Studies, School of Computer Science, Peking University(北京大学计算机学院计算前沿研究中心) Beijing University of Aeronautics and Astronautics(北京航空航天大学) Jingdong Technology Information Technology Co., Ltd(京东科技信息技术有限公司)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 针对现有大模型缺乏支持基于手册的家电操作规划的数据集的问题,提出MAGE数据合成流水线构建UseAppliance数据集,开发AppliancePlan模型,在RealAppliance-Bench和真实机器人实验中表现优异,推进通用家用机器人发展。

Comments Accepted by ACM MM 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22997 2026-07-28 cs.RO cs.AI cs.GR cs.LG 新提交 85%

Real2Sim2Real for Vision-Language-Action Manipulation: An AMD ROCm-Based Pipeline

用于视觉-语言-动作操纵的Real2Sim2Real:基于AMD ROCm的管道

Qing Yang, Xun Wang, Ziguan Wang, Zhenjiang Li, Hongqiang Wang, Dongdong Weng

机构 * AMD AIG Team(AMD人工智能团队) Beijing Institute of Technology(北京理工大学)

专题命中 机器人操作 :manipulation(title,abstract);embodied agent(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文针对视觉-语言-动作操纵提出基于AMD ROCm的Real2Sim2Real技术栈,涵盖多硬件计算,由开放软件栈统一。通过四个演示表明无需CUDA锁定生态系统,展示了在多硬件平台上的相关成果,且管道可在特定硬件和平台上原生运行并重现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17739 2026-06-17 cs.RO cs.AI cs.CV cs.MA 新提交 85%

ED3R: Energy-Aware Distributed Disaster Detection Enabled by Cooperative Robotic Agents

ED3R: 能量感知的分布式灾难检测——基于协作机器人智能体

Lina Magoula, Nikolaos Koursioumpas, Nancy Alonistioti, Ramin Khalili

机构 * Dept. of Informatics and Telecommunications, National and Kapodistrian University of Athens(雅典大学信息学与电信系) Huawei Heisenberg Research Center (Munich)(华为海森堡研究中心(慕尼黑))

专题命中 机器人操作 :robotic(title,abstract);robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 提出ED3R框架,通过机器人-远程控制器分层协作与分布式神经回归预测,在不确定性下以最低能耗实现野火检测,成功率达97.18%,能耗降低36.4%,检测速度提升41%。

Comments 14 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07217 2026-06-08 cs.RO cs.CV cs.LG 新提交 85%

Robotic Policy Adaptation via Weight-Space Meta-Learning

通过权重空间元学习实现机器人策略自适应

Christian Bianchi, Siamak Yousefi, Alessio Sampieri, Andrea Roberti, Luca Rigazio, Fabio Galasso, Luca Franco

机构 * ItalAI University of Verona(威尼斯大学) Sapeinza University of Rome(罗马萨佩因扎大学)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 提出WIZARD框架,通过权重空间元学习从语言指令和演示视频生成任务特定LoRA参数,无需微调即可适应新任务,在LIBERO上性能提升高达14倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19968 2026-08-21 cs.RO cs.CV 新提交 84%

PVRA: A Pointwise Key-point Voting Framework for Robotic Assembly

PVRA:用于机器人装配的逐点关键点投票框架

Kulunu Samarawickrama, Roel Pieters

机构 * Tampere University(坦佩雷大学)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.CV;robotics(comments)

AI总结 本研究针对机器人自主渐进式装配的感知需求,提出基于3D关键点的模块化学习框架PVRA,在装配位姿估计数据集上训练后,与以物体为中心的基线及增强指标对比验证了其有效性。

Comments 14 pages, 3 figures. Accepted for presentation at the European Conference on Robotics (ECoR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06678 2026-07-09 cs.RO 新提交 84%

NativeMEM: Native Memory Compression for Long-Horizon Robotic Manipulation

NativeMEM:用于长期机器人操作的原生内存压缩

Ziye Wang, Modi Shi, Chaojun Ni, Jiazhi Yang, Mengdi Li, Zhizhong Su, Tianwei Lin, Hongyang Li

机构 * The University of Hong Kong(香港大学) Beihang University(北京航空航天大学) Peking University(北京大学) The Chinese University of Hong Kong(香港中文大学) Horizon Robotics(地平线机器人)

专题命中 机器人操作 :manipulation(title);robotic(title);分类 cs.RO

AI总结 研究如何让预训练VLA模型高频更新时保留长期视觉历史且高效。提出NativeMEM策略,用原生内存压缩编码,通过开发分词器对齐内存令牌与策略,该方法在模拟和真实机器人实验中效果好,数据效率高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17323 2026-08-19 cs.RO cs.AI 新提交 84%

ORPA: Online Residual Policy Adaptation for Robot Manipulation Control with Human Feedback

ORPA:基于人类反馈的机器人操控控制在线残差策略适配

Muhammad A. Muttaqien, Tomohiro Motoda, Ryo Hanai, Yukiyasu Domae

机构 * National Institute of AIST(日本国立AIST研究所) Embodied AI Research Team(具身人工智能研究团队)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本研究提出ORPA框架,通过添加轻量反馈条件化模块实现机器人操控策略的在线残差适配,无需重训练即可纠正执行误差,在ALOHA平台的精度敏感操控任务上提升了成功率与扰动恢复能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14379 2026-08-17 cs.RO cs.AI 新提交 84%

Reflex: Enabling Fast and Predictive Vision-Language-Action Models for Reaction-Critical Manipulation

Reflex:面向反应关键型操作的快速且可预测的视觉-语言-动作模型

Yuxuan Chen, Wanruo Zhang, Xiao Li

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 针对现有VLA模型忽略动态交互场景的问题,提出面向反应关键型操作的ReflexBench基准与无需大规模机器人数据预训练的ReflexVLA模型,其可提升动态操作性能并保持静态操作精度。

Comments 8 pages, 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09303 2026-08-11 cs.RO cs.LG 新提交 84%

SAFE-CHEM: Uncertainty-Aware Policy Switching for Robust Robotic Chemistry

SAFE-CHEM:面向稳健机器人化学的不确定性感知策略切换

Laura Jones, Shazil Shahzad, Ayesha Sana, Gabriella Pizzuto

机构 * School of Computer Science & Informatics, University of Liverpool(利物浦大学计算机科学与信息学院) Department of Chemistry, University of Liverpool(利物浦大学化学系)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.LG

AI总结 本研究针对机器人化学实验的安全风险,提出SAFE-CHEM不确定性感知框架,通过混合控制架构在不确定性超阈值时切换至备份控制器,提升任务成功率并减少安全违规,实现零样本仿真到真实的迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07746 2026-08-11 cs.LG cs.RO 新提交 84%

LUCID: Latent-Skill Unified Control via Imagined Dynamics for Long-Horizon Humanoid Loco-Manipulation

LUCID:基于想象动力学的潜在技能统一控制用于长程人形机器人移动操作

Cheng Guo, Mingzhe Ni, Angelo Cangelosi, Arash Ajoudani

专题命中 机器人操作 :manipulation(title,abstract);world model(abstract);分类 cs.RO、cs.LG

AI总结 该研究针对人形机器人长程移动操作的复杂序列任务,提出分层基于模型的强化学习框架LUCID,经模拟多物体重排实验验证,其任务成功率优于现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03103 2026-08-05 cs.RO cs.AI 新提交 84%

A Hierarchical Approach to Imitation Learning for Manipulation Tasks Requiring Time Varying Forces

针对需要时变力的操作任务的模仿学习的分层方法

Rishabh Shukla, Adithya Santhosh, Shaili Gandhi, Samrudh Moode, Satyandra K. Gupta

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 该研究针对接触密集拆卸任务中扩散策略的延迟问题,提出DPA-FTG分层方法,解耦高低频控制,在双手电池拆卸任务上性能优于RDP等基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19479 2026-07-23 cs.RO cs.AI 新提交 84%

ModPack: An Extensible Teleoperation Interface for Bimanual Mobile Manipulation

ModPack:一种用于双边移动操作的可扩展遥操作接口

Joshua Citron, Renee Zbizika, Zeyi Liu, Shuran Song

机构 * Stanford University(斯坦福大学)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO、cs.AI

AI总结 针对现有遥操作系统扩展性和适应性不足的问题,提出ModPack可扩展遥操作系统,以统一框架支持多样机器人形式和任务,通过背包集成多种功能,经实验验证其灵活性和可复用性,并开源软硬件设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16312 2026-07-21 cs.CV cs.RO 新提交 84%

xperception -- Making Robotic Grasping Easier

xperception——让机器人抓取更轻松

Matteo Bortolon, Andrea Caraffa, Alice Fasoli, Fabio Poiesi

机构 * Fondazione Bruno Kessler(布鲁诺·凯斯勒基金会)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 研究针对高混合低产量制造中机器人操作灵活性问题,提出零样本6D姿态估计技术xperception,利用CAD模型和基础模型语义特征,基于FreeZe算法实现毫米级精确估计,为相关行业机器人自动化提供了可扩展方案。

Comments White paper published for Ital-IA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12105 2026-07-15 cs.RO cs.LG 新提交 84%

Robust In-Hand Manipulation via Priors in Reinforcement Learning and Mechanical Design

通过强化学习和机械设计中的先验知识实现稳健的手中操作

Yifei Chen, Shihan Lu, Ed Colgate, Kevin Lynch

机构 * Center for Robotics and Biosystems, Northwestern University(西北大学机器人与生物系统中心)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 研究无外部传感的手中操作难题,引入全局抓握质量先验和局部接触几何先验两种互补物理先验,用于多指机器人手操作物体的手中滚动操作学习,显著提升了旋转效率、抓握稳定性和抗干扰能力,增强任务稳健性与模拟到现实的转移。

Comments 25 pages, 15 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07775 2026-07-10 cs.AI cs.CR cs.HC cs.RO 新提交 84%

Idiobionics: The Unification of Privacy and Intelligent Robotic Prostheses

静止仿生学:隐私与智能机器人假肢的统一

Kwesi Afari Darfoor, Patrick M. Pilarski, Bailey Kacsmar

机构 * University of Alberta(阿尔伯塔大学) Alberta Machine Intelligence Institute (Amii)(阿尔伯塔机器智能研究所)

专题命中 机器人操作 :robotic(title,abstract);robotics(abstract);分类 cs.RO、cs.AI

AI总结 研究聚焦隐私与智能机器人假肢交叉领域,提出“静止仿生学”,通过定义、结合文献阐述及展示潜在攻击,为可穿戴机器人等领域提供开放性研究问题,助力释放机器人假肢等设备潜力。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07101 2026-07-09 cs.RO cs.AI 新提交 84%

GeoProp: Grounding Robot State in Vision for Generalist Manipulation

GeoProp:将机器人状态在视觉中进行定位以实现通用操作

Guoyang Zhao, Quanhao Qian, Gongjie Zhang, Wenhao Li, Jiuniu Wang, Xiaowei Lu, Deli Zhao, Ran Xu

机构 * Tongji University(同济大学) DAMO Academy, Alibaba Group(阿里巴巴达摩院) HuPan Lab(湖畔实验室) Alibaba Group(阿里巴巴集团) Nanyang Technological University(南洋理工大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 研究针对机器人操作中本体感觉与视觉缺乏有效对齐问题,提出轻量级GeoProp适配器,通过几何定位、特征采样及FiLM调制等使两者对齐,在多任务中提升策略性能,是具身策略的简单高效归纳偏差。

Comments 21 pages, 8 figures, 11 tables. Project page: https://alibaba-damo-academy.github.io/GeoProp/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04927 2026-07-07 cs.RO cs.AI 新提交 84%

DSWAM: A Dual-System World Action Foundation Model for Fine-Grained Robot Manipulation

DSWAM:用于细粒度机器人操作的双系统世界行动基础模型

Jian Zhu, Jianjun Zhang, Taiyi Su, Tianbin Liu, Zhangyuan Wang, Kai Xie, Zitai Huang, Chong Ma, Youzhang He, Tianjian Wang, Hanyang Wang, Weihao Ding, Yi Xu

机构 * AIRC, Midea Group(美的集团美云智数) Tongji University(同济大学)

专题命中 机器人操作 :manipulation(title,abstract);world model(abstract);分类 cs.RO、cs.AI

AI总结 研究针对世界行动模型在复杂任务指令分解及VLA与WAM执行能力对比方面的不足,引入DSWAM,通过双系统结合,利用视觉历史和任务提示预测子任务,经多种训练及加速等实现细粒度机器人操作并进行公平对比。

Comments 13 pages, 1 figures

详情

展开后加载摘要…

URL PDF HTML 收藏