arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 503 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 503 篇

2509.17053 2026-06-23 cs.RO 版本更新 79%

FILIC: Dual-Loop Force-Guided Imitation Learning with Impedance Torque Control for Contact-Rich Manipulation Tasks

FILIC:基于阻抗力矩控制的双环力引导模仿学习用于接触丰富操作任务

Haizhou Ge, Yufei Jia, Zheng Li, Yue Li, Zhixing Chen, Lu Shi, Lei Han, Ruqi Huang, Guyue Zhou

机构 * Tsinghua University(清华大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) DISCOVER Robotics(DISCOVER机器人)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出FILIC框架,通过双环结构结合Transformer策略与阻抗控制器,利用关节力矩估计末端力,实现无力传感器下的力感知接触操作,显著提升安全性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04531 2026-06-19 cs.RO 版本更新 79%

PTLD: Sim-to-real Privileged Tactile Latent Distillation for Dexterous Manipulation

PTLD: 从仿真到现实的触觉潜在知识蒸馏用于灵巧操作

Rosy Chen, Mustafa Mukadam, Michael Kaess, Tingfan Wu, Francois R Hogan, Jitendra Malik, Akash Sharma

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Washington(华盛顿大学) FAIR at Meta(Meta的FAIR团队) UC Berkeley(伯克利大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出PTLD方法,通过真实世界触觉策略数据蒸馏鲁棒状态估计器,解决触觉仿真困难问题,在灵巧操作任务中相比纯本体感策略提升182%和57%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15535 2026-06-19 cs.RO 版本更新 79%

VibeCheck: Using Active Acoustic Tactile Sensing for Contact-Rich Manipulation

VibeCheck: 使用主动声学触觉传感进行接触丰富的操作

Kaidi Zhang, Do-Gon Kim, Eric T. Chang, Hua-Hsuan Liang, Zhanpeng He, Kathryn Lampo, Philippe Wu, Ioannis Kymissis, Matei Ciocarlie

机构 * Dept. of Mechanical Engineering(机械工程系) Dept. of Computer Science(计算机科学系) Dept. of Electrical Engineering(电气工程系) Columbia University(哥伦比亚大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文构建了带有两个压电手指的主动声学传感夹爪,通过物体传递声学振动来感知其声学特性和接触状态,用于物体分类、抓取位置估计、内部结构姿态估计以及外部接触类型分类,并基于接触分类模型实现了鲁棒的插销任务。

Comments Published at IROS 2025. 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20708 2026-06-17 cs.LG math.OC stat.AP 版本更新 79%

Exposing the Illusion of Fairness: Auditing Vulnerabilities to Distributional Manipulation Attacks

揭露公平的幻象:审计对分布操纵攻击的脆弱性

Valentin Lafargue, Adriana Laurindo Monteiro, Emmanuelle Claeys, Laurent Risser, Jean-Michel Loubes

机构 * Institut de Mathématiques de Toulouse (IMT)(图卢兹数学研究所) Institut national de recherche en sciences et technologies du numérique (INRIA)(国家数字科学与技术研究院) Artificial and Natural Intelligence Toulouse Institute 2 (ANITI 2)(图卢兹人工智能与自然智能研究所2) Institut de Recherche en Informatique de Toulouse (IRIT)(图卢兹计算机研究所) Independent Researcher(独立研究员) CNRS IRL CROSSING(国家科学研究中心IRL CROSSING)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.LG

AI总结 研究恶意被审计方如何通过分布操纵制造公平假象,提出基于熵和最优传输的操纵策略,并评估统计检验的检测能力,为监管验证提供指导。

Journal ref European Conference on Machine Learning and Principles and Practice of Knowledge Discovery in Databases, Applied Data Science Track, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02773 2026-06-16 cs.RO 版本更新 79%

Bimanual High-Density EMG Control for In-Home Mobile Manipulation by Users with Quadriplegia

用于四肢瘫痪用户居家移动操作的双侧高密度肌电控制

Jehan Yang, Eleanor Hodgson, Cindy Sun, Zackory Erickson, Doug Weber

机构 * University of California, Berkeley(加州大学伯克利分校) University of Washington(华盛顿大学)

专题命中 机器人操作 :manipulation(title);navigation(abstract);分类 cs.RO

AI总结 针对颈椎脊髓损伤用户,提出双侧高密度肌电(HDEMG)前臂袖套,结合共享自主框架实现实时手势控制移动操作器,经12天居家研究验证日常任务有效性。

Comments 17 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15919 2026-06-16 cs.RO 版本更新 79%

ReMoBot: Retrieval-Based Few-Shot Imitation Learning for Mobile Manipulation with Vision Foundation Models

ReMoBot: 基于检索的少样本模仿学习用于移动操作与视觉基础模型

Yuying Zhang, Wenyan Yang, Francesco Verdoja, Ville Kyrki, Joni Pajarinen

机构 * School of Electrical Engineering, Aalto University, Espoo, Finland(艾尔沃大学电气工程学院,埃斯波,芬兰)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出ReMoBot,一种基于检索的少样本模仿学习框架,利用视觉基础模型从演示中检索信息,解决移动操作任务中的部分可观测性和数据有限问题,在真实世界任务中取得高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18438 2026-06-12 cs.CV 版本更新 79%

CPAM: Context-Preserving Adaptive Manipulation for Zero-Shot Real Image Editing

CPAM: 保持上下文的自适应操作用于零样本真实图像编辑

Dinh-Khoi Vo, Thanh-Toan Do, Tam V. Nguyen, Minh-Triet Tran, Trung-Nghia Le

机构 * Faculty of Information Technology, University of Science, Ho Chi Minh City, Vietnam(越南科学大学信息科技学院) Vietnam National University, Ho Chi Minh City, Vietnam(越南国家大学) Faculty of Information Technology, Monash University, Melbourne, Victoria, Australia(莫纳什大学信息科技学院) Department of Computer Science, University of Dayton, Dayton, Ohio, US(Dayton 大学计算机科学系)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.CV

AI总结 提出CPAM零样本框架,通过保持上下文的自适应操作和掩码引导,实现复杂非刚性真实图像的编辑,保留纹理和身份,无需微调。

Comments Accepted to IEEE Transactions on Multimedia. Project page: https://vdkhoi20.github.io/CPAM

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01661 2026-06-09 cs.RO 版本更新 79%

Symskill: Symbol and Skill Co-Invention for Data-Efficient and Reactive Long-Horizon Manipulation

Symskill:符号与技能共发明用于数据高效且反应性强的长周期操作

Yifei Simon Shao, Yuchen Zheng, Sunan Sun, Pratik Chaudhari, Vijay Kumar, Nadia Figueroa

机构 * GRASP Laboratory, University of Pennsylvania(GRASP实验室,宾夕法尼亚大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 Symskill通过联合学习谓词、运算符和技能,实现了数据高效且反应性强的长周期操作,结合了组合泛化与实时恢复能力。

Comments ICRA 2026 Best Conference Paper Award; ICRA 2026 Best Paper Award on Planning and Control; CoRL 2025 Best Paper Award on Learning Effective Abstractions for Planning (LEAP) Workshop (https://symskill.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11934 2026-06-09 cs.RO 版本更新 79%

Robot-DIFT: Correspondence-Sensitive Diffusion Features for Contact-Rich Robot Manipulation

Robot-DIFT: 用于接触丰富机器人操作的对应敏感扩散特征

Yu Deng, Yufeng Jin, Xiaogang Jia, Jiahong Xue, Gerhard Neumann, Georgia Chalvatzaki

机构 * TU Darmstadt(图宾根大学) KIT(卡尔斯鲁厄理工学院) FZI(弗劳恩霍夫研究所) Hessian.AI(黑森人工智能公司) Robotics Institute Germany(德国机器人研究所) Honda Research Institute Europe GmbH(本田欧洲研究院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出Robot-DIFT,通过流形蒸馏将扩散模型转化为确定性学生网络,结合空间-语义特征金字塔网络,为接触敏感任务提供实时对应敏感特征,在多个基准上超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15061 2026-07-07 cs.RO cs.CV 版本更新 79%

Ask-to-Clarify: Resolving Instruction Ambiguity through Multi-turn Dialogue

Ask-to-Clarify: 通过多轮对话解决指令歧义

Xingyao Lin, Xinghao Zhu, Tianyi Lu, Guojin Zhong, Sicheng Xie, Hui Zhang, Xipeng Qiu, Zuxuan Wu, Yu-Gang Jiang

机构 * College of Computer Science and Artificial Intelligence, Fudan University, Shanghai, China(复旦大学计算机科学与人工智能学院) Shanghai Innovation Institute, Shanghai, China(上海创新研究院) Mechanical Systems Control Lab, UC Berkeley, California, USA(伯克利机械系统控制实验室)

专题命中 机器人操作 :robotics(abstract);embodied agent(abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出Ask-to-Clarify框架,通过多轮对话解决指令歧义问题,结合视觉语言模型和扩散模型,采用两阶段知识绝缘策略训练,实现多任务中更高效的协作式具身代理。

Comments Accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20242 2026-06-10 cs.CY cs.AI cs.RO 版本更新 79%

BadRobot: Jailbreaking Embodied LLM Agents in the Physical World

BadRobot: 在物理世界中越狱具身LLM智能体

Hangtao Zhang, Chenyu Zhu, Xianlong Wang, Ziqi Zhou, Changgan Yin, Minghui Li, Lulu Xue, Yichen Wang, Shengshan Hu, Aishan Liu, Peijin Guo, Leo Yu Zhang

机构 * Huazhong University of Science and Technology(华中科技大学) Beihang University(北航) Griffith University(格里菲斯大学)

专题命中 机器人操作 :embodied AI(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 提出BadRobot攻击范式,利用LLM在机器人系统中的操纵、语言输出与物理动作的错位以及世界知识缺陷三个漏洞,通过语音交互使具身LLM执行有害行为,并在基准测试中验证了有效性。

Comments Accepted to ICLR 2025. Please cite the conference version. Project page: https://Embodied-LLMs-Safety.github.io

Journal ref International Conference on Learning Representations (ICLR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09127 2026-06-23 cs.RO 版本更新 78%

IMPACT: An Implicit Active-Set Augmented Lagrangian for Fast Contact-Implicit Trajectory Optimization

IMPACT: 一种隐式主动集增广拉格朗日法用于快速接触-隐式轨迹优化

Jiayun Li, Dejian Gong, Georgia Chalvatzaki

机构 * PEARL Lab, Dept. of Computer Science, TU Darmstadt, Germany(图腾实验室,计算机科学系,图恩大学,德国) Hessian.AI, Darmstadt, Germany(海森AI,图恩,德国) Robotics Institute Germany (RIG)(德国机器人研究所(RIG))

专题命中 机器人操作 :manipulation(abstract,abstract_cn);robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出IMPACT方法,通过隐式主动集策略解决接触约束下的轨迹优化问题,实现高效求解并提升控制质量。

Comments Accepted to Robotics: Science and Systems (RSS), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18795 2026-08-12 cs.SI 版本更新 78%

Opinion Polarization in LLM-Based Social Networks: Manipulation and Mitigation

基于LLM的社交网络中的意见极化:操纵与缓解

Ali Safarpoor Dehkordi, Mohammad Shirzadi, Ahad N. Zehmakan

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 研究在基于大语言模型模拟的社交网络中,对手如何通过有限预算操纵意见极化,并评估两种防御机制(反应性和主动性)的效果,发现两者均无法完全恢复基线极化状态。

Comments 16 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19696 2026-08-12 cs.RO cs.AI cs.LG 版本更新 78%

Diffusion-Based Impedance Learning for Contact-Rich Manipulation Tasks

基于扩散的阻抗学习用于接触丰富的操作任务

Noah Geiger, Tamim Asfour, Neville Hogan, Johannes Lachner

机构 * Institute for Anthropomatics and Robotics, Karlsruhe Institute of Technology(人机动力学与机器人研究所,卡尔斯鲁厄技术大学) Department of Mechanical Engineering, Massachusetts Institute of Technology(机械工程系,麻省理工学院) Department of Brain and Cognitive Sciences, Massachusetts Institute of Technology(脑与认知科学系,麻省理工学院)

专题命中 机器人操作 :manipulation(title);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出基于扩散的阻抗学习框架,结合生成建模与能量一致的阻抗控制,实现接触丰富的操作任务中的高精度动态控制与任务泛化能力。

Comments 15 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09246 2026-08-04 cs.CR 版本更新 78%

Practical Spoofing Attacks against Galileo OSNMA with Time-Synchronization Manipulation

通过时间同步操纵对伽利略OSNMA实施的实用欺骗攻击

Haiyang Wang, Yuanyu Zhang, Yangke Tan, Ji He, Shuangtrui Zhao, Ning Xi, Yulong Shen

专题命中 机器人操作 :manipulation(title);navigation(abstract)

AI总结 该研究针对启用OSNMA的伽利略接收机,提出三种符合时间同步要求的欺骗攻击,通过操纵本地参考时间迫使接收机满足时间同步,结合重放或伪造信号实现欺骗,实验验证攻击可成功通过OSNMA认证。

Comments 10 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.05507 2026-08-03 cs.LO cs.SE 版本更新 78%

A Compositional Approach to Verifying Modular Robotic Systems

一种验证模块化机器人系统的组合方法

Matt Luckcuck, Marie Farrell, Angelo Ferrando, Rafael C. Cardoso, Louise A. Dennis, Michael Fisher

专题命中 机器人操作 :robotic(title,abstract)

AI总结 研究如何验证模块化机器人系统,采用组合方法,用一阶逻辑假设保证契约指定节点,引入推理规则,提出RCL语言,通过工具Vanda翻译成可执行监视器,经实例验证该方法有效。

Comments Version accepted at RAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10486 2026-07-30 q-fin.TR econ.GN q-fin.EC q-fin.GN 版本更新 78%

Manipulation, Informed Trading, and Regulation in Leveraged Event-Linked Markets

操控、内幕信息与在杠杆事件关联市场中的监管

Maksym Nechepurenko

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 本文探讨杠杆预测市场合同引入后操控激励、内幕交易收益与监管框架的相互作用,提出操控分类框架和监管合成,分析杠杆对操控和内幕交易的影响,并提出14项监管建议。

Comments 10 pages, 0 figures, 3 tables. Major revision (series release r2.1.0): separates four conduct channels; removes uncalibrated numerical leverage thresholds; revises informed-trading, surveillance, and regulatory analysis. No new empirical run. Code: https://github.com/ForesightFlow/event-linked-perps

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14712 2026-07-14 cs.RO cs.AI cs.CL cs.CV 版本更新 78%

IntentVLA: Short-Horizon Intent Modeling for Aliased Robot Manipulation

IntentVLA:用于有歧义机器人操作的短周期意图建模

Shijie Lian, Bin Yu, Xiaopeng Lin, Zhaolong Shen, Laurence Tianruo Yang, Yurun Jin, Haishan Liu, Changti Wu, Hang Yuan, Cong Huang, Kai Chen

机构 * HUST(华中科技大学) ZGCA(中钢集团人工智能研究院) ZGCI(中钢智能科技有限公司) HIT(哈尔滨工业大学) HKUST(GZ)(香港科技大学(广州)) BUAA(北京航空航天大学) ZZU(浙江工业大学) ECNU(华东师范大学) USTC(中国科学技术大学) DeepCybo

专题命中 机器人操作 :manipulation(title);分类 cs.RO、cs.AI、cs.CV

AI总结 IntentVLA通过编码近期视觉观测为紧凑的短周期意图表示,提升机器人操作的执行稳定性,并在多个基准测试中优于现有VLA基线。

Comments Code can be found in https://github.com/ZGC-EmbodyAI/IntentVLA

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00015 2026-07-13 quant-ph 版本更新 78%

Quantumly controlled measurement, Hermitian conjugation and normalization in matrix-manipulation algorithms

矩阵操作算法中的量子控制测量、厄米共轭和归一化

Edward B. Fel'dman, Alexander I. Zenchuk, Wentao Qi, Junde Wu

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 研究矩阵操作算法中的问题,通过引入量子控制测量、复矩阵编码及弱化归一化约束解决,将这些扩展应用于矩阵乘法算法并给出电路,解决了相关重要问题并实现扩展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24589 2026-07-07 eess.AS cs.SD 版本更新 78%

YingMusic-Singer: Controllable Singing Voice Synthesis with Flexible Lyric Manipulation and Annotation-free Melody Guidance

YingMusic-Singer-Plus: 可控歌唱语音合成与灵活歌词操控及无标注旋律引导

Chunbo Hao, Junjie Zheng, Guobin Ma, Yuepeng Jiang, Huakang Chen, Wenjie Tian, Gongyu Chen, Zihao Chen, Lei Xie

机构 * AI Lab, GiantNetwork(巨人网络AI实验室)

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 本文提出YingMusic-Singer-Plus,一种基于扩散模型的可控歌唱语音合成方法,支持灵活歌词操控和无标注旋律引导,优于现有基准模型。

Comments INTERSPEECH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29764 2026-07-01 quant-ph physics.optics 版本更新 78%

Coherent manipulation of the biphoton generation in cavity-QED system

腔QED系统中双光子产生的相干操控

Jia-Ni Yang, Xin-Yi Ling, Yuan Feng, Xiao-Jun Zhang, Jin-Hui Wu

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 研究腔QED系统中通过自发四波混频产生双光子的相干操控,利用原子-腔耦合和驱动场实现暗态增强控制,分析光谱亮度和量子统计特性。

Comments 13 pages, 7 figures, This updated version corrects the license selection for compliance with Optics Express submission policy; all content is identical to v1

Journal ref Optics Express 34, 30902 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06570 2026-07-21 cs.RO 版本更新 77%

Unsupervised Discovery of Failure Taxonomies from Deployment Logs

无监督发现部署日志中的故障分类

Aryaman Gupta, Yusuf Umut Ciftci, Somil Bansal

机构 * Stanford University(斯坦福大学) University of Southern California(南加州大学)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出无监督发现部署日志中的故障分类方法,通过视觉-语言推理和语义聚类,提升机器人系统鲁棒性和故障监控能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03283 2026-07-07 cs.CV 版本更新 77%

Utonia: Toward One Encoder for All Point Clouds

Utonia:迈向适用于所有点云的单一编码器

Yujia Zhang, Xiaoyang Wu, Yunhan Yang, Xianzhe Fan, Han Li, Yuechen Zhang, Zehao Huang, Naiyan Wang, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) Xiaomi(小米)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.CV

AI总结 研究旨在训练跨多领域的单自监督点变压器编码器Utonia,其能学习一致表征空间实现跨域转移,统一各领域点云,提升感知能力,还对具身和多模态推理有益,有望成为稀疏3D数据基础模型。

Comments produced by Pointcept, project page: https://pointcept.github.io/Utonia

Journal ref International Conference on Machine Learning 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00836 2026-06-16 cs.RO 版本更新 77%

One-Step Model Predictive Path Integral for Manipulator Motion Planning Using Configuration Space Distance Fields

基于构型空间距离场的一步模型预测路径积分用于机械臂运动规划

Yulin Li, Tetsuro Miyazaki, Kenji Kawashima

机构 * Department of Information Physics and Computing, The University of Tokyo(东京大学信息物理与计算系)

专题命中 机器人操作 :robotics(abstract);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出将构型空间距离场与模型预测路径积分结合,利用CDF梯度统一代价函数并缩短规划时域至一步,实现高效避障,在2D环境和7自由度机械臂仿真中成功率近100%,控制频率超750Hz。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08213 2026-06-10 cs.RO 版本更新 77%

HandCept: A Visual-Inertial Fusion Framework for Accurate Proprioception in Dexterous Hands

HandCept: 用于灵巧手精确本体感知的视觉-惯性融合框架

Huang Junda, Honghao Guo, Hao Wu, Zhengyang Liu, Marcelo H Ang, Jianshu Zhou

机构 * The Chinese University of Hong Kong(香港中文大学) National University of Singapore(新加坡国立大学)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出HandCept,首个视觉-惯性本体感知框架,通过零样本学习和无延迟扩展卡尔曼滤波融合腕部RGB-D相机与9轴IMU,实现2°-4°关节角估计误差且无漂移,优于纯视觉或纯惯性方法。

Comments 8 pages, 7 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07820 2026-08-14 cs.RO cs.AI cs.CV cs.GR cs.SY eess.SY 版本更新 76%

SONIC: Supersizing Motion Tracking for Natural Humanoid Whole-Body Control

SONIC:为自然人形全身体控进行超大规模运动追踪

Zhengyi Luo, Ye Yuan, Tingwu Wang, Chenran Li, Fernando Castañeda, Sirui Chen, Zi-Ang Cao, Jiefeng Li, David Minor, Qingwei Ben, Jinhyung Park, David Sami, Zi Wang, Xingye Da, Runyu Ding, Cyrus Hogg, Lina Song, Edy Lim, Eugene Jeong, Tairan He, Haoru Xue, Wenli Xiao, Simon Yuen, Jan Kautz, Yan Chang, Umar Iqbal, Linxi "Jim" Fan, Yuke Zhu

机构 * NVIDIA

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);分类 cs.RO、cs.AI、cs.CV;robotics(journal_ref)

AI总结 本文提出了一种超大规模运动追踪方法,通过扩大模型容量、数据和计算资源,实现了一种能够产生自然且稳健全身体态的通用人形控制器,并展示了其在运动追踪任务中的可扩展性及在下游任务中的应用价值。

Comments Project page: https://nvlabs.github.io/SONIC/

Journal ref Science Robotics 11 (117), eaed4592 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06961 2026-08-18 cs.RO cs.CV 版本更新 76%

Two by Two: Learning Multi-Task Pairwise Objects Assembly for Generalizable Robot Manipulation

两两配对:学习用于通用机器人操作的多任务成对物体装配

Yu Qi, Yuanchen Ju, Tianming Wei, Chi Chu, Lawson L. S. Wong, Huazhe Xu

专题命中 机器人操作 :manipulation(title);分类 cs.RO、cs.CV

AI总结 针对现有装配数据集无法适配日常物体装配的问题,提出2BY2数据集,并开发带等变特征的两步SE(3)位姿估计方法,在18项任务上取得最优性能且经机器人实验验证可靠泛化

Comments Accepted to CVPR 2025 (Conference on Computer Vision and Pattern Recognition)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12263 2026-06-09 cs.CL cs.AI cs.LG 版本更新 76%

Multimodal Generative Engine Optimization: Rank Manipulation for Vision-Language Model Rankers

多模态生成式引擎优化:针对视觉-语言模型排序器的排名操纵

Yixuan Du, Chenxiao Yu, Haoyan Xu, Ziyi Wang, Yue Zhao, Xiyang Hu

机构 * Georgetown University(乔治城大学) University of Southern California(南加州大学) University of Maryland, College Park(马里兰大学学院公园分校) Arizona State University(亚利桑那州立大学)

专题命中 机器人操作 :manipulation(title);分类 cs.AI、cs.LG

AI总结 提出多模态生成式引擎优化(MGEO)方法,通过联合优化图像扰动和文本后缀,利用视觉-语言模型内部跨模态知识耦合,实现对产品排名的有效操纵,揭示了多模态基础模型知识基础的脆弱性。

Comments Proceedings of the 4th Workshop on Towards Knowledgeable Foundation Models (KnowFM) at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01948 2026-06-15 cs.RO 版本更新 76%

A Unified Control Architecture for Macro-Micro Manipulation using a Active Remote Center of Compliance for Manufacturing Applications

面向制造应用的宏微操作统一控制架构:基于主动远程柔顺中心

Patrick Frank, Christian Friedrich

机构 * Institute for Robotics and Intelligent Production Systems University of Applied Sciences Karlsruhe (HKA)(机器人与智能生产系统研究所 卡尔施塔特应用科学大学(HKA))

专题命中 机器人操作 :manipulation(title);分类 cs.RO;robotics(comments)

AI总结 提出一种将宏操作器纳入主动交互控制的新架构,相比现有领先-跟随方法将控制带宽提升2.1倍,相比传统力控制提升12.5倍,并引入替代模型简化控制器设计。

Comments 17 pages, 14 figures, submitted to Robotics and Computer-Integrated Manufacturing (RCIM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09948 2026-08-19 cs.AI cs.CV cs.RO 版本更新 75%

LoopVLA: Learning Sufficiency in Recurrent Refinement for Vision-Language-Action Models

LoopVLA: 在视觉-语言-动作模型中学习充分性

Boyang Shen, Kaixiang Yang, Hao Wang, Qiuyu Yu, Qiang Xie, Qiang Li, Zhiwei Wang

机构 * Huazhong University of Science and Technology(华中科技大学) Wuhan United Imaging Surgical Co.,Ltd. (UIS)(武汉联影 surgical 公司)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 LoopVLA通过递归学习实现表示细化、动作预测和充分性估计,减少计算并提升效率,实验表明其在精度和性能上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏