arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 61441 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 22164 篇

2603.09761 2026-07-20 cs.RO 版本更新 70%

MuxGel: Simultaneous Dual-Modal Visuo-Tactile Sensing via Spatially Multiplexing and Deep Reconstruction

MuxGel: 通过空间复用和深度重建实现同时双模视觉触觉感知

Zhixian Hu, Zhengtong Xu, Sheeraz Athar, Juan Wachs, Yu She

机构 * Edwardson School of Industrial Engineering, Purdue University(工业工程系,普渡大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 MuxGel通过空间复用和深度重建实现双模视觉触觉感知,提升机器人抓取任务的感知能力。

Comments Accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14579 2026-07-17 cs.HC cs.CV 新提交 70%

Skeleton: Visual Authoring of Non-visual Data Experiences

Skeleton:非视觉数据体验的可视化创作

Frank Elavsky, Chieri Nnadozie, Lucas Nadolskis, Patrick Carrington, Dominik Moritz

机构 * Carnegie Mellon University(卡内基梅隆大学) UC Santa Barbara(加州大学圣巴巴拉分校)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);分类 cs.CV

AI总结 研究非视觉数据体验可视化创作问题,提出Skeleton直接操作创作环境,含Inspector、Dimensions API等技术,经对8名从业者实地研究评估,其使导航结构可见,改变从业者可访问设计方式。

Comments 9 pages core, 2 pages acknowledgements + references, 4 pages appendices. Accepted at IEEE VIS 2026, to appear in November 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13731 2026-07-16 cs.LG stat.ML 新提交 70%

DAGR: State-Conditioned Goal Representations via Difference-Aware Goal Cross-Attention

DAGR:通过差异感知目标交叉注意力实现的状态条件目标表示

Xing Lei, Wenyan Yang, Xuetao Zhang, Donglin Wang

机构 * Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(西安交通大学人工智能与机器人研究所) Department of Electrical Engineering and Automation, Aalto University(阿尔托大学电气工程与自动化系) School of Engineering, Westlake University(西湖大学工学院)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);分类 cs.LG

AI总结 研究目标条件强化学习中目标编码问题,提出DAGR方法,通过多尺度门控交叉注意力将静态嵌入细化为状态条件嵌入,在OGBench上改善导航,在操纵和拼图任务中有不同表现,是一种结构化细化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12593 2026-07-15 eess.IV cs.RO cs.SY eess.SY 新提交 70%

Improving Autonomous Nano-drones Performance via Automated End-to-End Optimization and Deployment of DNNs

通过深度神经网络的自动化端到端优化和部署提高自主纳米无人机性能

Vlad Niculescu, Lorenzo Lamberti, Francesco Conti, Luca Benini, Daniele Palossi

专题命中 机器人操作 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究如何通过自动化端到端优化和部署DNN提高自主纳米无人机性能,聚焦PULP-Dronet在Crazyflie 2.1纳米无人机上的部署,实现内存占用减少、推理时间加速,提升了无人机在避障、自由飞行和车道跟随等方面的性能,还开源了相关软件设计。

Comments 16 pages, 8 figures, 5 tables. This paper has been accepted for publication in the IEEE Journal on Emerging and Selected Topics in Circuits and Systems (JETCAS) copyright 2021 IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12702 2026-07-15 cs.RO 新提交 70%

Vision-Based Dribbling for Humanoid Soccer via Privileged Representation Learning

通过特权表示学习实现基于视觉的人形足球运球

Flavio Maiorana, Valerio Spagnoli, Eugenio Bugli, Flavio Volpi, Daniele Affinita, Vincenzo Suriani, Daniele Nardi, Luca Iocchi

机构 * Sapienza University of Rome(罗马第一大学) Institut de Robòtica i Informàtica Industrial (CSIC-UPC)(工业机器人与信息学研究所(西班牙科学与技术研究委员会 - 加泰罗尼亚理工大学)) École Polytechnique Fédérale de Lausanne (EPFL)(洛桑联邦理工学院)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 研究人形机器人基于视觉的运球问题,提出将时间深度编码器嵌入强化学习策略的集成方法,应用于模拟机器人,该方法在不同场景下实现了一定成功率的运球,为处理复杂运球场景奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07491 2026-07-15 cs.RO 版本更新 70%

Smooth Operator: A Real-Time Sampling-Based Algorithm for Kinematic Hand Retargeting

平滑算子:一种基于实时采样的运动学手部重定向算法

Robert Jomar Malate, Erik Bauer, Norica Bacuieti, Stefanos Charalambous, Elvis Nava, Robert K. Katzschmann, Benedek Forrai

机构 * ETH Zurich(苏黎世联邦理工学院) Stanford University(斯坦福大学) mimic robotics(模仿机器人公司)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 针对基于梯度的手部重定向算法易收敛到不同局部最小值影响数据质量的问题,提出基于采样的无梯度重定向方法SBR,经模拟和真实用户研究评估,其总体任务成功率最高且显著降低操作员疲劳,为灵巧操作提供高效重定向器及基准测试方法。

Comments Minor cosmetic updates to figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08966 2026-07-13 cs.CE cs.RO math.OC 新提交 70%

Impedance-Guided Programmable Transmission of Localized Deformation in Modular Soft Metamaterials

模块化软超材料中局部变形的阻抗引导可编程传输

Weiyun Xu, Daewon Hong, Zhi Zhao, Rahul Dev Kundu, Xiaojia Shelly Zhang

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 研究模块化软超材料中局部变形传输问题,提出阻抗引导设计框架,通过建立非线性模型和拓扑优化实现可编程传输,合成模块族,实现多种位移操纵架构及信息处理,为智能材料系统提供见解和途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22332 2026-07-13 cs.RO 新提交 70%

Tactile Genesis: Exploring Tactile Sensors at Scale for Learning Dexterous Tasks

触觉起源:大规模探索用于学习灵巧任务的触觉传感器

Trinity Chung, Kashu Yamazaki, Dhruv Patel, Alexis Duburcq, Yiling Qiao, Katerina Fragkiadaki, Aran Nayebi

机构 * Carnegie Mellon University(卡内基梅隆大学) Genesis AI

专题命中 机器人操作 :robot learning(abstract);manipulation(abstract);分类 cs.RO

AI总结 提出Tactile Genesis,一种GPU并行触觉传感器仿真平台,支持多种触觉模态,通过大规模实验发现传感器布局比类型和分辨率更重要,力/力矩感知最有效。

Comments 24 pages, 8 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07675 2026-07-09 cs.CV 新提交 70%

Scaling Mixture-of-Experts Video Pretraining for Embodied Intelligence

用于具身智能的缩放专家混合视频预训练

Shuailei Ma, Jiaqi Liao, Xinyang Wang, Jingjing Wang, Chaoran Feng, Zijing Hu, Chong Bao, Zichen Xi, Yuqi Gan, Weisen Wang, Yanhong Zeng, Qin Zhao, Zifan Shi, Wei Wu, Hao Ouyang, Qiuyu Wang, Shangzhan Zhang, Jiahao Shao, Yipengjing Sun, Liangxiao Hu, Lunke Pan, Nan Xue, Kecheng Zheng, Yinghao Xu, Xing Zhu, Yujun Shen, Ka Leong Cheng

机构 * Robbyant(蚂蚁灵波)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);分类 cs.CV

AI总结 针对视频生成模型领域不匹配问题,提出LingBot-Video,采用MoE架构、构建数据剖析引擎、开发多维奖励系统进行视频预训练,验证了其性能和效率,贡献了首个大规模开源MoE视频基础模型。

Comments Project page: https://technology.robbyant.com/lingbot-video

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23128 2026-07-08 cs.RO 版本更新 70%

$π_0$-EqM: Equilibrium Matching for Closed-Loop Vision-Language-Action Control

$\pi_0$-EqM:闭环视觉-语言-动作控制的均衡匹配

Huanming Liu, Congsheng Xu, Jianmin Ji, Yao Mu

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出$\pi_0$-EqM,用均衡匹配解码器替换$\pi_0$中的流匹配专家,在固定预算下提升机器人操作成功率,并发现残差与成功率之间的非单调关系。

Comments Preprint. 5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07162 2026-07-08 cs.RO 版本更新 70%

First Plan Then Evaluate: Multi-Target Planning with Post-Planning Success Evaluation Improves Learning-Based Grasping Pipelines

先规划再评估:通过规划后成功评估的多目标规划改进基于学习的抓取管道

Martin Matak, Mohanraj Devendran Shanthi, Karl Van Wyk, Tucker Hermans

机构 * NVIDIA

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究自主多指抓取问题,提出先规划到一组抓取目标,再由评估器估计成功可能性,机器人执行最可能成功轨迹的框架,该方法在多方面优于传统框架且能推广到新环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05396 2026-07-07 cs.CV cs.AI cs.LG cs.RO 新提交 70%

From Fixed to Free Cameras: Calibration-Free View-Robust Vision-Language-Action Model

从固定相机到自由相机:无需标定的视图鲁棒视觉-语言-动作模型

Wenhao Li, Xueying Jiang, Quanhao Qian, Deli Zhao, Shijian Lu, Gongjie Zhang, Ran Xu

机构 * Nanyang Technological University(南洋理工大学) DAMO Academy, Alibaba Group(阿里巴巴达摩院) HuPan Lab(湖畔实验室) Alibaba Group(阿里巴巴集团)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 针对真实机器人部署中相机位姿变动问题,提出CamVLA模型,解耦操控控制与相机几何,实现无标定视图鲁棒的机器人任务执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30900 2026-07-02 cs.RO 新提交 70%

The Quadruped Soft Tail: Compliant Grasping and Swabbing for Contamination Surveys in Harsh Environments

四足软尾巴:用于恶劣环境中污染调查的柔顺抓取与擦拭

Harald Minde Hansen, Nandita Gallacher, Kristin Y. Pettersen, Jan Tommy Gravdahl, Mario di Castro

机构 * Mechatronics, Robotics and Operation Section, European Organization for Nuclear Research (CERN)(欧洲核子研究中心(CERN)机电一体化、机器人与操作部门) Department of Engineering Cybernetics, Norwegian University of Science and Technology (NTNU)(挪威科技大学(NTNU)工程控制论系)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种安装在四足机器人上的轻量、柔软、肌腱驱动的尾巴,通过空心柔性骨架和软体夹爪实现污染拭子的抓取、擦拭和回收,结合运动学模型和任务空间控制器实现遥操作,验证了抓取对形状影响小且共模驱动可调节刚度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26284 2026-07-02 cs.RO 版本更新 70%

PhyPush: One Push is All You Need for Sensorless Physical Property Estimation with Physics-Guided Transformers

PhyPush:基于物理引导的Transformer,一次推动即可实现无传感器物理属性估计

Koyo Fujii, Luis Figueredo, Praminda Caleb-Solly, Ivan Boschi, Edoardo Ida', Marco Carricato, Aly Magassouba

机构 * School of Computer Science, University of Nottingham(诺丁汉大学计算机科学学院) Dept. of Industrial Engineering, University of Bologna(博洛尼亚大学工业工程系)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出PhyPush框架,利用物理引导的Transformer从单次推动的末端执行器速度估计物体质量和摩擦系数,通过牛顿第二定律和库仑摩擦模型约束提升物理一致性和泛化能力。

Comments Accepted to 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19124 2026-07-02 cs.RO 版本更新 70%

Tendon-Actuated Robots with a Tapered, Flexible Polymer Backbone: Design, Fabrication, and Modeling

具有锥形柔性聚合物背架的肌腱驱动机器人:设计、制造与建模

Harald Minde Hansen, Nandita Gallacher, Nicholas B. Andrews, Kristin Y. Pettersen, Jan Tommy Gravdahl, Mario di Castro

机构 * Mechatronics, Robotics and Operation Section, European Organization for Nuclear Research (CERN)(欧洲核子研究组织(CERN)机电学、机器人学与操作部门) Department of Aeronautics and Astronautics, University of Washington(华盛顿大学航空与航天系) Department of Engineering Cybernetics, Norwegian University of Science and Technology (NTNU)(挪威科学技术大学(NTNU)工程 cybernetics 部门)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出了一种3D打印的肌腱驱动连续机器人,采用柔性锥形背架,通过几何锥形设计实现高曲率和增强的末端合规性,支持多种合规性机器人检测和操作任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03591 2026-07-02 cs.RO cs.SY eess.SY 版本更新 70%

Manifold-constrained Hamilton-Jacobi Reachability Learning for Decentralized Multi-Agent Motion Planning

流形约束的 Hamilton-Jacobi 可达性学习用于去中心化多智能体运动规划

Qingyi Chen, Ruiqi Ni, Junyoung Kim, Ahmed H. Qureshi

机构 * Purdue University(普渡大学)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 提出流形约束的 HJR 学习框架,通过求解流形约束下的 HJR 问题获取任务感知安全条件,并集成到去中心化轨迹优化规划器中,实现安全且任务可行的多智能体运动规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31723 2026-07-01 cs.RO 新提交 70%

UniTacVLA: Unified Tactile Understanding and Prediction in Vision Language Action Models

UniTacVLA:视觉语言动作模型中的统一触觉理解与预测

Xidong Zhang, Yichi Zhang, Jiaxin Shi, Fucai Zhu, Siyu Zhu, Michael Yu Wang, Xiaojun Wu, Weihao Yuan

机构 * Harbin Institute of Technology(哈尔滨工业大学) Great Bay University(大湾区大学) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) Nanjing University(南京大学) Daimon Robotics

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出统一触觉学习框架,通过触觉链式推理和由粗到细的未来触觉预测构建状态与动力学感知先验,并设计触觉-动作混合控制器,在接触丰富操作任务中提升成功率、精度和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31132 2026-07-01 cs.RO 新提交 70%

ELASTIC: Efficiently Learning to Adaptively Scale Test-Time Compute for Generative Control Policies

ELASTIC: 高效学习自适应缩放测试时计算以生成控制策略

Andrew Zou Li, Gokul Swamy, Yonatan Bisk, Andrea Bajcsy

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 机器人操作 :manipulation(abstract);robot policy(abstract);分类 cs.RO

AI总结 提出ELASTIC算法,通过元强化学习为生成控制策略学习状态依赖的测试时计算调度,在扩散策略和视觉-语言-动作模型上实现帕累托最优,减少34%延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04991 2026-07-01 cs.RO 版本更新 70%

Wavelet Policy: Imitation Learning in the Scale Domain with World Prior Memory

小波策略:基于世界先验记忆的尺度域模仿学习

Changchuan Yang, Haoxuan Xu, Yuhang Dong, Guanzhong Tian, Haizhou Ge, Hongrui Zhu

机构 * Zhejiang University(浙江大学) Tsinghua University, DISCOVER Robotics(清华大学,DISCOVER机器人实验室) Hangzhou TaiWeave Robotics Co., Ltd.(杭州太 weave 机器人有限公司)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出小波策略,结合世界先验记忆与小波多尺度动作建模,通过编码静态背景图像中的持久物理场景结构,提升长周期机器人操作的效率与效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07939 2026-07-01 cs.RO physics.flu-dyn 版本更新 70%

Unified Structural-Hydrodynamic Modeling of Underwater Underactuated Mechanisms and Soft Robots

水下欠驱动机构与软体机器人的统一结构-水动力学建模

Chenrui Zhang, Yiyuan Zhang, Yunfei Ye, Junkai Chen, Haozhe Wang, Cecilia Laschi

机构 * Department of Mechanical Engineering and Advanced Robotics Centre, National University of Singapore(新加坡国立大学机械工程系与先进机器人中心) Singapore-MIT Alliance for Research and Technology (SMART) Centre(新加坡-麻省理工学院研究与技术联盟中心)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种轨迹驱动的全局优化框架,基于CMA-ES同时识别弹性、阻尼和分布式水动力学参数,实现水下欠驱动机构和软体机器人的高保真建模,仅需单段视频。

Comments The first two listed authors contributed equally. Yiyuan Zhang is the corresponding author. This paper has been accepted to the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29871 2026-06-30 cs.AI 70%

AI Training Manager: Bounded Closed-Loop Control of Adaptive Training Recipes

AI训练管理器:自适应训练配方的有界闭环控制

Anjali Rao, Nikhil Kamalkumar Advani

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.AI

AI总结 提出一种基于LLM的有界监督控制器,通过结构化遥测和约束动作空间,动态调整学习率、正则化等超参数,解决训练中的过拟合、损失不平衡等问题,在语言建模和强化学习任务中提升性能。

Comments 12 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29868 2026-06-30 cs.RO 70%

Normalizing Flow-Enhanced Message Passing for Multirobot Collaborative Localization

基于归一化流增强消息传递的多机器人协同定位

Han Shen, Guanghui Wen, Liangming Chen, Ming Cao

机构 * Department of Systems Science, Southeast University(东南大学系统科学系) School of Automation, Southeast University(东南大学自动化学院) School of Automation and Intelligent Manufacturing and Guangdong Provincial Key Laboratory of Fully Actuated System Control Theory and Technology, Southern University of Science and Technology(南方科技大学自动化与智能制造学院及广东省全驱动系统控制理论与技术重点实验室) Engineering and Technology Institute Groningen, Faculty of Science and Engineering, University of Groningen(Groningen大学工程与技术学院)

专题命中 机器人操作 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种融合高斯置信传播与平均场近似的分布式协同定位算法,通过归一化流梯度估计器处理非线性测量模型,并扩展至李群状态空间,实现多机器人定位的精度、鲁棒性和适应性提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29267 2026-06-30 cs.CV 70%

Enhancing Part-Level Point Grounding for Any Open-Source MLLMs

增强任意开源多模态大语言模型的部件级点定位能力

Jin-Cheng Jhang, Fu-En Wang, Xin Yang, Nan Qiao, Lu Xia, Min Sun, Cheng-Hao Kuo

机构 * National Tsing Hua University(国立清华大学) Amazon(亚马逊)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.CV

AI总结 提出一种通用方法,通过冻结原模型参数并引入Q-Synth模块和注意力到点解码器,为任意开源MLLM赋予精确的2D部件级点定位能力,显著提升部件级定位精度。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28899 2026-06-30 cs.RO 70%

You Only Touch Once: 6-DoF Object Pose Estimation from Single Tactile Contact

一次触碰:单次触觉接触的6自由度物体姿态估计

Pengfei Ye, Yuxiang Ma, Haonan Chen, Guangming Wang, Yixiong Jing, Brian Sheil, Yilun Du, Edward Adelson

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) Harvard University(哈佛大学) University of Cambridge(剑桥大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出YOTO系统,利用单次双点触觉接触通过粗到细网络定位接触点并闭式SVD求解器恢复6自由度物体姿态,在视觉失效场景下优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27566 2026-06-29 cs.RO 新提交 70%

Spacecraft Fiducial Marker for Autonomous Rendezvous, Proximity Operations, and Docking

用于自主交会、近距离操作和对接的航天器基准标记

Ravi Kumar Thakur, Matouš Vrba, Martin Saska

机构 * Department of Cybernetics, Faculty of Electrical Engineering, Czech Technical University in Prague(捷克理工大学电气工程学院控制论系)

专题命中 机器人操作 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 针对现有基准标记在近距离操作中易丢失的问题,提出基于Spidron递归自相似图案的AstraTag标记,结合GRS编码和TPS重映射,在曲面航天器上实现更高检测率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27144 2026-06-26 cs.RO 新提交 70%

PAMAE: Phase-Aware-MoE Action Experts Towards Reliable Flow-Matching Vision-Language-Action Policies

PAMAE: 面向可靠流匹配视觉-语言-动作策略的相位感知MoE动作专家

Jiayu Yang, Tao Yang, Xiang Chang, Fei Chao, Changjing Shang, Qiang Shen

机构 * Department of Artificial Intelligence, School of Informatics, Xiamen University(厦门大学信息学院人工智能系) Department of Computer Science, Aberystwyth University(阿伯里斯特威斯大学计算机科学系)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 针对多阶段机器人操作中VLA模型动作生成不可靠的问题,提出即插即用的相位感知混合专家动作模块PAMAE,通过稀疏专家混合和相位感知路由提升阶段一致性,在模拟任务中成功率提升9.2%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26188 2026-06-26 cs.RO physics.app-ph 新提交 70%

Morphology-Specific Closed-Loop Control of Logarithmic-Spiral Continuum Arms via Online Jacobian Error Compensation

对数螺旋连续体臂的形态特异性闭环控制:基于在线雅可比误差补偿

Partha Datta, Yi Jin, Wei Lin, C. Chase Cao

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出首个针对对数螺旋连续体臂的形态特异性闭环任务空间控制框架,通过分段腱驱动模型和在线雅可比误差补偿实现精确鲁棒控制,在轨迹跟踪、姿态调节等任务中优于分段常曲率基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22540 2026-06-26 cs.CV 新提交 70%

PolicyTrim: Boosting Intrinsic Policy Efficiency of Vision-Language-Action Models

PolicyTrim: 提升视觉-语言-动作模型的内在策略效率

Xianghui Wang, Feng Chen, Wenbo Zhang, Hua Yan, Zixuan Wang, Changsheng Li, Yinjie Lei

机构 * Sichuan University(四川大学) Adelaide University(阿德莱德大学) Beijing Institute of Technology(北京理工大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.CV

AI总结 提出PolicyTrim框架,通过强化学习后训练扩展动作块可靠长度并减少冗余物理步骤,实现高达5.83倍的端到端部署加速且不降低任务成功率。

Comments Accepted by ECCV 2026. Project page: https://inceptionwang.github.io/PolicyTrim/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11755 2026-06-26 cs.CV 版本更新 70%

Controllable Egocentric Video Generation via Occlusion-Aware Sparse 3D Hand Joints

可控的第一人称视角视频生成:基于遮挡感知的稀疏3D手部关节点

Chenyangguang Zhang, Botao Ye, Boqi Chen, Alexandros Delitzas, Fangjinhua Wang, Marc Pollefeys, Xi Wang

机构 * ETH Zurich(苏黎世联邦理工学院) MPI for Informatics(信息研究所) Microsoft(微软)

专题命中 机器人操作 :world model(abstract);robotic(abstract);分类 cs.CV

AI总结 提出利用稀疏3D手部关节点作为显式控制信号,通过遮挡感知特征提取和3D加权机制,实现高保真、3D一致的第一人称手物交互视频生成。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11906 2026-06-26 cs.RO 版本更新 70%

Visual-Language-Guided Task Planning for Horticultural Robots

面向园艺机器人的视觉-语言引导任务规划

Jose Cuaran, Kendall Koe, Aditya Potnis, Naveen Kumar Uppalapati, Girish Chowdhary

机构 * the Siebel School of Computing and Data Science(塞比尔计算与数据科学学院) the Department of Agricultural and Biological Engineering(农业与生物工程系) National Center for Supercomputing Applications(国家超级计算中心)

专题命中 机器人操作 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种模块化框架,利用视觉语言模型(VLM)主动查询异构数据源来引导机器人任务规划,在单作和混作环境中进行短期和长期作物监测任务基准测试,发现零样本VLM在短期任务中表现稳健(成功率87%),但长期多目标任务成功率低于10%,且依赖噪声语义地图时性能下降。

Comments 18 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏