arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-24 至 2026-08-24 共收录 40 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2608.21083 2026-08-24 cs.RO cs.HC 新提交 79%

Teaching is a Process: The TOSS Framework for Modeling Human Teaching Decisions in Human-Interactive Robot Learning

教学是一个过程:用于建模人机交互机器人学习中人类教学决策的TOSS框架

Bernhard Hilpert, Kim Baraka, Joost Broekens

机构 * LIACS, Leiden University(莱顿大学LIACS学院) VU Amsterdam(阿姆斯特丹自由大学)

专题命中 机器人学习 :robot learning(title,abstract);分类 cs.RO

AI总结 本研究通过34名参与者的实验揭示人类教学决策的构成,提出TOSS框架,为理解教学决策、模拟神谕及设计机器人学习算法提供数据集与理论基础。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 12 篇

2608.20546 2026-08-24 cs.RO 新提交 88%

Koala Gripper: Co-designing Robotic Grippers and Data-Capture Devices for Scaling Dexterous Manipulation Learning

考拉夹持器:为扩展灵巧操作学习而协同设计机器人夹持器与数据采集装置

Amar Hajj-Ahmad, Zubin Kremer Guha, Tim Fofonoff, Zhi Ern Teoh, Ciarán T. O'Neill, Ben Thacher, Igor Fala, Vidullan Surendran, Murphy Wonsick, Peter Whitney, David Watkins

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出协同设计框架,开发Koala Gripper系统,该系统兼具数据采集与机器人夹持器功能,可提升灵巧操作能力,经端到端管道验证能支持演示学习,助力扩展操作数据集规模。

Comments Paper website: this http URL (http://koalagripper.rai-inst.com) Paper video: this http URL (http://www.youtube.com/watch?v=ZoygFCWAVhg)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20929 2026-08-24 cs.CV 新提交 79%

GAP-SAM: A Global Artifact Prior for Generalizable AI-Generated Image Manipulation Localization

GAP-SAM:用于通用AI生成图像篡改定位的全局伪影先验

Haozhen Yan, Siyuan Shan, Zijian Yu, Youqi Wang, Yan Hong, Jun Lan, Jianfu Zhang

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.CV

AI总结 本研究针对AI生成图像篡改定位的分布外性能问题,提出GAP-SAM方法,通过构建COCO-ControlNet对齐语义与几何,利用全局伪影标记抑制语义边界捷径,在六个数据集上平均像素F1达79.8,优于现有方法且在各类图像退化下表现最佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20558 2026-08-24 cs.CV 新提交 79%

Zero-Shot Color Image Manipulation Localization via Noise Residual Artifact Pattern Analysis

基于噪声残留伪影模式分析的零样本彩色图像篡改定位

Edgar Gonzalez-Fernandez

机构 * INFOTEC Centro de Investigación e Innovación en Tecnologías de la Información y Comunicación(墨西哥信息通信技术研究与创新中心)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.CV

AI总结 本研究提出一种零样本、无需训练的盲彩色图像篡改定位流程,通过噪声残留伪影模式分析实现,无需训练数据或设备注册,在与现有最先进被动方法的对比中展现出竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20962 2026-08-24 cs.RO 新提交 70%

Hybrid Roller-Jamming Gripper for Object Acquisition and Retention Under Pose Uncertainty

用于位姿不确定下物体抓取与保持的混合滚轮-颗粒阻塞夹爪

Yijie Ren, Guillaume Gourmelen, Hiroyasu Iwata

机构 * Waseda University(早稻田大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 该研究提出集成主动引入与抓取后保持功能的混合滚轮-颗粒阻塞夹爪,经840次抓取试验评估,在平面与方向偏移下成功率达96.7%,证明其可改善位姿不确定下的物体抓取与保持效果。

Comments 11 pages, 16 figures, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20817 2026-08-24 cs.CR cs.RO 新提交 70%

GhostTac: Manipulating Tactile Sensors without Physical Contact

GhostTac:无物理接触的触觉传感器操纵技术

Kun Wang, Xuancun Lu, Ruochen Zhou, Kai Wang, Tongjun Ye, Yihao Shao, Chen Yan, Xiaoyu Ji, Wenyuan Xu

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究人员提出首个非接触式触觉传感器操纵攻击GhostTac,利用电磁干扰引发测量偏差,在15个传感器上验证有效性,揭示机器人触觉传感的新型物理攻击向量。

Comments Accepted at ACM CCS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21332 2026-08-24 cs.AI cs.CV cs.RO 新提交 67%

Anatomy-Informed Neural Networks: Encoding Anatomic Priors in Loss and Architecture, with an SE(3) Formulation of Guidewire-Induced Aortoiliac Deformation

解剖学先验引导神经网络:在损失函数与架构中编码解剖学先验,并结合导丝诱导主髂动脉变形的SE(3)公式

David P. Stonko

机构 * The Johns Hopkins Hospital(约翰斯·霍普金斯医院)

专题命中 机器人操作 :navigation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 该研究提出解剖学先验引导神经网络(AINN),结合SE(3)公式处理导丝诱导主髂动脉变形问题,通过编码解剖学先验提升模型在数据稀缺时的泛化能力,为自主血管内导航提供支撑。

Comments 42 pages, 10 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21204 2026-08-24 cs.RO cs.LG 新提交 62%

Beyond Imitation: Self-Improving Robot Policies via Off-Policy Q-Planning

超越模仿:基于离线Q规划的机器人策略自改进

Varun Giridhar, Anant Khandelwal, Jeremy A. Collins, Ignat Georgiev, Animesh Garg

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.LG

AI总结 该研究提出Q规划方法,为大型视觉运动BC策略配备离线Q函数,通过仅微调Q函数实现自改进,在仿真和真实机器人任务中均显著提升机器人操作性能,且优于多种对比方法。

Comments Project page with videos: this https URL (https://varungiridhar.github.io/qplanning/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20913 2026-08-24 cs.CV cs.AI 新提交 62%

Explainable Deepfake Detection with Feature-robust Augmentation and Evidence-grounded Explanation Optimization

基于特征鲁棒增强与证据支撑的解释性深度伪造检测

Zhu Xu, Jiaqi Tang, Pokai Chen, Yuxin Peng, Yang Liu

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王选计算机研究所)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.CV

AI总结 该研究针对深度伪造检测的鲁棒性与可解释性缺陷,提出含特征鲁棒增强、证据支撑偏好优化的框架,在ACM Multimedia 2026相关任务中获第一名。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21355 2026-08-24 cs.RO 新提交 57%

ViTacPhys: Physical Property-Aware Grasping from Human Visual-Tactile Demonstrations

ViTacPhys:基于人类视觉-触觉演示的感知物体物理属性的抓取方法

Yiwen Liu, Yujun Zhu, Kui Jia, Zhao Liao, Yangwei You, Shuaijun Wang

机构 * Xiaomi Robotics(小米机器人)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 该研究提出ViTacPhys视觉-触觉框架,可从人类演示中估计物体物理属性,迁移至机器人后实现高抓取成功率,力曲线更贴合人类遥操作。

Comments 11 pages, 7 figures. Project page: this https URL (https://vitacphys.github.io/ViTacPhys/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20946 2026-08-24 cs.RO 新提交 57%

Fast Coordinated Bimanual Motion Planning With Hard Constraints

带硬约束的快速双协作机械臂运动规划

Borna Paro, Luka Petrović, Ivan Marković

机构 * University of Zagreb(萨格勒布大学) Faculty of Electrical Engineering and Computing(电气工程与计算机学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 针对双臂操作的相对变换硬约束问题,提出主从参数化的快速规划流水线,仿真中规划速度提升19.4倍,实际实验验证轨迹可直接迁移至硬件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20433 2026-08-24 cs.RO cs.HC cs.MM cs.SD 新提交 57%

Humanoid Musical Robots as Experimental Interfaces for Music-Evoked Emotion

类人音乐机器人作为音乐诱发情绪研究的实验接口

Vincent K.M. Cheung, Jia-Yeu Lin

机构 * Sony Computer Science Laboratories(索尼计算机科学实验室) Waseda University(早稻田大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 本文提出将类人音乐机器人作为音乐诱发情绪研究的实验接口,通过WAS-5案例验证其技术可行性,为该领域可控研究提供方法论平台。

Comments Opinion paper accepted for presentation at the Sound and Music Computing (SMC) Conference 2026 (5-7 November in Zagreb, Croatia)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20678 2026-08-24 cs.CR cs.SE 新提交 50%

The Software Supply Chain as a Market for Lemons: A Multivocal Review of Trust Signal Collapse

软件供应链作为“柠檬市场”:信任信号崩溃的多视角综述

Ranindya Paramitha, Christian Kästner, Laurie Williams

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过多视角综述252个谷歌搜索来源和870个Reddit线程,揭示开源依赖项的廉价信任信号因三种力量崩溃,提出需强制实施加密证明等成本更高的信号。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 8 篇

2608.21358 2026-08-24 cs.RO 新提交 70%

Mining beyond Earth with Space Robots: Exploration, Sampling, and Extraction

利用太空机器人开展地外采矿:探测、采样与提取

Dong Li, Dujun Nie, Xiaotong Zhang, Ruilin Wang, Yuchen Li, Chang Ge, Chao Xiong, Kaichang Di, Andreas Nüchter, Levente Kovács, Qingquan Li, Shirong Ge, Fei-Yue Wang, Long Chen

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) OpenSpace Lab(OpenSpace实验室) School of Computation, Information and Technology, Technical University of Munich(慕尼黑工业大学计算、信息与技术学院) University Research and Innovation Center, Obuda University(欧布达大学大学研究与创新中心) School of Mechanical Engineering and Automation, Beihang University(北京航空航天大学机械工程及自动化学院) School of Earth and Space Sciences, Wuhan University(武汉大学地球与空间科学学院) Faculty of Mathematics and Computer Science, University of Würzburg(维尔茨堡大学数学与计算机科学学院) School of Architecture & Urban Planning, Shenzhen University(深圳大学建筑与城市规划学院) School of Mechanical and Electrical Engineering, China University of Mining and(中国矿业大学机电工程学院)

专题命中 具身导航 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 本文全面概述太空采矿机器人及相关技术,定义太空采矿六阶段架构,整理研究资源,明确关键挑战并规划战略路线图,推动可持续地外经济发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21031 2026-08-24 cs.RO 新提交 70%

PhysCaP: Grounding Code-as-Policy Agent with Physics-Informed Exploration

PhysCaP:基于物理引导探索的代码即策略智能体

Chen-Yu Lin, Jing-Wen Chen, Hsueh-En Chang, Hung-An Chen, Sheng-Hsun Chang, Chi-Pin Huang, Fu-En Yang, Min-Hung Chen, Yi-Ting Chen, Yu-Chiang Frank Wang, Shao-Hua Sun

机构 * National Taiwan University(台湾大学) NVIDIA Research(英伟达研究院) National Yang Ming Chiao Tung University(国立阳明交通大学)

专题命中 具身导航 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 PhysCaP是一种带物理引导探索层的代码即策略智能体,采用双智能体设计,可高效估算物体物理属性,在桌面操纵及LIBERO模拟任务中性能优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20379 2026-08-24 cs.AI 新提交 70%

A Survey on Foundations and Frontiers of Multimodal Agentic Frameworks: Techniques and Applications

多模态智能体框架的基础与前沿:技术及应用综述

Neel Mokaria, Rishie Raj, Dheeraj Baiju, Xiaoqian Shen, Shraman Pramanick, Kevin Qinghong Lin, Arda Senocak, Mike Zheng Shou, Philip Torr, Mohamed Elhoseiny, Yapeng Tian, Ruohan Gao, Salman Khan, Sayan Nag, Sanjoy Chowdhury, Dinesh Manocha

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.AI

AI总结 本综述针对多模态在智能体框架核心模块的作用展开系统分析,梳理了其架构整合方式、应用领域及效率权衡,为通用智能系统研究指明方向。

Comments Accepted at TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21066 2026-08-24 cs.CV 新提交 57%

Robust Validation to Geometric Perturbations for Autonomous Pose Estimation

面向自主位姿估计的几何扰动鲁棒性验证

Gregoire Theau, Melanie Ducoffe

机构 * Airbus SAS(空中客车公司) IRT Saint-Exupery(圣埃克苏佩里技术研究院)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 本文针对自主位姿估计的几何扰动鲁棒性验证问题,提出基于全局利普希茨优化(GLO)的方法,在YOLOv8-Pose模型上验证其可高效定位失效模式并剪枝80%以上搜索空间,为鲁棒自主感知验证提供了新途径。

Comments 15 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20640 2026-08-24 cs.IR cs.AI 新提交 57%

One Hierarchy, Two Systems: Semantic Product IDs for Discovery-Surface Ranking and Search-Page Query Reformulation

一个层级,两个系统:用于发现面排序和搜索页查询改写的语义产品ID

Steven Xu, Sanjyot Thete, Saathvik Dirisala, Raghav Saboo, Nimesh Sinha, Leo Shao, Elyse Winer, Sudeep Das, Martin Wang, Kyle MacDonald

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 本研究提出单一语义产品层级\textit{\texttt{sid}},分别用于电商发现面排序与搜索页查询改写,经离线及在线实验验证,可提升排序相关性、加购参与度及查询意图保留等性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20478 2026-08-24 cs.RO 新提交 57%

EndoLIFT: Language-Disambiguated Latent-Conditioned Rectified Flow for Bidirectional Endoscopic Control

EndoLIFT:用于双向内镜控制的语言消歧潜在条件修正流

Chi Kit Ng, Yidong Zhang, Lui Siu Hing, Jinsong Lin, Tianchun Wu, Ho Yin Chim, Zhiqing Tang, Tao Yang, Huxin Gao, Trevor Yeung, Raymond Shing-Yan Tang, Hongliang Ren

机构 * The Chinese University of Hong Kong(香港中文大学) The Sixth Affiliated Hospital, Sun Yat-sen University(中山大学附属第六医院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 EndoLIFT是一种视觉-语言-动作策略,通过结合语言意图条件与潜在条件修正流,解决双向内镜控制的意图混叠问题,在导航准确率、错误方向减少及多 phantom 试验中均取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20467 2026-08-24 eess.SY cs.RO 新提交 57%

Learning-Based Measurement-Robust Control Barrier Functions for Obstacle Avoidance under State Estimation Error

面向状态估计误差下避障的基于学习的测量鲁棒控制障碍函数

Nicholas Rober, Yixuan Jia, Jonathan P. How

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文针对状态估计误差下避障的安全控制问题,提出DMR-CBF与NMR-CBF两种新型CBF,经理论分析、数值实验与Unitree Go2部署验证,其在保障安全性的同时降低了保守性与计算成本。

Comments 8 Pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20751 2026-08-24 cs.HC 新提交 50%

Adaptive Training for Nautical Rules of the Road

航海避碰规则的自适应训练

Amit Dutta, Sushil J. Louis

专题命中 具身导航 :navigation(abstract)

AI总结 本研究针对航海避碰规则,通过对比30名学生的自适应与非自适应船舶驾驶模拟训练,发现自适应训练的后测分数及学生认可度均显著更高,验证了调整场景难度与情境反馈的训练价值。

Comments 16 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 具身推理 5 篇

2608.20936 2026-08-24 cs.AI cs.RO 新提交 81%

Graph-Operator World Models for Morphology-Parameter Generalization in Continuous Control

用于连续控制中形态参数泛化的图算子世界模型

Xu Yang, Yiqin Yang, Qianchuan Zhao

机构 * Tsinghua University(清华大学) Chinese Academy of Sciences(中国科学院)

专题命中 具身推理 :world model(title,abstract);分类 cs.RO、cs.AI

AI总结 提出GraphOp-WM结构化世界模型,通过分解转移为形态无关局部基与形态相关算子,实现连续控制中铰接机器人家族的形态参数泛化,定义MuJoCo参数划分验证方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20401 2026-08-24 cs.AI cs.LG 新提交 81%

World models of environment, agent and joint agent-environment systems

环境、智能体及智能体-环境联合系统的世界模型

Manuel Baltieri, Filippo Torresan, Yivan Zhang, Alexander Boyd, Fernando E. Rosas

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文基于计算力学,将世界模型按建模信道分为三类,构建规范模型并通过POMDP示例说明耦合与支持限制可简化模型复杂度,为世界模型的本质提供了清晰框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21075 2026-08-24 cs.SD cs.LG 新提交 79%

AudioWorldSim: Realistic Binaural Audio Datasets For World Models

AudioWorldSim:用于世界模型的真实双耳音频数据集

Luis Vitor Zerkowski, Luiz Velho

机构 * VISGRAF IMPA(巴西纯数学与应用数学国家研究所)

专题命中 具身推理 :world model(title,abstract);分类 cs.LG

AI总结 本研究提出开源平台AudioWorldSim,作为SoundSpaces 2.0的自定义扩展,用于生成真实双耳音频数据集,助力基于音频的机器学习尤其是世界模型研究,相关资源已公开以提升可重复性。

Comments 7 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20709 2026-08-24 math.OC 新提交 78%

ResiliFlow: An Open Transport World Model for Infrastructure Perception and Disaster Resilience

ResiliFlow:面向基础设施感知与灾害韧性的开放交通世界模型

Junxiang Xu, Vinayak Dixit, S. Travis Waller, Divya Jayakumar Nair, Qianwen (Vivian)Guo, Sisi Jian, Xiao Wen, Ashutosh Ashutosh, Sunhyung Yoo, Julius Secadiningrat, Jingni Guo

专题命中 具身推理 :world model(title,abstract)

AI总结 ResiliFlow是面向基础设施感知与灾害韧性的开放交通世界模型平台,整合两类工作空间功能,实现交通模型的可检查复用,支撑研究协作与公众监督。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20891 2026-08-24 cs.RO cs.CV 新提交 62%

IMU-Free Body-Frame State Estimation with Sparse Scene Flow for Quadcopters

面向四旋翼无人机的基于稀疏场景流的无IMU机体坐标系状态估计

Daniel Grønhaug, Sofie Markeset, Mathias Kolberg

专题命中 具身推理 :world model(abstract);分类 cs.RO、cs.CV

AI总结 该研究提出一种无IMU的四旋翼仅视觉状态估计系统,采用扩展卡尔曼滤波与4视图光束平差法,生成机体坐标系状态估计与稀疏场景流,无需GPS等世界坐标系基础设施。

Comments 56 pages, 5 figures, 2 tables. Evaluated on the VID dataset ( arXiv:2103.11152 (https://arxiv.org/abs/2103.11152) )

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 机器人基础模型 3 篇

2608.20735 2026-08-24 cs.AI cs.RO 新提交 82%

ForeTime-VLA: Causal Future-Token Distillation from a World Action Model for Conveyor-Belt Manipulation

ForeTime-VLA:面向传送带操作的世界动作模型的因果未来令牌蒸馏

Siyuan Ma, Yutian Zhang, Boshi Zhang, Qinglian Wu, Jiaqi Zhai, Dong Wei, Xiaojin Huang

机构 * Tsinghua University(清华大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Harbin Institute of Technology(哈尔滨工业大学) Hangzhou Yunshenchu Technology Co., Ltd. (DEEP Robotics)(杭州云深处科技有限公司(深地机器人))

专题命中 机器人基础模型 :manipulation(title,abstract);分类 cs.RO、cs.AI

AI总结 该研究提出ForeTime-VLA策略,通过从冻结Fast-WAM教师模型蒸馏因果未来令牌,在传送带操控任务上降低了MAE和L2误差,提升了抓取成功率,验证了该方法的有效性。

Comments 8 pages, 5 figures. Introduces ForeTime-VLA, a causal future-token distillation method for conveyor-belt manipulation from a frozen world action model teacher

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21247 2026-08-24 cs.CV cs.RO 新提交 62%

Just Noticeable Difference Modeling for Token Compression in Vision-Language-Action Models

视觉-语言-动作模型中用于令牌压缩的刚可察觉差异建模

Zhuoyuan Li, Rui Zhao, Jin Wang, Hanwei Zhu, Cong Zhang, Giuseppe Valenzise, Weisi Lin, Kin-Man Lam

机构 * The Hong Kong Polytechnic University(香港理工大学) Nanyang Technological University(南洋理工大学) Bytedance Inc.(字节跳动公司) Shandong University(山东大学) CNRS(法国国家科学研究中心) CentraleSupelec(中央理工学院) Université Paris-Saclay(巴黎萨克雷大学)

专题命中 机器人基础模型 :embodied agent(abstract);分类 cs.RO、cs.CV

AI总结 本文针对视觉-语言-动作模型的令牌压缩问题,提出Action-JND方法,通过动作容忍度准则优化压缩,在LIBERO基准实验中提升了激进压缩下的压缩可靠性。

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20556 2026-08-24 cs.RO cs.LO eess.SY 新提交 57%

Logic-VLA: A Temporal Logic Conditioned Vision-Language-Action Model

Logic-VLA:一种时序逻辑条件下的视觉-语言-动作模型

Celina Shiyu Wang, Yiqi Zhao, Junjie Ye, Yue Wang, Jyotirmoy V. Deshmukh

机构 * University of Southern California(南加州大学)

专题命中 机器人基础模型 :navigation(abstract);分类 cs.RO

AI总结 Logic-VLA是感知形式化需求的VLA模型,以STL规约为条件,经两阶段适配后,在四旋翼导航仿真中大幅提升STL满足率,仅小幅降低常规NL任务成功率,可适配不同形式化需求。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 模仿学习与强化学习 2 篇

2608.20784 2026-08-24 cs.RO cs.LG 新提交 84%

Rethinking Demonstration Unlearning in Imitation Learning for Robotics

机器人模仿学习中演示数据遗忘的重新思考

Jiazhuo Li, Yu Zhang, Yiming Fei, Kangkang Dong, Xiaojun Zhu, Houde Liu, Jinze Tao

机构 * University of Michigan(密歇根大学) Zhejiang University(浙江大学) Wuhan University of Technology(武汉理工大学)

专题命中 模仿学习与强化学习 :robotics(title,abstract);robot policy(abstract);分类 cs.RO、cs.LG

AI总结 本研究针对机器人模仿学习的演示数据遗忘问题,提出双维度联合审计方法,在ACT机械臂实验中实现了20次试验18次成功的盲测恢复。

Comments 21 pages, 7 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏