arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Intelligent Robots and Systems · 会议 · Robotics

共收录 190
2607.03470 2026-07-07 cs.CV 新提交

PhysMirror: Physics-Aware Mirror Object Generation

物理镜像:物理感知镜像对象生成

Xuan-Bach Mai, Duy-Phuc Nguyen, Quoc-Van Le, Tam V. Nguyen, Thanh-Toan Do, Huu Le, Duong-Van Nguyen, Minh-Triet Tran, Trung-Nghia Le

机构 * University of Science, Ho Chi Minh City(胡志明市科学大学) Vietnam National University, Ho Chi Minh City(胡志明市越南国家大学) University of Dayton(代顿大学) Monash University(莫纳什大学) VinFast(VinFast公司) VinUniversity(Vin大学)

AI总结 针对现代文本到图像扩散模型合成物理精确镜像反射的挑战,提出物理感知生成框架PhysMirror,通过3D空间先验执行投影几何,引入评估指标,实验表明其在反射精度等方面优于基线。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03204 2026-07-07 cs.RO 新提交

Layout-independent actuation allocator for fin-actuated marine robots

用于鳍驱动海洋机器人的与布局无关的驱动分配器

Yuya Hamamatsu, Maarja Kruusmaa, Asko Ristolainen

机构 * Department of Computer Systems, Tallinn University of Technology(计算机系统系,塔林理工大学)

AI总结 研究提出与布局无关的控制分配器,用含图神经网络、Transformer和混合密度网络的学习管道及可微物理代理模型,实现跨不同执行器配置零样本部署,提升轨迹跟踪性能。

Comments Accepted by 2026 International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03072 2026-07-07 cs.MA cs.RO 新提交

LOTUSim: Multi-Domain Simulator for Marine Robotics

LOTUSim:海洋机器人多域模拟器

Cédric Buche, Juliette Grosset, Hélène Lechêne, Marie Dubromel, Pierig Havez-Bodivit, Malcom Neo, Julien Prodhon

机构 * CROSSING IRL 2010, CNRS(CROSSING IRL 2010,CNRS) Naval Group, France(法国海军集团) IMT Atlantique(IMT阿蒂旺)

AI总结 介绍LOTUSim多域海洋模拟器,其贡献一是支持多用户跨系统交互,确保实时性与可扩展性;二是有高效水下电流模型,验证显示相比常用模型精度大幅提升,适合海洋机器人研究。

Journal ref 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), IROS, Sep 2026, Pittsburgh (Etats-Unis), United States

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02322 2026-07-03 cs.RO cs.CV 新提交

The Moving Eye: Enhancing VLA Spatial Generalization via Hybrid Dynamic Data Collection

移动之眼:通过混合动态数据收集增强VLA空间泛化能力

Jincheng Tang, Yilong Zhu, Zhengyuan Xie, Jiang-Jiang Liu, Jiaxing Zhang

机构 * Lion Rock AI Lab, China Merchants Research Institute of Advanced Technology(狮岩人工智能实验室,中国商人先进科技研究院) The Hong Kong University of Science and Technology(香港科学与技术大学) Nankai University(南开大学)

AI总结 针对VLA模型空间泛化脆弱性问题,提出混合动态数据策略,结合连续相机运动与多样静态视角,减少虚假相关性,提升对未见相机位姿和物体配置的泛化能力。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01287 2026-07-03 cs.RO cs.AI cs.SY eess.SY 新提交

Adaptive Companionship for Group-Following Robots: Handling Dynamically Changing Group Formations

群体跟随机器人的自适应陪伴:处理动态变化的群体编队

Cong-Thanh Vu, Yen-Chen Liu

机构 * National Cheng Kung University(国立成功大学)

AI总结 提出基于视觉语言模型的自适应群体陪伴方法,通过语义推理推断同伴位置、维持社交距离并理解群体动态,结合MPPI控制器实现稳定安全跟随,在五个场景中成功率提升15%,碰撞率降低25%。

Comments Accepted to the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01574 2026-07-03 cs.RO math.OC 新提交

Multi-Rate Nonlinear Model Predictive Control for Wall-Supported Bipedal Locomotion of Quadrupedal Robots

多速率非线性模型预测控制用于四足机器人的墙壁支撑双足运动

Taizoon Chunawala, Jeeseop Kim, Kaveh Akbari Hamed

机构 * Virginia Tech(弗吉尼亚理工大学) The University of Texas at El Paso(德克萨斯大学埃尔帕索分校)

AI总结 提出基于多速率非线性模型预测控制的分层框架,实现四足机器人在受限环境中借助墙壁进行混合双足运动,通过接触点与质心轨迹联合优化提升动态稳定性,仿真验证成功率比传统方法高2.9倍。

Comments Accepted to IEEE/RSJ IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00022 2026-07-03 cs.RO 新提交

When to Personalize Household Object Search: A Rigidity-Gated Hybrid Policy

何时个性化家庭物品搜索:一种刚性门控混合策略

Xianyao Li, Yuhai Wang, Hu Xiao, Kaleb Smith, Gilbert Yang Ye, Eric Jing Du

机构 * University of Florida(佛罗里达大学) Northeastern University(东北大学) NVIDIA(英伟达)

AI总结 提出刚性门控混合策略PerSim,仅在物品放置行为多变时个性化,结合特质条件先验与人口频率基线,通过人类校准仿真和五大人格向量预测,降低搜索成本。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31912 2026-07-03 cs.RO 新提交

Learning Locomotion on Discrete Terrain via Minimal Proximity Sensing

通过最小接近感知学习离散地形上的运动

Jiale Fan, Connor Flynn, Tianao Xu, Junzhe He, Andrei Cramariuc, Marco Hutter, Robert Baines

机构 * Robotic Systems Lab, ETH Zurich(苏黎世联邦理工学院机器人系统实验室)

AI总结 本研究在四足机器人足部嵌入低成本红外接近传感器,提供预接触反馈,结合强化学习使机器人能预测地形不连续性,显著提升离散地形穿越鲁棒性。

Comments Accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22982 2026-07-03 cs.RO 新提交

Distilling Collaborative Dynamics into Latent Space for Implicit Coordination in Decentralized Multi-Agent Manipulation

将协作动态蒸馏到潜在空间以实现分散式多智能体操作中的隐式协调

Chanyoung Park, Minsung Yoon, Andrew Jeong, Sung-eui Yoon

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

AI总结 提出CLS-DP分散式多智能体框架,通过将多智能体动态蒸馏到潜在空间,在部分可观测下实现隐式协调,无需全局视图或通信,在RoboFactory任务中平均成功率38%,优于集中式基线20%。

Comments Accepted to IROS 2026 | Project Page: https://cosdeneb.github.io/cls-dp/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18955 2026-07-03 cs.CV cs.RO 新提交

Motion-Focused Latent Action Enables Cross-Embodiment VLA Training from Human EgoVideos

运动聚焦的潜在动作使跨实体VLA训练能从人类自我中心视频中学习

Runze Xu, Yiluo Zhang, Jian Wang, Yu Wang, Jincheng Yu

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Tianfu Jiangxi Laboratory(天府江西实验室)

AI总结 提出基于潜在动作的框架,利用混合解耦VQ-VAE从无标签人类视频中提取通用动作先验,通过意图-感知解耦策略减少动作幻觉,仅需50条轨迹即可适配下游任务。

Comments Accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01044 2026-07-02 cs.RO 新提交

Robots Ask the Way: Communication-Enabled Social Navigation

机器人问路:支持通信的社交导航

Valentino Sacco, Luca Scofano, Indro Spinelli, Fabio Galasso

机构 * Sapienza University of Rome(罗马大学)

AI总结 提出CommNav任务,让机器人通过主动与居民通信获取信息来定位目标个体,在Habitat 3.0c环境中评估,通信模块使导航成功率提升10个百分点,且对自然语言鲁棒。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00424 2026-07-02 cs.RO cs.SY eess.SY 新提交

Robust Operational Space Control with Conformal Disturbance Bounds for Safe Redundant Manipulation

具有共形扰动边界的鲁棒操作空间控制用于安全冗余操作

Wenhua Liu, Fan Zhang, Qin Lin

机构 * Department of Engineering Technology and the Department of Electrical and Computer Engineering, University of Houston(工程科技系和电气与计算机工程系,休斯顿大学)

AI总结 提出结合扩展状态观测器和共形预测的鲁棒操作空间控制框架,在动态不确定性下实现冗余机械臂的精确任务空间跟踪与安全保证。

Comments Paper accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00283 2026-07-02 cs.RO cs.AI cs.CV 新提交

What's Hidden Matters: Identifying Planning-Critical Occluded Agents using Vision-Language Models

隐藏之物至关重要:使用视觉语言模型识别规划关键性的被遮挡智能体

Amirhosein Chahe, Tyler Naes, Jovin D'sa, Faizan M. Tariq, Sangjae Bae, Lifeng Zhou, David Isele

AI总结 提出利用视觉语言模型(VLM)识别对自车轨迹影响最大的被遮挡智能体,通过规划KL散度(PKL)度量进行排序,并微调VLM以提升性能,实验表明该方法比随机采样提升约30%。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026). 9 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00191 2026-07-02 cs.RO cs.AI cs.CV cs.LG cs.MA 新提交

HydraCollab: Adaptive Collaborative-Perception for Distributed Autonomous Systems

HydraCollab:面向分布式自主系统的自适应协同感知

Luke Chen, Cheng-Ju Wu, David R. Martin, Qilin Ye, Pramod Khargonekar, Mohammad Abdullah Al Faruque

机构 * Department of Electrical Engineering and Computer Science, University of California, Irvine, USA(电气工程与计算机科学系,加州大学尔湾分校)

AI总结 提出HydraCollab框架,通过选择性传输最信息丰富的传感器特征和基于空间置信度图动态切换协作策略,在带宽受限下实现感知精度与通信开销的最佳权衡。

Comments Accepted at IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00066 2026-07-02 cs.RO 新提交

Learning Expert Strategy for Autonomous Robotic Endovascular Intervention via Decoupled Procedural Execution

通过解耦程序执行学习自主机器人血管内介入的专家策略

Yanxi Chen, Tianliang Yao, Shaolong Tang, Jiyuan Zhao, Hengyu Hu, Zhaoxing Li, Antonio J. Sánchez Egea, Peng Qi

机构 * Tongji University(同济大学) The Chinese University of Hong Kong(香港中文大学) Shanghai University(上海大学) Universitat Politècnica de Catalunya (UPC)(加泰罗尼亚理工大学)

AI总结 提出一种基于学习的专家策略,通过将高层策略决策与低层程序执行解耦,实现自主血管内导航,在仿真和真实机器人上达到>96%成功率并减少29.3%操作步骤。

Comments This paper has been accepted by IEEE/RSJ IROS 2026. 8 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00024 2026-07-02 cs.RO cs.MA cs.SY eess.SY 新提交

Decentralized Geometric Control for Cable-Suspended Payload Transport with Adaptive Mass Estimation

基于自适应质量估计的缆绳悬挂载荷运输的分散几何控制

Hadi Hajieghrary, Benedikt Walter, Paul Schmitt, Miguel Hurtado

机构 * MassRobotics

AI总结 提出GPAC四层分层架构,通过隐式协调实现多四旋翼无中心协调运输缆绳悬挂载荷,结合几何控制、自适应质量估计和CBF安全滤波,仿真显示低计算成本下平均跟踪误差33.8厘米。

Comments Accepted to be presented at IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31329 2026-07-02 cs.RO cs.AI 新提交

3D HAMSTER: Bridging Planning and Control in Hierarchical Vision Language Action Models through 3D Trajectory Guidance

3D HAMSTER:通过3D轨迹引导在分层视觉语言动作模型中桥接规划与控制

Dongyoon Hwang, Byungkun Lee, Dongjin Kim, Hyojin Jang, Hoiyeong Jin, Jueun Mun, Minho Park, Hojoon Lee, Hyunseung Kim, Jaegul Choo

机构 * Kim Jaechul Graduate School of AI, KAIST(韩国科学技术院金载哲人工智能研究生院) Graduate School of Artificial Intelligence, POSTECH(浦项工业大学人工智能研究生院) KRAFTON AI

AI总结 提出3D HAMSTER框架,通过让规划器直接输出度量可靠的3D轨迹,弥合2D引导与3D低层策略之间的差距,在3D轨迹预测、仿真和真实操作中优于现有方法。

Comments Published in IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026. Code: https://github.com/DAVIAN-Robotics/3D_HAMSTER. Project page: https://davian-robotics.github.io/3D_HAMSTER/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31807 2026-07-01 cs.RO 新提交

Reinforcement Learning-Based Control for an Inline Skating Humanoid Robot

基于强化学习的直排轮滑人形机器人控制

Ethan Marot, Thomas Bi, Clemens Schwarke, Victor Klemm, Marco Hutter, Raffaello D'Andrea

机构 * Institute for Dynamic Systems and Control, ETH Zurich(苏黎世联邦理工学院动态系统与控制研究所) Robotic Systems Lab, ETH Zurich(苏黎世联邦理工学院机器人系统实验室)

AI总结 提出一种强化学习控制策略,使配备被动直排轮滑鞋的人形机器人实现动态、高效的轮滑运动,无需人类数据或模仿学习,相比行走能耗降低50%,并零样本迁移到真实硬件。

Comments 8 pages, 7 figures, 7 tables, Accepted at IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31357 2026-07-01 cs.SE 新提交

A Self-Negotiation Framework for Ethical Decision-Making during Task Interruptions in Service Robots

服务机器人任务中断期间伦理决策的自我协商框架

Nele Reichert, Mashal Afzal Memon, Marco Autili, Nico Hochgeschwender

AI总结 提出一种自我协商框架,通过内部协商过程解决服务机器人面对多用户中断时的伦理冲突,实现自主、符合用户伦理偏好的决策。

Comments Accepted at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31158 2026-07-01 cs.RO cs.AI 新提交

LLM-Powered Interactive Robotic Action Synthesis from Multimodal Speech, Gestures, and Music

基于多模态语音、手势和音乐的LLM驱动交互式机器人动作合成

Snehasis Banerjee, Ranjan Dasgupta

机构 * TCS Research, Tata Consultancy Services(塔塔咨询服务公司TCS研究院)

AI总结 提出利用大语言模型融合语音、手势和音乐节拍等多模态输入,合成复杂机器人动作序列的框架,实现更自然的人机交互。

Comments IROS 2025 Workshop on Action and Interaction: Humans and Robots in Collaboration

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31144 2026-07-01 cs.RO cs.AI 新提交

A Modular Vision-Language-Action Robotics Framework for Indoor Environments

面向室内环境的模块化视觉-语言-动作机器人框架

Anindya Jana, Snehasis Banerjee, Arup Sadhu, Ranjan Dasgupta

机构 * TCS Research, Tata Consultancy Services(塔塔咨询服务公司TCS研究部) CMU(卡内基梅隆大学)

AI总结 提出模块化架构,集成环境建图、问题处理和导航,通过双流并行处理(语义体素建图与语言分类)实现自然语言指令驱动的自主任务执行。

Comments IEEE IROS 2025 Workshop on Generative AI for Robotics and Smart Manufacturing

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30937 2026-07-01 cs.CV 新提交

No Adaptation Without Observation: Observability-Constrained Test-Time Prompt Tuning for LiDAR Semantic Segmentation

无观测则无适应:面向LiDAR语义分割的观测约束测试时提示调整

Linlian Jiang, Wentao Ju, Sadman Rakib Pinon, Jianwei Xian, Zhixiang Chi, Xinxin Zuo, Yang Wang

机构 * Concordia University(康考迪亚大学) Mila – Quebec AI Institute(米拉-魁北克人工智能研究所) University of Toronto(多伦多大学)

AI总结 针对LiDAR语义分割在部署中性能下降的问题,提出一种几何约束的测试时提示调整框架,通过估计感知可靠性并加权空间监督,仅调整轻量提示适配器,实现稳定适应。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30754 2026-07-01 cs.CV cs.RO 新提交

Streaming Gaussian Encoding for 4D Panoptic Occupancy Tracking

流式高斯编码用于4D全景占据跟踪

Maximilian Luz, Thomas Nürnberg, Yakov Miron, Abhinav Valada

机构 * University of Freiburg(弗莱堡大学) Bosch Research, Robert Bosch GmbH(博世研究中心,罗伯特·博世有限公司) University of Haifa(海法大学)

AI总结 提出流式高斯编码器,通过持久化场景表示和置信度引导的预算约束,实现相机4D全景占据跟踪,在nuScenes和Waymo上达到新最优。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30698 2026-07-01 cs.RO 新提交

Vision-Language Procedural Reasoning for Context-Aware Reward Modeling of Robotic Endovascular Guidewire Navigation

面向机器人血管内导丝导航的视觉-语言程序化推理与上下文感知奖励建模

Wentong Tian, Jiyuan Zhao, Tianliang Yao, Yuxiang Fan, Zhengyu Shi, Dong Liu, Peng Qi

机构 * Department of Control Science and Engineering, College of Electronic and Information Engineering, and Shanghai Institute of Intelligent Science and Technology, Tongji University(同济大学电子与信息工程学院控制科学与工程系,以及上海智能科学与技术研究院) Department of Electronic Engineering, Faculty of Engineering, The Chinese University of Hong Kong(香港中文大学工程学院电子工程系) Shanghai Operation Robot Co., Ltd.(上海微创医疗机器人(集团)股份有限公司)

AI总结 提出视觉-语言程序化推理框架,利用多模态大模型实时理解视觉上下文,动态调整奖励权重,实现单策略适应复杂血管导航任务,提升可靠性与效率。

Comments This paper has been accepted by IEEE/RSJ IROS 2026. 7 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09620 2026-06-30 cs.RO cs.SY eess.SY 新提交

Motion planning for hundreds of floating robots

数百个浮动机器人的运动规划

Jan Kamm, Antonio Terpin, Raffaello D'Andrea, Aswin Ramachandran

机构 * Institute for Dynamic Systems and Control, ETH Zürich(苏黎世联邦理工学院动态系统与控制研究所)

AI总结 针对大型浮动机器人编队的无碰撞运动规划问题,提出一种可扩展的流水线方法,通过碰撞图分解为独立子问题并行求解,在500个机器人仿真和实际演示中验证了有效性。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27292 2026-06-26 cs.RO 新提交

BOWConnect: Parallel Bayesian Optimization over Windows with Learned Local Cost Maps for Sample-Efficient Kinodynamic Motion Planning

BOWConnect: 基于学习局部代价图窗口的并行贝叶斯优化用于样本高效的运动动力学运动规划

Sourav Raxit, Abdullah Al Redwan Newaz, Jose Fuentes, Leonardo Bobadilla

机构 * Louisiana State University New Orleans(路易斯安那州立大学新奥尔良分校) Florida International University(佛罗里达国际大学)

AI总结 提出BOWConnect双向并行运动动力学规划器,通过窗口贝叶斯优化学习局部代价图引导采样,解决高维空间样本效率低、动态约束下代价启发式不可靠及窄通道规划难题,在基准测试中实现100%成功率。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27079 2026-06-26 cs.RO 新提交

ForesightSafety-VLA: A Unified Diagnostic Safety Benchmark for Vision-Language-Action Models

ForesightSafety-VLA:视觉-语言-动作模型的统一诊断安全基准

Mingyang Lyu, Yinqian Sun, Yiyang Jia, Sicheng Shen, Moquan Sha, Huangrui Li, Feifei Zhao, Yi Zeng

机构 * Brain-inspired Cognitive AI Lab, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所类脑认知智能实验室) Beijing Key Laboratory of Safe AI and Superalignment(北京市安全人工智能与超级对齐重点实验室) Beijing Institute of AI Safety and Governance(北京人工智能安全与治理研究所) Gaoling School of AI, Renmin University of China(中国人民大学高瓴人工智能学院) University of Chinese Academy of Sciences (UCAS)(中国科学院大学)

AI总结 提出ForesightSafety-VLA基准,通过13类安全分类和三维变量控制,诊断VLA模型在物理交互、指令和感知侧的安全风险,并引入累积安全成本和风险暴露时间等过程级指标。

Comments 8 pages, 5 figures, 4 tables. Submitted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26858 2026-06-26 cs.RO 新提交

PlanRL: A Trajectory Planning Architecture for Reinforcement Learning-based Driving Experts

PlanRL: 一种用于基于强化学习的驾驶专家的轨迹规划架构

Joonhee Lim, Yongjae Lee, Jangho Shin, Dongsuk Kum

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院) Hyundai Motor Company(现代汽车公司)

AI总结 提出一种将强化学习策略与多项式轨迹规划器结合的轨迹规划架构,通过Frenet坐标系简化道路几何并加入运动学可行性检查,在CARLA基准上驾驶评分提升5%-11%,成功率提升8%-19%。

Comments Accepted at IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26800 2026-06-26 cs.RO 新提交

SSI-Policy: Learning Structured Scene Interfaces for Vision-Language Robotic Manipulation

SSI-Policy: 学习用于视觉语言机器人操作的结构化场景接口

Kaijun Wang, Zikai Ouyang, Xuping Wu, Jinyi Hong, Wei Pan, Haibo Lu, Jia Pan, Wei Zhang, Linfang Zheng

机构 * Southern University of Science and Technology(南方科技大学) Peng Cheng Laboratory(鹏城实验室) The University of Hong Kong(香港大学) LimX Dynamics

AI总结 提出SSI-Policy框架,通过统一的结构化场景接口(SSI)联合编码单目深度、语言锚定的物体布局和指令条件化的2D运动轨迹,实现从少量演示中学习机器人操作,在LIBERO基准上仅用10个演示即提升15%性能。

Comments Accepted by 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25629 2026-06-26 cs.RO eess.SP 新提交

Event-Adaptive Motion Planning with Distilled Vision-Language Model in Safety-Critical Situations

安全关键场景下基于蒸馏视觉语言模型的事件自适应运动规划

Zhenwei Huang, Changsheng You, Shuai Wang, Chao Zhou, Wei Xu, Yi Gong

机构 * Southern University of Science and Technology(南方科技大学) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Manifold Tech Limited(曼孚科技股份有限公司)

AI总结 提出事件自适应运动规划(EAMP)框架,通过可配置语义事件触发器、蒸馏视觉语言模型和语义模型预测控制,在安全关键场景中实现高层推理与底层控制的协同,提升动态安全裕度并保持实时性。

Comments 8 pages, 8 figures, 4 tables. Accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏