arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-31 至 2026-08-31 共收录 72 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 16 篇

2608.27476 2026-08-31 cs.AI 新提交 70%

Class-Based Heuristic Selection for Solving the Flying Block Puzzle

求解飞行方块谜题的基于类的启发式选择

Sanyar Ahmadi, Pedram Asadzadeh, Amanj Khorramian

机构 * Faculty of Computer Engineering(计算机工程学院) University of Tehran(德黑兰大学) K. N. Toosi University of Technology(霍加·纳绥尔·丁·图西大学) Department of Electrical and Computer Engineering(电气与计算机工程学院) University of Kurdistan(库尔德斯坦大学)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.AI

AI总结 针对启发式搜索在空间规划中的性能问题,提出CBHA*算法,在146个飞行方块谜题基准实例上大幅提升成功率、减少节点扩展,为高效空间规划提供了可推广的自适应启发式机制。

Comments 27 pages, 15 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28270 2026-08-31 cs.RO cs.AI 新提交 62%

Spatial-Semantic Reasoning using Large Language Models for Efficient UAV Search Operations

基于大语言模型的空间语义推理用于高效无人机搜索任务

Marin Maletic, Marijana Peti, Tamara Petrovic, Stjepan Bogdan

机构 * University of Zagreb(萨格勒布大学) Faculty of Electrical Engineering and Computing(电气工程与计算机学院) LARICS (Laboratory for Robotics and Intelligent Control Systems)(拉里克机器人与智能控制系统实验室)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 该研究提出基于大语言模型的无人机实时语义导航框架,结合多技术实现高效目标导航,经仿真与真实实验验证可缩短任务时长且保持高搜索准确率。

Comments 8 pages, preprint, Published in: 2025 European Conference on Mobile Robots (ECMR), DOI: https://doi.org/10.1109/ECMR65884.2025.11163229

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28214 2026-08-31 cs.RO 新提交 61%

Probabilistic Multi-Robot Gas Source Localization with Uncalibrated Sensors: A Distributed Estimation Approach

采用未校准传感器的概率多机器人气源定位:一种分布式估计方法

Wanting Jin, Marc Zoel Arias Mitjà, Alcherio Martinoli

机构 * Distributed Intelligent Systems and Algorithms Laboratory(分布式智能系统与算法实验室) School of Architecture, Civil and Environmental Engineering(建筑、土木与环境工程学院) École Polytechnique Fédérale de Lausanne (EPFL)(洛桑联邦理工学院)

专题命中 具身导航 :robotic(abstract,comments);分类 cs.RO

AI总结 本文针对多机器人异构传感器未校准的气源定位问题,提出分布式概率框架,结合秩特征与专家乘积融合,并引入信息区域分配策略,经仿真验证其性能优于基准方法。

Comments 14 pages, 6 figures, accepted by The 18th International Symposium on Distributed Autonomous Robotic Systems (DARS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28090 2026-08-31 cs.RO 新提交 57%

Stay Seated: Learning Omnidirectional Humanoid Locomotion on a Passive Mobile Chair with Casters

保持坐姿:在带脚轮的被动移动椅上学习全向人形机器人运动

Kango Yanagida, Kazuki Miyazawa, Takato Horii

机构 * The University of Osaka(大阪大学) The University of Tokyo(东京大学)

专题命中 具身导航 :manipulation(abstract);分类 cs.RO

AI总结 该研究在带脚轮的被动移动椅上学习人形机器人全向坐姿运动,通过改进站立速度跟踪环境训练策略,实现零样本仿真到真实机器人的迁移,其坐姿策略速度跟踪性能优于站立策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27866 2026-08-31 cs.CV 新提交 57%

Iron: Intent-Aligned and Retrospective Dual Learning Framework for Enhancing Generalist Virtual Agents

Iron:用于增强通用虚拟智能体的意图对齐与回溯双学习框架

Jiahe Ying, Wendong Bu, Kaihang Pan, Bingchen Miao, Siyu Chen, Wen Wang, Xueming Jiang, Juncheng Li, Siliang Tang

机构 * Fudan University(复旦大学) Zhejiang University(浙江大学)

专题命中 具身导航 :embodied AI(abstract);分类 cs.CV

AI总结 Iron是用于训练GUI智能体的意图对齐与回溯双学习框架,通过逐步循环一致奖励和事后回放机制提升性能,在跨环境等任务中优于三倍数据训练的模型,未见过的网页任务获25.06%相对提升。

Comments 11 pages, 5 figures, and 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28217 2026-08-31 eess.SP 新提交 50%

Beam scheduling policy for communications and PNT services from LEO satellites

用于低轨卫星通信与PNT服务的波束调度策略

Alejandro Gonzalez-Garrido, Francesco Menzione, Ottavio M. Picchi, Carla Amatetti

专题命中 具身导航 :navigation(abstract)

AI总结 本文针对LEO星座通信与PNT服务的波束调度问题,提出两种策略并对比,在通信优先级下评估其PNT可用性,为融合PNT服务提供方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27693 2026-08-31 eess.SP 新提交 50%

Secure Pseudonymetry with DSSS Watermarking for LEO Satellites

用于低轨卫星的采用DSSS水印技术的安全假名机制

Nisanur Camuzcu, Alireza Vahid

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出一种用于LEO卫星的DSSS水印框架,将可恢复假名与密钥认证字段嵌入下行链路,可在多卫星干扰下实现被动检测验证,且对传统接收器透明。

Comments 6 pages, 7 figures. Accepted to the 2026 IEEE Military Communications Conference (MILCOM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19881 2026-08-31 q-bio.NC 版本更新 50%

Planning difficulty and temporal constraints differently shape the level of detail and ordering of visual exploration

问题难度和等待时间影响人类规划中视觉策略的细节和时间组织水平

Mattia Eluchans, Giovanni Pezzulo

专题命中 具身导航 :navigation(abstract)

AI总结 研究探讨了问题难度和等待时间如何影响人类规划中视觉策略的细节和时间组织,发现难度增加视觉覆盖,时间影响执行中的重计划程度和目光路径一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 8 篇

2603.23149 2026-08-31 cs.AI 版本更新 83%

Describe-Then-Act: Proactive Agent Steering via Distilled Language-Action World Models

描述-然后-行动:通过蒸馏的语言-动作世界模型实现前瞻性智能体导航

Massimiliano Pappa, Luca Romani, Valentino Sacco, Alessio Palma, Stéphane Lathuilière, Fabio Galasso, Xavier Alameda-Pineda, Indro Spinelli

机构 * Sapienza University of Rome, Italy(罗马大学萨皮恩扎) Inria, Univ. Grenoble Alpes, CNRS, LJK(法国国家信息与自动化技术研究所)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 本文提出DILLO模型,通过蒸馏方法实现无需视觉模拟的前瞻性智能体导航,提升任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13247 2026-08-31 cs.CL cs.AI cs.CV cs.LG cs.MM 版本更新 82%

Aligning Agentic World Models via Knowledgeable Experience Learning

通过知识性经验学习对齐代理世界模型

Baochang Ren, Yunzhi Yao, Rui Sun, Shuofei Qiao, Ningyu Zhang, Huajun Chen

机构 * Zhejiang University(浙江大学) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 WorldMind通过知识性经验学习对齐代理世界模型,解决物理模拟中的幻觉问题,实现跨环境的高效迁移。

Comments EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28541 2026-08-31 cs.LG cs.AI 新提交 81%

An Enclosed Mode Is a Gauge Choice: Topology Relative to Reach in Certified Code World Models

闭合模式是一种规范选择:认证代码世界模型中相对于可达性的拓扑结构

Javier Aguilar Martín

机构 * AGILabs

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 该研究探讨认证代码世界模型中相对于可达性的拓扑,通过LLM合成实验得出三条原则,揭示危险与可达性的关联、修复的限制及缓解措施需匹配错误维度方向的结论。

Comments 33 pages, 2 figures. Paper 3 of a series (companion papers: arXiv:2607.14169 (https://arxiv.org/abs/2607.14169), arXiv:2608.17956 (https://arxiv.org/abs/2608.17956) ). Code, data, and Lean formalization: this https URL (https://github.com/JaviMaligno/code-world-models)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27345 2026-08-31 cs.CV cs.AI 版本更新 81%

PAWBench: How Far Are We from Probabilistically Aligned World Modeling?

PAWBench:我们离概率对齐的世界建模还有多远?

Yuandong Pu, Le Zhuo, Sayak Paul, Gabriel Jorge Menezes, Avram Đorđević, Shiyang Li, Yifan Zhou, Bin Fu, Wenlong Zhang, Junjun He, Yu Qiao, Yihao Liu, Jinbo Xing, Xi Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Krea AI Huggingface Shanghai Innovation Institute(上海创新研究院) Tongyi Lab(通义实验室) The University of Hong Kong(香港大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.CV

AI总结 本研究针对当前视频生成器未满足概率对齐世界建模要求的问题,提出PAWBench基准与PAWEval协议,经50种场景和11个系统测试发现无模型达要求,为相关研究奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27073 2026-08-31 cs.CV cs.RO 版本更新 81%

SpatialCrafter: Single Image World Modeling with Generative 3D Proxies

SpatialCrafter:基于生成式3D代理的单图像世界建模

Chuan Fang, Lingteng Qiu, Yixun Liang, Rui Chen, Kunming Luo, Zhaohua Zheng, Tongyuan Bai, Feipeng Tian, Zilong Dong, Zihan Zhou, Ping Tan

机构 * Hong Kong University of Science and Technology(香港科技大学) Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) ManyCore Tech Inc.(ManyCore科技公司) Jilin University(吉林大学)

专题命中 具身推理 :world model(title);robotics(abstract);分类 cs.RO、cs.CV

AI总结 SpatialCrafter是解决图像到场景生成问题的两阶段框架,通过3D代理及相关策略提升3D一致性,构建了115K场景的新数据集,性能优于现有方法且鲁棒性强。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28491 2026-08-31 cs.AI cs.RO 新提交 76%

AcrossVAM1.0: Particle World Modeling for Text-Assisted Robot Video Prediction

AcrossVAM1.0:面向文本辅助机器人视频预测的粒子世界建模

Yafei Zhang, Nan Wu

机构 * Across Physical AI(跨越物理人工智能公司) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 具身推理 :world model(title);分类 cs.RO、cs.AI

AI总结 该研究提出AcrossVAM1.0模型,通过分解为粒子运动与外观,在文本辅助下实现机器人视频预测,在VRS基准上显著降低轨迹误差、提升PSNR/SSIM等指标,但仍存在LPIPS未超越基线等局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22149 2026-08-31 cs.RO cs.AI 版本更新 73%

Meta-Ctrl: Guaranteed Plan Generation by Decoupling Syntactic and Semantic Constraints

Meta-Ctrl:通过分离句法与语义约束实现带保证的规划生成

Gwen Yidou-Weng, Edward Sun, Tianyi Ma, Metin Alp Dogan, Benjie Wang, Allen Peng, Guy Van den Broeck, Yuchen Cui

机构 * Michigan State University(密歇根州立大学) University of California Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 具身推理 :embodied agent(abstract,abstract_cn);分类 cs.RO、cs.AI

AI总结 Meta-Ctrl是一种约束解码框架,通过引入元标记分离句法与语义约束,在保证规划满足约束的同时保留语言模型的规划质量,在WAH-NL数据集和真实桌面机器人上均取得优于GPT-4的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24044 2026-08-31 cs.LG 版本更新 57%

JEPA-x: Cross-Predictive Physics Grounding for Forecastable Latent Dynamics

XP-JEPA:用于可预测潜在动力学的交叉预测物理基础

Kehan Wen, Ziming Li, Siyuan Luo, Fan Shi

专题命中 具身推理 :world model(abstract);分类 cs.LG

AI总结 XP-JEPA通过将视觉与物理表征交叉预测,提升了潜在动力学的可预测性,在多任务套件上降低了展开漂移并提高了控制成功率,无需特权输入即可实现更优的基于展开的控制性能。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 4 篇

2608.27609 2026-08-31 cs.RO cs.AI 新提交 73%

PHR-VLA: Planning Horizon Reasoning for Vision-Language-Action Models

PHR-VLA:面向视觉-语言-动作模型的规划视界推理

Davood Soleymanzadeh, Kaidi Zhang, Zhiyuan Zhang, Bihao Zhang, Xiao Liang, Yu She, Minghui Zheng

机构 * Texas A&M University(德克萨斯农工大学) Purdue University(普渡大学)

专题命中 机器人基础模型 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 该研究针对现有视觉-语言-动作模型缺乏未来任务动态推理机制的问题,提出PHR-VLA框架,通过辅助未来头对齐潜在动态,提升了机器人操纵任务的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04208 2026-08-31 cs.RO cs.AI cs.LG 版本更新 67%

SCALE: Self-uncertainty Conditioned Adaptive Looking and Execution for Vision-Language-Action Models

SCALE: 基于自不确定性条件自适应观察与执行的视觉-语言-动作模型

Hyeonbeom Choi, Daechul Ahn, Youhan Lee, Taewook Kang, Seongwon Cho, Jonghyun Choi

机构 * Seoul National University(首尔国立大学)

专题命中 机器人基础模型 :robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 提出SCALE推理策略,利用自不确定性联合调节视觉感知和动作,无需额外训练或验证器,仅单次前向传播,提升VLA模型在模拟和真实环境中的鲁棒性。

Comments ICML 2026 Spotlight. Project page: this https URL (https://dcahn12.github.io/projects/scale/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28108 2026-08-31 cs.RO cs.CV 新提交 62%

DeicticVLA: Unifying Instruction Modes Based on Language and Deictic Gestures in a Single VLA

DeicticVLA:在单一视觉-语言-动作模型(VLA)中统一基于语言和指示手势的指令模式

Kango Yanagida, Tatsuya Aoki, Yuichiro Yoshikawa, Takato Horii

机构 * The University of Osaka(大阪大学) The University of Tokyo(东京大学)

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO、cs.CV

AI总结 本研究提出DeicticVLA,将三种指令模式统一于单一VLA,经仿真与真实任务验证,其在未见场景和新类别下的表现优于仅用语言指令的模型,为相关设计提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04633 2026-08-31 cs.RO 版本更新 57%

Mind-VLA: Instruction-Aware Spatial Representation Alignment for Vision-Language-Action Models

Mind-VLA:面向视觉-语言-动作模型的指令感知空间表示对齐方法

Xingyu Ding, Yuzhong Zhao, Yang Wu, Chunhai Zhao, Chaoyang Zhao, Yifan Zhang, Jian Cheng

机构 * Nanjing University(南京大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO

AI总结 本文针对现有VLA方法忽略指令指定目标物体3D几何的问题,提出Mind-VLA方法,通过对齐目标物体相关特征实现指令感知3D理解,在LIBERO、CALVIN及真实机器人遮挡任务上性能显著优于基线。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 5 篇

2608.09467 2026-08-31 cs.CV cs.AI 版本更新 81%

RecoverFly: A Failure-Aware Reinforcement Learning Post-Training Framework for Aerial Vision-Language Navigation

RecoverFly:面向空中视觉语言导航的故障感知强化学习后训练框架

Boxiong Wang, Hui Kang, Geng Sun, Jiahui Li, Chao Yu, Daxin Tian

专题命中 模仿学习与强化学习 :navigation(title,abstract);分类 cs.AI、cs.CV

AI总结 RecoverFly是面向端到端无人机视觉-语言-动作策略的故障感知强化学习后训练框架,在TravelUAV基准上实现了优于AerialVLA的性能,提升了导航成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27508 2026-08-31 cs.AI 新提交 79%

WM-R1: Training GUI Agents to Reason and leverage World Models with Reinforcement Learning

WM-R1:用强化学习训练GUI智能体以推理并利用世界模型

Yu Han, Tianwen Qian

机构 * School of Computer Science and Technology, East China Normal University(华东师范大学计算机科学与技术学院)

专题命中 模仿学习与强化学习 :world model(title,abstract);分类 cs.AI

AI总结 该研究提出首个用世界模型替代真实环境训练GUI智能体的强化学习框架WM-R1,在Android基准测试中其性能显著优于仅GRPO的基线方法和推理时模拟方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08273 2026-08-31 cs.RO cs.CV 版本更新 62%

Action- and Language-Conditioned Video Assessment for Embodied Control

面向具身控制的动作与语言条件视频评估

Hwanhee Kim, Jaehyun Jang, Seungmin Cha, Hyeonseo Yun, Donghoon Lee, Chang D. Yoo

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院) School of Electrical Engineering, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院电气工程学院)

专题命中 模仿学习与强化学习 :embodied agent(abstract);分类 cs.RO、cs.CV

AI总结 该研究提出ALVA轨迹评估器,结合视觉观测、动作序列与语言指令评估具身控制任务,在模拟3D家庭环境中误报率低,作为反馈机制可提升闭环策略优化效果。

Comments 21 pages, 7 figures. v2: updated Funding section

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28140 2026-08-31 cs.RO 新提交 61%

Contact-Guided Exploration for Non-Prehensile Locomanipulation with Multi-Critic RL

基于多评论家强化学习的非抓取型移动操纵的接触引导探索

Simone Tolomei, Mayank Mittal, Franco Angelini, Manolo Garabini, Paolo Salaris, Marco Hutter

机构 * Centro di Ricerca E. Piaggio(E.皮亚焦研究中心) Università di Pisa(比萨大学) ETH Zürich(苏黎世联邦理工学院) NVIDIA(英伟达公司)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO;robotics(comments)

AI总结 针对非抓取型移动操纵的复杂混合动力学与接触稀疏性问题,提出多评论家RL框架下的接触引导探索策略,经四足移动操纵器实验验证可实现现实世界中的非抓取型操纵。

Comments project website: this https URL (https://tolomeis.github.io/contact-guided-exp) Accepted in IEEE Robotics and Automation Letter (RA-L) 8 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28065 2026-08-31 cs.AI 新提交 57%

Learning to Allocate Incentives for Incentivized Advertising via Offline Model-Based Reinforcement Learning

基于离线模型强化学习的激励式广告激励分配学习

Zilin Zhao, Han Yang, Tianpei Yang, Fangsheng Huang, Yanfei Cui, Kan Peng, Yi Li, Yiming Zong, Hao Zhang, Yinsong Xue

机构 * State Key Laboratory of Novel Software Technology, Nanjing University(南京大学计算机软件新技术国家重点实验室) ByteDance(字节跳动) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI

AI总结 本研究针对激励式广告的序列激励分配问题,提出离线模型强化学习框架,实验显示MB-IQL可显著提升人均净利润,验证了该框架的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 人机交互与遥操作 1 篇

2608.27545 2026-08-31 cs.RO eess.SY 新提交 70%

Remote Human and Robot Interaction for Greenhouse Gardening Using Virtual Reality

基于虚拟现实的温室园艺远程人机交互

Daniel Udekwe, Hasan Seyyedhasani

专题命中 人机交互与遥操作 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 该研究验证了VR远程人机交互用于温室叶片检查和土壤湿度评估的有效性,发现摄像头遮挡是主要限制因素,需调整传感策略提升系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 机器人数据与评测 10 篇

2509.26536 2026-08-31 cs.CL cs.AI cs.CV cs.LG cs.RO 版本更新 85%

OceanGym: A Benchmark Environment for Underwater Embodied Agents

OceanGym: 一个用于水下具身智能体的基准环境

Yida Xue, Mingjun Mao, Xiangyuan Ru, Yuqi Zhu, Baochang Ren, Shuofei Qiao, Mengru Wang, Shumin Deng, Xinyu An, Ningyu Zhang, Ying Chen, Huajun Chen

专题命中 机器人数据与评测 :embodied agent(title,abstract);embodied AI(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 OceanGym通过多模态大语言模型构建首个水下具身智能体基准,揭示水下环境感知与规划的挑战,推动水下自主系统发展。

Comments EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28305 2026-08-31 cs.RO cs.AI 新提交 81%

PanelShield: Verifiable Closed-Loop Safe Planning for Robotic Industrial Panel Operation

PanelShield:面向机器人工业面板操作的可验证闭环安全规划

Guipeng Xin, Jiahe Xu, Chenhui Wan, Jie Liu, Youmin Hu, Zhongxu Hu

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO、cs.AI

AI总结 针对工业面板操作的安全约束规划问题,提出PanelShield框架,结合LTL与安全FSM实现可验证闭环规划,实验表明其可降低违规率至2.7%并提升任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28300 2026-08-31 cs.RO cs.AI 新提交 81%

MaCoPlanner: LLM-Assisted Manual-Compiled Task Planning with Proactive Safety Verification for Robotic Industrial Panel Operation

MaCoPlanner:面向机器人工业面板操作的、结合主动安全验证的大语言模型辅助人工编译任务规划

Guipeng Xin, Jiahe Xua, Mohammad Deghat, Chenhui Wan, Jie Liu, Youmin Hu, Zhongxu Hu

机构 * Huazhong University of Science and Technology(华中科技大学) University of New South Wales(新南威尔士大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO、cs.AI

AI总结 MaCoPlanner是面向机器人工业面板操作的规划框架,通过编译设备手册知识生成规划,经主动安全验证后执行,大幅提升了任务成功率,在Level-2、Level-3任务上分别提升了21.6、17.3个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16145 2026-08-31 cs.RO 版本更新 80%

Differentiable Dynamics and Fast Simulation of Continuous Elastic Robotic Fish

可微动力学与连续弹性机器鱼的快速仿真

Zhiheng Chen, Jiayi Jin, Wei Wang

机构 * Marine Robotics Lab, Department of Mechanical Engineering, College of Engineering, University of Wisconsin-Madison(威斯康星大学麦迪逊分校工程学院机械工程系水下机器人实验室) Sibley School of Mechanical and Aerospace Engineering, Cornell University(康奈尔大学Sibley机械与航空航天工程学院)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO;robotics(comments)

AI总结 本文针对现有机器鱼动力学模型的不足,提出基于哈密顿原理的可微全身动力学模型与快速仿真框架,经数值与实验验证,可用于机器鱼身体刚度分布的梯度优化设计。

Comments Under review at IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏