arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-31 至 2026-08-31 共收录 16 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 16 篇

2608.28279 2026-08-31 cs.RO 新提交 83%

STEGNav: Spatio-Temporal Event Graph Reasoning for Multimodal Lifelong Object Navigation

STEGNav:面向多模态终身目标导航的时空事件图推理

Yang Chen, Zhenyu Huang, Wenbo Fu, Danyang Peng, Shi-Yu Tian, Kun-Yang Yu, Lan-Zhe Guo

机构 * State Key Laboratory of Novel Software Technology, Nanjing University(南京大学计算机软件新技术国家重点实验室) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院) School of Artificial Intelligence, Nanjing University(南京大学人工智能学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对现有多模态终身导航方法的局限,本文提出无训练框架STEGNav,通过时空事件图的双轴设计优化导航性能,在多个基准数据集上取得显著效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28518 2026-08-31 cs.AI cs.CL cs.RO 新提交 81%

When Robots Mishear Us: Mapping the Safety Risks of Voice-Controlled Embodied AI

当机器人误听我们时:映射语音控制具身人工智能的安全风险

Sihan Jia, Oliver Lemon

专题命中 具身导航 :embodied AI(title,abstract);分类 cs.RO、cs.AI

AI总结 该研究探讨ASR错误对语音控制具身AI安全性的影响,发现其会导致有害指令被执行,部分错误会削弱模型弃权行为,自动修正并非总能降低风险,揭示了ASR错误带来的显著安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26050 2026-08-31 cs.RO 版本更新 80%

When Obstacles Bend: Modeling Vegetation Deformation in the context of Field Robotics

当障碍物弯曲:野外机器人场景下的植被变形建模

Zaar Khizar, Tom Montagnon, Roland Lenain, Romuald Aufrère, Johann Laconte

机构 * LIMOS(利摩日信息学与优化实验室) Université Clermont Auvergne(克莱蒙奥弗涅大学) Clermont Auvergne INP(克莱蒙奥弗涅国立综合理工学院) CNRS(法国国家科学研究中心) INRAE(法国国家农业食品与环境研究院) Institut Pascal(帕斯卡尔研究院)

专题命中 具身导航 :robotics(title,comments);navigation(abstract);分类 cs.RO

AI总结 针对现有可通行性评估绑定机器人动力学、难以跨平台迁移的局限,该研究提出通过植被固有力学特性建模,结合变形与力数据实现植被感知导航。

Comments 8 pages, 7 figures, submitted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28437 2026-08-31 eess.SY cs.RO 新提交 79%

LUCID: An Agentic AI Framework on Digital-Twin in the Loop for QoS-Guaranteeing Robotic Control

LUCID:一种用于QoS保障机器人控制的闭环数字孪生智能体AI框架

Hyeonsu Lyu, Minwoo Kim, Sehyun Ryu, Hyun Jong Yang

专题命中 具身导航 :robotic(title);robotics(abstract);分类 cs.RO

AI总结 LUCID是一种LLM智能体编排的云机器人框架,将TP-RRM动态编排于DITL环境,结合路径规划与RRM验证器,可适应动态条件并降低规划延迟,保障机器人控制的QoS。

Comments 10 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27793 2026-08-31 cs.RO 新提交 79%

CAVE-NAV: VLM-Based Autonomous 3D Navigation in Underwater Cave Environments

CAVE-NAV:基于VLM的水下洞穴环境自主三维导航

Zhenqi Wu, Yuanjie Lu, Yisheng Zhang, Miao Yu, Xuesu Xiao, Jaejeong Shin, Xiaomin Lin

机构 * University of South Florida(南佛罗里达大学) George Mason University(乔治梅森大学) University of Maryland(马里兰大学) Seoul National University(首尔大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 该研究针对水下洞穴导航的传统方法局限,提出带CoT推理的VLM导航框架,经仿真验证可完成无碰撞的端到端三维洞穴导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27584 2026-08-31 cs.CV cs.AI 新提交 79%

Quanta Perception as Probabilistic Events

作为概率事件的量子感知

Varun Sundar, Pavan Thodima, Sacha Jungerman, Mohit Gupta

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 具身导航 :robotics(abstract);navigation(abstract);robotic(abstract);分类 cs.AI、cs.CV

AI总结 本文提出概率事件计算原语,通过递归贝叶斯推理将单个光子检测转化为低延迟信号,实现极端环境下的量子感知,其输出速度远超现有基线,连接了量子传感与机器人视觉。

Comments For project webpage, see this https URL (https://wisionlab.com/project/probabilistic-events/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27751 2026-08-31 physics.bio-ph cond-mat.stat-mech nlin.AO 新提交 78%

Noise-robust navigation from an adaptive run-and-tumble policy

抗噪声的自适应跑-翻策略导航

Aniruddha Datta, Shiladitya Banerjee

专题命中 具身导航 :navigation(title,abstract)

AI总结 研究针对噪声信号下的生物体导航问题,提出源于最优性原理的跑-翻策略,该策略自带的方差适应机制可在噪声增大时维持趋化漂移有限,虽会降低安静环境性能,但为抗噪声导航提供了新方案。

Comments 5 pages, 4 figures, 4 supplemental files

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27628 2026-08-31 cs.RO 新提交 74%

One year in a forest: Analyzing the challenges of autonomous navigation in subarctic environments

森林中的一年:分析亚北极环境中自主导航的挑战

Matěj Boxan, Nicolas Lauzon, Veronica Vannini, Mathis Turgeon-Roy, François Pomerleau

机构 * Université Laval(拉瓦尔大学)

专题命中 具身导航 :navigation(title);分类 cs.RO

AI总结 本文通过对亚北极北方森林中移动机器人为期一年的部署试验,评估了9种导航方法的性能,发现环境变化会阻碍现有技术,激光雷达跨季节定位表现优于雷达和视觉,还总结了相关挑战与经验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27476 2026-08-31 cs.AI 新提交 70%

Class-Based Heuristic Selection for Solving the Flying Block Puzzle

求解飞行方块谜题的基于类的启发式选择

Sanyar Ahmadi, Pedram Asadzadeh, Amanj Khorramian

机构 * Faculty of Computer Engineering(计算机工程学院) University of Tehran(德黑兰大学) K. N. Toosi University of Technology(霍加·纳绥尔·丁·图西大学) Department of Electrical and Computer Engineering(电气与计算机工程学院) University of Kurdistan(库尔德斯坦大学)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.AI

AI总结 针对启发式搜索在空间规划中的性能问题,提出CBHA*算法,在146个飞行方块谜题基准实例上大幅提升成功率、减少节点扩展,为高效空间规划提供了可推广的自适应启发式机制。

Comments 27 pages, 15 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28270 2026-08-31 cs.RO cs.AI 新提交 62%

Spatial-Semantic Reasoning using Large Language Models for Efficient UAV Search Operations

基于大语言模型的空间语义推理用于高效无人机搜索任务

Marin Maletic, Marijana Peti, Tamara Petrovic, Stjepan Bogdan

机构 * University of Zagreb(萨格勒布大学) Faculty of Electrical Engineering and Computing(电气工程与计算机学院) LARICS (Laboratory for Robotics and Intelligent Control Systems)(拉里克机器人与智能控制系统实验室)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 该研究提出基于大语言模型的无人机实时语义导航框架,结合多技术实现高效目标导航,经仿真与真实实验验证可缩短任务时长且保持高搜索准确率。

Comments 8 pages, preprint, Published in: 2025 European Conference on Mobile Robots (ECMR), DOI: https://doi.org/10.1109/ECMR65884.2025.11163229

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28214 2026-08-31 cs.RO 新提交 61%

Probabilistic Multi-Robot Gas Source Localization with Uncalibrated Sensors: A Distributed Estimation Approach

采用未校准传感器的概率多机器人气源定位:一种分布式估计方法

Wanting Jin, Marc Zoel Arias Mitjà, Alcherio Martinoli

机构 * Distributed Intelligent Systems and Algorithms Laboratory(分布式智能系统与算法实验室) School of Architecture, Civil and Environmental Engineering(建筑、土木与环境工程学院) École Polytechnique Fédérale de Lausanne (EPFL)(洛桑联邦理工学院)

专题命中 具身导航 :robotic(abstract,comments);分类 cs.RO

AI总结 本文针对多机器人异构传感器未校准的气源定位问题,提出分布式概率框架,结合秩特征与专家乘积融合,并引入信息区域分配策略,经仿真验证其性能优于基准方法。

Comments 14 pages, 6 figures, accepted by The 18th International Symposium on Distributed Autonomous Robotic Systems (DARS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28090 2026-08-31 cs.RO 新提交 57%

Stay Seated: Learning Omnidirectional Humanoid Locomotion on a Passive Mobile Chair with Casters

保持坐姿:在带脚轮的被动移动椅上学习全向人形机器人运动

Kango Yanagida, Kazuki Miyazawa, Takato Horii

机构 * The University of Osaka(大阪大学) The University of Tokyo(东京大学)

专题命中 具身导航 :manipulation(abstract);分类 cs.RO

AI总结 该研究在带脚轮的被动移动椅上学习人形机器人全向坐姿运动,通过改进站立速度跟踪环境训练策略,实现零样本仿真到真实机器人的迁移,其坐姿策略速度跟踪性能优于站立策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27866 2026-08-31 cs.CV 新提交 57%

Iron: Intent-Aligned and Retrospective Dual Learning Framework for Enhancing Generalist Virtual Agents

Iron:用于增强通用虚拟智能体的意图对齐与回溯双学习框架

Jiahe Ying, Wendong Bu, Kaihang Pan, Bingchen Miao, Siyu Chen, Wen Wang, Xueming Jiang, Juncheng Li, Siliang Tang

机构 * Fudan University(复旦大学) Zhejiang University(浙江大学)

专题命中 具身导航 :embodied AI(abstract);分类 cs.CV

AI总结 Iron是用于训练GUI智能体的意图对齐与回溯双学习框架,通过逐步循环一致奖励和事后回放机制提升性能,在跨环境等任务中优于三倍数据训练的模型,未见过的网页任务获25.06%相对提升。

Comments 11 pages, 5 figures, and 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28217 2026-08-31 eess.SP 新提交 50%

Beam scheduling policy for communications and PNT services from LEO satellites

用于低轨卫星通信与PNT服务的波束调度策略

Alejandro Gonzalez-Garrido, Francesco Menzione, Ottavio M. Picchi, Carla Amatetti

专题命中 具身导航 :navigation(abstract)

AI总结 本文针对LEO星座通信与PNT服务的波束调度问题,提出两种策略并对比,在通信优先级下评估其PNT可用性,为融合PNT服务提供方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27693 2026-08-31 eess.SP 新提交 50%

Secure Pseudonymetry with DSSS Watermarking for LEO Satellites

用于低轨卫星的采用DSSS水印技术的安全假名机制

Nisanur Camuzcu, Alireza Vahid

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出一种用于LEO卫星的DSSS水印框架,将可恢复假名与密钥认证字段嵌入下行链路,可在多卫星干扰下实现被动检测验证,且对传统接收器透明。

Comments 6 pages, 7 figures. Accepted to the 2026 IEEE Military Communications Conference (MILCOM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19881 2026-08-31 q-bio.NC 版本更新 50%

Planning difficulty and temporal constraints differently shape the level of detail and ordering of visual exploration

问题难度和等待时间影响人类规划中视觉策略的细节和时间组织水平

Mattia Eluchans, Giovanni Pezzulo

专题命中 具身导航 :navigation(abstract)

AI总结 研究探讨了问题难度和等待时间如何影响人类规划中视觉策略的细节和时间组织,发现难度增加视觉覆盖,时间影响执行中的重计划程度和目光路径一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏