arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-12-03 至 2025-12-03 共收录 11 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 11 篇

2504.09843 2025-12-03 cs.CV cs.RO 81%

ST-Booster: An Iterative SpatioTemporal Perception Booster for Vision-and-Language Navigation in Continuous Environments

ST-Booster: 一种用于连续环境视觉-语言导航的迭代时空感知增强器

Lu Yue, Dongliang Zhou, Liang Xie, Erwei Yin, Feitian Zhang

机构 * Robotics and Control Laboratory, the School of Advanced Manufacturing and Robotics, and the State Key Laboratory of Turbulence and Complex Systems, Peking University(机器人与控制实验室、先进制造与机器人学院、湍流与复杂系统国家重点实验室,北京大学) Defense Innovation Institute, Academy of Military Sciences(国防创新研究院,军事科学院) Tianjin Artificial Intelligence Innovation Center(天津人工智能创新中心) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 ST-Booster通过多粒度感知和指令感知推理提升连续环境中视觉-语言导航的性能。

Comments 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11590 2025-12-03 cs.RO cs.LG 81%

Predicting Human Perceptions of Robot Performance During Navigation Tasks

预测人类在导航任务中对机器人性能的感知

Qiping Zhang, Nathan Tsoi, Mofeed Nagib, Booyeon Choi, Jie Tan, Hao-Tien Lewis Chiang, Marynel Vázquez

机构 * Yale University(耶鲁大学) Google DeepMind, Google Inc(谷歌DeepMind及谷歌公司)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.LG

AI总结 本文通过SEAN TOGETHER数据集研究了利用非语言行为线索和机器学习预测人类对机器人导航性能感知的方法,发现空间特征推理和监督学习在预测中表现更优。

Journal ref ACM Transactions on Human-Robot Interaction, Vol. 14, No. 3, Article 46, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02423 2025-12-03 cs.CV 79%

GUI Exploration Lab: Enhancing Screen Navigation in Agents via Multi-Turn Reinforcement Learning

GUI探索实验室:通过多轮强化学习提升代理的屏幕导航

Haolong Yan, Yeqing Shen, Xin Huang, Jia Wang, Kaijun Tan, Zhixuan Liang, Hongxin Li, Zheng Ge, Osamu Yoshie, Si Li, Xiangyu Zhang, Daxin Jiang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) StepFun Waseda University(早稻田大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 GUI探索实验室通过多轮强化学习提升代理屏幕导航能力,结合监督微调和交互式试错,实现更高效和通用的GUI代理训练。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02400 2025-12-03 cs.CV 79%

Nav-$R^2$ Dual-Relation Reasoning for Generalizable Open-Vocabulary Object-Goal Navigation

Nav-$R^2$双关系推理用于通用开放词汇目标导航

Wentao Xiang, Haokang Zhang, Tianhang Yang, Zedong Chu, Ruihang Chu, Shichao Xie, Yujian Yuan, Jian Sun, Zhining Gu, Junjie Wang, Xiaolong Wu, Mu Xu, Yujiu Yang

机构 * Tsinghua University(清华大学) Amap, Alibaba Group(阿里巴巴集团的阿里的地图)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 Nav-R2通过双关系推理和相似性感知记忆,在开放词汇环境下实现高效目标导航,提升未见对象定位性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16904 2025-12-03 cs.RO cs.AI 73%

Deep Learning for Human Locomotion Analysis in Lower-Limb Exoskeletons: A Comparative Study

深度学习在下肢外骨骼中的人体运动分析:比较研究

Omar Coser, Christian Tamantini, Matteo Tortora, Leonardo Furia, Rosa Sicilia, Loredana Zollo, Paolo Soda

专题命中 具身导航 :robotics(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文通过比较八种深度神经网络架构,研究了在不同地形中预测人体运动参数的方法,并展示了使用IMU传感器的高效和轻量级系统设计。

Comments 26 pages, 6 figures

Journal ref Front. Comput. Sci., 7:1597143 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21214 2025-12-03 cs.CV cs.CL 70%

VoxRep: Enhancing 3D Spatial Understanding in 2D Vision-Language Models via Voxel Representation

VoxRep:通过体素表示增强2D视觉-语言模型的3D空间理解

Alan Dao, Norapat Buppodom

机构 * Menlo Research(Menlo研究)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.CV

AI总结 本文提出VoxRep方法,通过将体素空间切分为2D切片并输入预训练的视觉-语言模型,实现对3D环境的高效语义理解。

Journal ref Proc. APSIPA ASC 2025, pp. 1464-1469

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02389 2025-12-03 cs.AI cs.LG 62%

Synthetic Error Injection Fails to Elicit Self-Correction In Language Models

合成错误注入无法在语言模型中引发自我修正

David X. Wu, Shreyas Kapur, Anant Sahai, Stuart Russell

机构 * ucb(伯克利大学)

专题命中 具身导航 :robotics(abstract);分类 cs.AI、cs.LG

AI总结 本研究发现合成错误注入无法有效提升语言模型的自我修正能力,揭示了策略性强化学习在激发自我修正方面的独特优势。

Comments 13 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02994 2025-12-03 eess.SY cs.SY eess.SP 56%

GNSS Array-Based Multipath Detection Employing UKF on Manifolds

基于GNSS阵列的UKF在流形上实现多路径检测

Abdelgabar Ahmed, Tarig Ballal, Xing Liu, Mohanad Ahmed, Tareq Y. Al-Naffouri

专题命中 具身导航 :navigation(abstract,comments)

AI总结 本文提出基于GNSS阵列和UKF在流形上的多路径检测方法,利用RANSAC算法提高计算效率,有效提升定位精度。

Comments The paper, was presented at the ION PLANS 2025 meeting (Position, Location, and Navigation Symposium) in Session C1: Multisensor Integrated Systems and Sensor Fusion Technologies, and is published in the conference proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15286 2025-12-03 math.NA cs.NA 50%

Real-time aerodynamic load estimation for hypersonics via strain-based inverse maps

通过应变基逆映射实现高超声速的实时气动载荷估计

Julie Pham, Omar Ghattas, Noel Clemens, Karen Willcox

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出通过应变基逆映射实时估计高超音速飞行器气动载荷的方法,适用于恶劣环境下的压力推断与力矩系数计算。

Comments 22 pages, 15 figures

Journal ref AIAA Journal, Vol. 63, No. 1, 2025, pp. 91-101

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.12766 2025-12-03 cs.CR 50%

GPS-Spoofing Attack Detection Mechanism for UAV Swarms

无人机群中GPS欺骗攻击检测机制

Pavlo Mykytyn, Marcin Brzozowski, Zoya Dyka, Peter Langendoerfer

专题命中 具身导航 :navigation(abstract)

AI总结 本研究提出了一种基于UAV群成员间距离对比的GPS欺骗攻击检测机制,通过脉冲无线电超宽带测距技术识别单发射机和多发射机攻击,以防止UAV被误导或坠毁。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02043 2025-12-03 cs.CL 50%

Mirror, Mirror on the Wall -- Which is the Best Model of Them All?

镜中镜——哪一个模型才是最好的?

Dina Sayed, Heiko Schuldt

机构 * Databases and Information Systems Research Group University of Basel, Switzerland(数据库与信息系统研究组巴塞尔大学)

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出了一种模型选择方法论,通过分析排行榜和基准来帮助选择最适合特定用途的模型。

详情

展开后加载摘要…

URL PDF HTML 收藏