arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 329 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 329 篇

2512.08766 2026-06-24 physics.flu-dyn 版本更新 78%

Optimal navigation in two-dimensional flows: Control theory and reinforcement learning

二维流动中的最优导航:控制理论与强化学习

Vladimir Parfenyev

专题命中 具身导航 :navigation(title,abstract)

AI总结 研究在二维流动中,受平流和自推进的智能体(如漂浮无人机)的最小时间路径问题,利用最优控制理论求解,并应用强化学习(Q学习和演员-评论家算法)设计鲁棒导航策略,在规则流中接近最优解,在湍流中偏差增大,且粗粒化训练可泛化至全流场。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22497 2026-06-11 cs.HC cs.NA math.NA 版本更新 78%

Catheter Monitoring in Intelligent Endovascular Navigation Systems: Interactive Simulations and Mixed Reality for Enhanced Navigational Awareness

智能血管内导航系统中的导管监测:用于增强导航意识的交互式模拟与混合现实

Veronica Ruozzi, Giovanni Battista Regazzo, Maria Chiara Palumbo, Wim-Alexander Beckers, Mouloud Ourak, Xiu Zhang, Francesca Perico, Alessandro Caimi, Emmanuel Vander Poorten, Emiliano Votta

专题命中 具身导航 :navigation(title,abstract)

AI总结 提出一种结合实时导管形状重建、交互式模拟和混合现实可视化的框架,通过有限元模型和传感器数据监测导管-血管相互作用,实验验证位移误差低于2.33毫米。

Comments Int J CARS (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23082 2026-06-09 q-bio.NC 版本更新 78%

Spatial navigation in preclinical Alzheimer's disease: A review

阿尔茨海默病前期阶段的空间导航:综述

Syrine Salouhou, Victor Gilles, Remi Vallée, Gillian T. Coughlan, Romain Bachelet, Michael Hornberger, Hugo Spiers, Antoine Coutrot, Antoine Garnier-Crussard

专题命中 具身导航 :navigation(title,abstract)

AI总结 本文综述了阿尔茨海默病前期阶段空间导航的认知功能,探讨其与AD病理标志物如p-tau的相关性,提出空间导航任务作为早期检测高风险个体的敏感方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05964 2026-06-08 math.PR 版本更新 78%

Strong Solutions to SDEs with Supercritical Drift Arising in Navigation Problems

导航问题中超临界漂移随机微分方程的强解

Carlo Ciccarella

专题命中 具身导航 :navigation(title,abstract)

AI总结 针对极坐标下具有1/r型超临界奇异漂移的两种随机导航模型,通过路径论证证明了强存在性和路径唯一性,并研究了停止半径趋于零时的极限行为。

Comments 28 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16794 2026-08-20 cs.RO cs.AI cs.CL 版本更新 76%

Neurosymbolic Embodied Agents

神经符号具身智能体

Mohammad Albinhassan, Yuming Feng, Alessandra Russo, Pranava Madhyastha

机构 * Imperial College London(帝国理工学院) Johns Hopkins University(约翰斯·霍普金斯大学) City, University of London(伦敦城市大学)

专题命中 具身导航 :embodied agent(title);分类 cs.RO、cs.AI

AI总结 该研究提出一种神经符号具身智能体,将长周期家庭任务分解为视觉探索与符号规划,在VirtualHome、ALFWorld基准测试中表现优异,约束与搜索结合可大幅提升任务解决率,且无需专门训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21046 2026-07-08 cs.CV cs.AI 版本更新 76%

SpatialFly: Implicit 3D Prior-Guided Visual Reparameterization for Continuous UAV Vision-and-Language Navigation

SpatialFly:基于几何的表示对齐用于城市环境中无人机视觉与语言导航

Wen Jiang, Kangyao Huang, Li Wang, Wang Xu, Wei Fan, Jinyuan Liu, Shaoyu Liu, Hanfang Liang, Hongwei Duan, Bin Xu, Xiangyang Ji, Huaping Liu

机构 * School of Mechanical Engineering, Beijing Institute of Technology(北京理工大学机械工程学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Tsinghua University(清华大学) Department of Automation, Tsinghua University(清华大学自动化系) School of Artificial Intelligence, Xidian University(西安电子科技大学人工智能学院) Jianghan University(江汉大学)

专题命中 具身导航 :navigation(title);分类 cs.AI、cs.CV

AI总结 本文提出SpatialFly框架,通过几何引导的2D表示对齐机制,解决无人机在复杂3D环境中的视觉与语言导航问题,实验表明其在路径对齐和运动稳定性方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06828 2026-06-23 cs.RO cs.AI 版本更新 76%

NeuPAN: Direct Point Robot Navigation with End-to-End Model-based Learning

NeuPAN: 基于端到端模型学习的直接点机器人导航

Ruihua Han, Shuai Wang, Shuaijun Wang, Zeqing Zhang, Jianjun Chen, Shijie Lin, Chengyang Li, Chengzhong Xu, Yonina C. Eldar, Qi Hao, Jia Pan

专题命中 具身导航 :navigation(title);分类 cs.RO、cs.AI

AI总结 提出NeuPAN,一种实时、高精度、无地图、易部署的机器人运动规划器,通过紧耦合感知-控制框架和端到端模型学习,直接处理原始点云生成无碰撞运动,避免感知到控制的误差传播。

Comments Accepted by TRO 2025; project website: https://hanruihua.github.io/neupan_project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23038 2026-07-07 cs.RO 版本更新 76%

MOSAIC: Modular Scalable Autonomy for Intelligent Coordination of Heterogeneous Robotic Teams

MOSAIC:异构机器人团队智能协作的模块化可扩展自主性

David Oberacker, Julia Richter, Philip Arm, Marvin Grosse Besselmann, Lennart Puck, William Talbot, Maximilian Schik, Sabine Bellmann, Tristan Schnell, Hendrik Kolvenbach, Rüdiger Dillmann, Marco Hutter, Arne Roennau

机构 * FZI Forschungszentrum für Informatik, Karlsruhe, Germany(弗赖堡信息研究中心,卡尔斯鲁厄,德国) Robotic Systems Lab (RSL), ETH Zürich, Zürich, Switzerland(机器人系统实验室(RSL),苏黎世联邦理工学院,苏黎世,瑞士) Machine Intelligence and Robotics Lab (MaiRo), Karlsruhe Institute for Technology (KIT), Karlsruhe, Germany(机器智能与机器人实验室(MaiRo),卡尔斯鲁厄技术学院(KIT),卡尔斯鲁厄,德国) European Space Agency (ESA), Noordwijk, Netherlands(欧洲航天局(ESA),诺德威克,荷兰)

专题命中 具身导航 :robotic(title);分类 cs.RO;robotics(comments)

AI总结 研究针对多机器人科学探索,提出MOSAIC框架,基于兴趣点统一任务抽象与多层自主性,依机器人能力动态分配任务,经模拟月球探测实验验证,可实现强鲁棒性、可扩展的多机器人科学探索。

Comments This work has been accepted for publication with the IEEE Transactions of Field Robotics Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12236 2026-08-13 cs.RO cs.AI cs.LG 版本更新 75%

TMRL: Diffusion Timestep-Modulated Pretraining Enables Exploration for Efficient Policy Finetuning

TMRL: 差分时间步调节预训练实现高效策略微调的探索

Matthew M. Hong, Jesse Zhang, Anusha Nagabandi, Abhishek Gupta

机构 * University of Washington(华盛顿大学) Amazon FAR(亚马逊FAR)

专题命中 具身导航 :manipulation(abstract);robot policy(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出TMRL框架,通过结合行为克隆预训练与强化学习微调,解决预训练中动作分布狭窄的问题,提升机器人策略微调的样本效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18324 2026-06-16 cs.CV cs.AI cs.GR cs.LG stat.ML 版本更新 75%

Improved Baselines with Representation Autoencoders

改进的基于表示自动编码器的基线

Jaskirat Singh, Boyang Zheng, Zongze Wu, Richard Zhang, Eli Shechtman, Saining Xie

机构 * Adobe Research(Adobe研究院) ANU(澳大利亚国立大学) New York University(纽约大学)

专题命中 具身导航 :navigation(abstract);world model(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文研究了基于表示自动编码器(RAE)的设计选择,发现三个见解,简化并改进了RAE。首先,研究了一种通用公式,将表示定义为最后k个编码器层的总和,而不是仅最终层。其次,研究了RAE与表示对齐(REPA)的假设,发现两者具有互补的工作机制。最后,改进了RAE在无分类器指导(CFG)中的表现,通过重新参数化DiT模型输出,实现了无需训练第二个模型的指导效果。RAEv2在ImageNet-256上达到了1.06的gFID,且训练效率显著提高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16144 2026-07-15 cs.CV cs.RO 版本更新 74%

LEGO-SLAM: Language-Embedded Gaussian Optimization SLAM

LEGO-SLAM:语言嵌入的高斯优化SLAM

Sibaek Lee, Seongbo Ha, Kyeongsu Kang, Joonyeol Choi, Seungjun Tak, Hyeonwoo Yu

机构 * Department of Intelligent Robotics, Sungkyunkwan University(智能机器人系,成均馆大学)

专题命中 具身导航 :robotics(abstract,comments);robotic(abstract);分类 cs.RO、cs.CV

AI总结 研究将语言特征集成到基于3DGS的SLAM系统的问题,提出LEGO-SLAM框架,利用场景自适应自动编码器压缩语言嵌入,实现语言引导剪枝和回环检测,提升映射质量和跟踪精度,具备开放词汇能力且达15FPS。

Comments Project page :https://lab-of-ai-and-robotics.github.io/LEGO-SLAM/ Submitted to IEEE RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19289 2026-08-18 cs.CV 版本更新 74%

STAG-VIO: Stabilized Prompt-to-Geometry Interface for Robust Dynamic Visual--Inertial Odometry

STAG-VIO:用于鲁棒动态视觉-惯性里程计的稳定提示-几何接口

Rui Zhou, Jingbin Liu, Junbin Xie, Jianyu Zhang, Yingze Hu, Jiele Zhao

专题命中 具身导航 :navigation(title);分类 cs.CV

AI总结 STAG-VIO通过提出不确定性自适应多目标跟踪等策略,解决动态VIO中提示不稳定导致的几何估计问题,在公开数据集上显著降低轨迹误差,性能优于现有最优方法。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

Journal ref 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20679 2026-07-27 cs.RO 版本更新 74%

Towards Capability-Aware Traversability Navigation for Unstructured Environments

面向非结构化环境的能力感知可通行性导航

Gianluca Capezzuto, Felipe Tommaselli, Matheus P. Angarola, Ricardo V. Godoy, Marcelo Becker

机构 * University of São Paulo(圣保罗大学)

专题命中 具身导航 :navigation(title);分类 cs.RO

AI总结 研究非结构化环境中可通行性估计,提出能力感知可通行性(CAT)框架,将物理限制嵌入空间特征空间,通过交互式标注和SPADE块改进可通行性预测,在多数据集上领先,实现实例感知避障。

Comments 8 pages, 7 figures. Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026). Project page: https://capability-aware-traversability.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07468 2026-08-21 cs.LG cs.AI 版本更新 73%

Learning-Based Speed Estimation from Accelerometer-Only Inertial Sensing

CarSpeedNet: 基于学习的仅使用加速度计的车速估计

Barak Or

机构 * CEO Office, MetaOr Artificial Intelligence(MetaOr人工智能首席执行办公室) Google(谷歌) Reichman Tech School, Reichman University(Reichman大学技术学院)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.AI、cs.LG

AI总结 CarSpeedNet通过仅使用加速度计实现车速估计,无需陀螺仪或其他传感器,提升低资源环境下的导航精度。

Comments 6 pages, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00406 2026-08-14 eess.SP cs.LG cs.RO 版本更新 73%

LOCUS-DT: Localization via Observation-Conditioned Uncertainty Scoring with Digital Twins

LOCUS-DT:基于数字孪生的观测条件不确定性评分定位方法

Haozhe Lei, Roberto Bomfin, Marwa Chafii, Sundeep Rangan

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 本文提出LOCUS-DT框架,利用数字孪生和学习评分函数处理室内多径定位,泛化性好,在Sionna测试中比高斯类基准更精准捕捉多模态后验结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10744 2026-08-11 cs.CV cs.RO 版本更新 73%

Traj-VLN: Learning Pixel-Space Interaction via Autoregressive Trajectory Generation

Traj-VLN:通过自回归轨迹生成学习像素空间交互

Changfei Fu, Guangcheng Chen, Aoxiang Gu, Haoxiang Liang, Wenjun Xu, Hong Zhang

机构 * Southern University of Science and Technology(南方科技大学) Peng Cheng National Laboratory(鹏城国家实验室) Guangdong University of Technology(广东工业大学)

专题命中 具身导航 :embodied agent(abstract);navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究连续环境中视觉与语言导航问题,提出通过自回归轨迹生成在2D像素空间微调视觉语言模型来学习导航交互的方法,实验验证该方法能显著提升性能,旗舰模型在有限资源和数据下达最优水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20785 2026-08-04 cs.RO cs.AI 版本更新 73%

Robostral Navigate

稳健导航

Abdelaziz Bounhar, Abhijeet Somani, Aditi Kabra, Adrian Valente, Adrien Petralia, Adrien Sade, Alan Jeffares, Albert Jiang, Aleksandr Timashov, Alexandre Cahill, Alexandre Gavaudan, Alexandre Laval, Alexandre Sablayrolles, Amelie Heliou, Amos You, Andre Jonasson, Andrew Bai, Andrew Ehrenberg, Andrew Zhao, Angele Lenglemetz, Anmol Agarwal, Antonia Calvi, Arata Suzuki, Arjun Majumdar, Arthur Fournier, Artjom Joosen, Avinash Sooriyarachchi, Aylin Guliz Akkus, Aysenur Karaduman, Baptiste Bout, Baptiste Roziere, Baudouin De Monicault, Benjamin Holzschuh, Benjamin Lefaudeux, Benjamin Tibi, Bernhard Stadlbauer, Blazej Osinski, Camille Le Scao, Chaoran Yu, Charlotte Cronjager, Chen-Yo Sun, Chris Bamford, Christian Wallenwein, Christophe Renaudin, Clemence Lanfranchi, Corentin Barreau, Corentin Sautier, Cristiana-Diana Diaconu, Cyprien Courtot, Daniel Marczak, Darius Dabert, Diego de Las Casas, Dominik Nuss, Dylan Rubini, Dzmitry Soupel, Elizaveta Demyanenko, Elliot Chane-Sane, Emilien Fugier, Emmanuel Gottlob, Erik Aas, Etienne Goffinet, Etienne Millon, Eujeong Choi, Fabian Paischer, Fabian Schlager, Faruk Ahmed, Federico Baldassarre, Filip Szatkowski, Florian Wiesner, Gabrielle Berrada, Gaetan Ecrepont, Gaetan Lepage, Gaspard Blanchet, Gaspard Donada-Vidal, Gauthier Delerce, Gauthier Guinet, Genevieve Hayes, Georgii Novikov, Giada Pistilli, Gianluca Galletti, Guillaume Breton, Guillaume Kunsch, Guillaume Lample, Guillaume Martin, Guillaume Raille, Gunjan Dhanuka, Gunshi Gupta, Han Zhou, Harshil Shah, Hasan Furkan Vural, Hedi Hadiji, Hope McGovern, Hugo Cisneros, Hugo Thimonier, Indraneel Mukherjee, Ivan Cuevas Salazar, Jacques Sun, Jan Ludziejewski, Jason Rute, Jean Quentin, Jean-Hadrien Chabran, Jean-Malo Delignon, Jie Zhang, Joachim Studnia, Joep Barmentlo, Johannes Brandstetter, John Harvill, Jonas Amar, Jonas Schweizer, Josephine Delas, Josselin Somerville, Julien Denize, Julien Tauran, Kartik Khandelwal, Khyathi Raghavi Chandu, Kilian Tep, Kush Jain, Larissa Laich, Laura Calem, Laurence Aitchison, Laurent Callot, Laurent Fainsin, Leo Cotteleer, Leonard Blier, Lingxiao Zhao, Louis Martin, Louis Serrano, Lucile Saulnier, Ludovic Ho Fuh, Luis Montero, Maarten Buyl, Manon Chossegros, Marcin Mozejko, Margaret Jennings, Markus Hennerbichler, Martin Alexandre, Mathieu Poiree, Mathieu Schmitt, Mathilde Guillaumin, Matthieu Andre, Matthieu Dinot, Matthieu Futeral, Maurits Bleeker, Mauro Comi, Max Mynter, Maxim Berman, Maxime Darrin, Maxime Louis, Maximilian Augustin, Maximilian Muller, Melina Jingting Laimon, Mert Unsal, Mia Chiquier, Michael Pilcer, Michal Pietruszka, Michal Zajac, Mikhail Biriuchinskii, Minh-Quang Pham, Minwoo Kang, Morgane Riviere, Namit Katariya, Nathan Grinsztajn, Nathan Simpson, Neeraj Aggarwal, Neha Gupta, Ola Mysiak, Oliver Leicht, Olivier Bousquet, Olivier Duchenne, Parag Jain, Patricia Wang, Patrick Blies, Patrick von Platen, Paul Jacob, Paul Wambergue, Paula Kurylowicz, Pavan Kumar Reddy, Pavel Kuksa, Philippe Pinel, Philomene Chagniot, Pierre Stock, Pierre-Andre Savalle, Piotr Milos, Prateek Gupta, Pravesh Agrawal, Quentin Desreumaux, Quentin Torroba, Quercus Hernandez, Ram Ramrakhya, Randall Isenhour, Ranjit Parva, Raul Perez Pelaez, Reinhard Sonnleitner, Remi Delacourt, Richard Kurle, Rishi Shah, Rob Romijnders, Rohin Arora, Romain Sauvestre, Roman Soletskyi, Rosalie Millner, Rupert Menneer, Sagar Vaze, Samuel Barry, Samuel Belkadi, Samuel Humeau, Sanchit Gandhi, Sandeep Subramanian, Sarthak Mittal, Saskia Adaime, Sean Cha, Sebastian Kaltenbach, Shashwat Dalal, Shashwat Verma, Sherif Waly, Shrimai Prabhumoye, Siddhant Waghjale, Siddharth Gandhi, Simon Lepage, Simon Sorg, Soham Ghosh, Sophie Marbach, Srijan Mishra, Stanislas Lange, Steve Hong, Sumukh Aithal, Szymon Antoniak, Tarun Kumar Vangani, Teven Le Scao, Theo Cachet, Thibaut Lavril, Thomas Chabal, Thomas Coste, Thomas Defard, Thomas Foubert, Thomas Robert, Thomas Wang, Tianyu Zhang, Tim Lawson, Timothee Lacroix, Tobias Kronlachner, Tom Bewley, Tom Edwards, Tomas Hodan, Tuhin Das, Tyler Wang, Ulrick BLE, Umar Jamil, Umberto Tomasini, Valentin Mace, Van Phung, Vedant Nanda, Victor Jouault, Victor Letzelter, Victor Paltz, Victor Poucheret, Vincent Maladiere, Vincent Pfister, Virgile Richard, Vladislav Bataev, Wassim Bouaziz, Wen Ding Li, William Havard, William Marshall, Xinghui Li, Xingran Guo, Xinyu Yang, Yann Dreze, Yassine El Ouahidi, Yassir Bendou, Yihan Wang, Yimu Pan, Yves Martin des Taillades, Zaccharie Ramzi, Zhenlin Xu, Zsofia Csakany

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 研究旨在解决大规模导航系统部署问题,提出Robostral Navigate模型,仅用单目RGB图像流预测路点,具鲁棒性。通过模拟场景减少对真实数据依赖,用前缀缓存训练等方法,在基准测试中达新最优,提升导航系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19719 2026-08-04 cs.LG cs.RO 版本更新 73%

Koopman Dreamer: Spectrally Constrained Latent Dynamics for Stable World-Model Imagination

库普曼梦想家:用于稳定世界模型想象的频谱约束潜在动力学

Jiaqi Li, Xinglong Zhang, Haibin Xie, Yixing Lan, Wei Pan, Xin Xu

机构 * College of Intelligence Science and Technology, National University of Defense Technology(国防科技大学智能科学与技术学院) School of Engineering, Newcastle University(纽卡斯尔大学工程学院)

专题命中 具身导航 :navigation(abstract);world model(abstract);分类 cs.RO、cs.LG

AI总结 研究针对潜在世界模型长期展开中模态持久性和误差积累控制有限的问题,提出库普曼梦想家模型,通过频谱约束潜在动力学核心及多种目标结合优化,推导误差界,实验证明其提高了长期潜在展开稳定性及闭环控制性能。

Comments 20 pages, 13 figures, 11 tables. Revised manuscript with a more concise and precise abstract and improved clarity and presentation throughout the main text. The main technical content, experimental results, and conclusions remain unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31119 2026-07-23 cs.RO cs.LG 版本更新 73%

Don't Fool Me Twice: Adapting to Adversity in the Wild with Experience-Driven Reasoning

不要愚弄我两次:通过经验驱动推理在野外适应逆境

Navin Sriram Ravie, Andrew Jong, Krrish Jain, John Liu, Omar Alama, Bijo Sebastian, Sebastian Scherer

机构 * Department of Engineering Design, Indian Institute of Technology, Madras(印度理工学院工程设计系,马德拉斯) Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 具身导航 :robotics(abstract);embodied agent(abstract);分类 cs.RO、cs.LG

AI总结 提出一种持续学习框架,使移动机器人能够在线从干扰中学习,通过语义将异常行为归因于原因,从而更好地预测和规划未来。

Comments Accepted at 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17315 2026-06-19 cs.LG cs.AI 版本更新 73%

Flickering Multi-Armed Bandits

闪烁多臂老虎机

Sourav Chakraborty, Amit Kiran Rege, Claire Monteleoni, Lijun Chen

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) INRIA Paris(巴黎国家信息与自动化研究所)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.AI、cs.LG

AI总结 提出闪烁多臂老虎机模型,通过随机图约束动作可用性,设计两阶段懒惰随机游走算法实现次线性遗憾界,并证明信息论下界的最优性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03604 2026-08-07 cs.HC 版本更新 71%

Language Scent: Exploring Cross-Language Information Navigation

语言气味:探索跨语言信息导航

Jiawen Stefanie Zhu, Katharina Reinecke, Tanushree Mitra

专题命中 具身导航 :navigation(title)

AI总结 研究探讨了多语言用户在信息检索中跨语言切换的机制,提出'语言气味'理论,并设计Niffler系统支持跨语言信息导航,通过上下文线索和工具提升探索性搜索策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08975 2026-06-10 math.NA cs.NA 版本更新 71%

Overlapping Schwarz Preconditioners for Pose-Graph SLAM in Robotics

机器人位姿图SLAM中的重叠型Schwarz预条件子

Stephan Köhler, Oliver Rheinbach, Yue Xiang Tee, Sebastian Zug

专题命中 具身导航 :robotics(title)

AI总结 提出基于GDSW型能量最小化粗空间的两层重叠Schwarz预条件子,用于SLAM位姿图优化中的稀疏线性系统,数值实验表明其具有数值可扩展性。

Comments 26 pages, 8 figures. To be submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17633 2026-08-21 cs.RO 版本更新 70%

OVIP-SG: Open-Vocabulary Instance-Preserving Scene Graphs for Mapping and Retrieval of Small, Fine-Grained Objects

OVIP-SG:用于小型细粒度物体映射与检索的开放词汇实例保留场景图

Tianjing Hao, Haiyu Lan, Angsong Li, Cheng Chen, Enyu Li, Jiarui Yang, Yuning Su, Peiwen Lin, Wang Chuang

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出OVIP-SG框架,通过VLM等技术实现小型细粒度物体的实例保留映射与语言引导检索,在Replica数据集上的多项指标优于现有方法,且经实际机器人实验验证有效。

Comments 15 pages, 6 figures, including appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10449 2026-08-13 cs.RO 版本更新 70%

PBD-AG: Persistent Baseline-Delta Active Graphs with Uncertainty-Aware Inspection for Long-Horizon Service Robots

PBD-AG:面向长周期服务机器人的具有不确定性感知检查的持久基线-增量主动图

Shuo Bao, Wei Dong, Shuyue Zhang, Ming Shang, Yuchen Huang, Han Yu, Chengjie Xu, Yiheng Bi, Kai Sun, Fuchun Sun, Xinzhou Wang

专题命中 具身导航 :world model(abstract);robotic(abstract);分类 cs.RO

AI总结 针对长周期服务机器人世界模型构建的现有方法存在不足,本文提出PBD-AG框架,通过解耦稳定固定装置与动态对象事件,结合不确定性感知检查,在仿真与物理机器人实验中取得更优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05900 2026-08-04 eess.SY cs.RO cs.SY 版本更新 70%

Disentangled Control of Multi-Agent Systems

多智能体系统的解耦控制

Ruoyu Lin, Gennaro Notomista, Magnus Egerstedt

机构 * Department of Electrical Engineering and Computer Science, University of California, Irvine(加州大学 Irvine 分校 电气工程与计算机科学系) Department of Electrical and Computer Engineering, University of Waterloo(滑铁卢大学 电气与计算机工程系) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.RO

AI总结 本文提出一种通用多智能体控制合成框架,适用于具有收敛保证的广泛问题,包括具有时间变化目标函数的问题。该框架实现去中心化而不引入智能体间的动态耦合,自然支持多目标机器人和实时实现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18060 2026-07-29 cs.RO 版本更新 70%

RoboHarness: Memory-Driven Orchestration of Heterogeneous Robot Policies for Long-Horizon Planning

RoboHarness:用于长期规划的异构机器人策略的内存驱动编排

Jinbang Huang, Yuanzhao Hu, Zhiyuan Li, Ran Qi, Yixin Xiao, Zhanguang Zhang, Mark Coates, Tongtong Cao, Yingxue Zhang

机构 * Huawei Noah’s Ark Lab(华为诺亚方舟实验室) University of British Columbia(英属哥伦比亚大学) University of Toronto(多伦多大学) McGill University(麦吉尔大学) Labs(2012实验室)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 针对长期机器人任务需多种能力、异构策略编排难的问题,提出RoboHarness框架,通过多模态执行内存等表征策略能力边界,经内存桥接稳定策略交接,实验验证其在长期规划和分布外鲁棒性上有显著提升。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20071 2026-07-28 cs.CV 版本更新 70%

GaussianSeed: Hierarchical Gaussian Seeding for High-Resolution 3D Occupancy Prediction

高斯种子:用于高分辨率3D占用预测的分层高斯播种

Xinzhuo Li, Xianghui Pan, Jiayuan Du, Wei Wei, Liuyi Wang, Chengju Liu, Qijun Chen

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.CV

AI总结 针对现有3D占用预测方法难以扩展到高体素分辨率的问题,提出高斯种子框架,通过分层设计规避内存瓶颈,构建TJScenes数据集,实验表明该方法在保持高精度的同时具有最低延迟,推动了高分辨率3D占用预测的效率-质量前沿。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05385 2026-07-14 cs.RO cs.SY eess.SY 版本更新 70%

Accelerating Sampling-Based Control via Learned Linear Koopman Dynamics

通过学习的线性Koopman动力学加速基于采样的控制

Wenjian Hao, Yuxuan Fang, Zehui Lu, Shaoshuai Mou

机构 * School of Aeronautics and Astronautics, Purdue University(航空航天学院,普渡大学)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于学习的线性Koopman动力学的MPPI控制框架,通过减少计算成本实现高效实时控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22346 2026-06-24 cs.RO 版本更新 70%

A Pairwise Human-Human Interaction Detection and Recognition Framework for Mobile Service Robots

面向移动服务机器人的成对人-人交互检测与识别框架

Mengyu Liang, Iolanda Leite, Sarah Gillet

机构 * Wallenberg AI, Autonomous Systems and Software Program – Humanity and Society(瓦伦贝格人工智能、自主系统和软件计划—人类与社会)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出两阶段框架,先利用轻量几何和运动线索识别交互对,再通过关系网络分类交互类型,在JRDB数据集上以较低计算成本取得竞争性能,并在CAD和零样本数据集上验证泛化性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19749 2026-06-09 eess.IV cs.CV 版本更新 70%

SPIRONet: Spatial-Frequency Learning and Graph-based Channel Interaction Network for Vessel Segmentation

SPIRONet:用于血管分割的空间-频率学习与基于图的通道交互网络

De-Xing Huang, Xiao-Hu Zhou, Xiao-Liang Xie, Shi-Qi Liu, Shuang-Yi Wang, Zhen-Qiu Feng, Mei-Jiang Gui, Hao Li, Tian-Yu Xiang, Bo-Xian Yao, Zeng-Guang Hou

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.CV

AI总结 提出SPIRONet,通过双空间-频率编码器、交叉注意力融合和基于图的通道交互模块,解决低信噪比、细小血管和强干扰下的血管分割难题,在五个数据集上取得最优性能。

Comments Accepted by Biomedical Signal Processing and Control. 15 Pages, 9 Figures, 13 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏