arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 14052 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 14052 篇

2605.09053 2026-05-12 cs.CV 79%

LCGNav: Local Candidate-Aware Geometric Enhancement for General Topological Planning in Vision-Language Navigation

LCGNav: 本地候选感知的几何增强以实现连续环境中的通用拓扑规划

Jiankun Peng, Jianyuan Guo, Yiguang Yang, Yue Liu, Jiashuang Yan, Ying Xu

机构 * The Aerospace Information Research Institute, Chinese Academy of Sciences, Beijing(中国科学院航空航天信息研究所,北京) The School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences, Beijing(中国科学院大学电子电气与通信工程学院,北京) The Department of Computer Science, City University of Hong Kong, Hong Kong, SAR, China(香港城市大学计算机科学系,香港特别行政区,中国)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 LCGNav通过本地几何增强框架解决连续环境视觉语言导航中局部深度信息冗余和候选前沿关注不足的问题,提升拓扑规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12333 2026-05-12 cs.RO cs.MA 79%

GameChat: Multi-LLM Dialogue for Safe, Agile, and Socially Optimal Multi-Agent Navigation in Constrained Environments

GameChat:多LLM对话用于在受限环境中安全、敏捷且社会最优的多智能体导航

Vagul Mahadevan, Shangtong Zhang, Rohan Chandra

机构 * University of Virginia(弗吉尼亚大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出GameChat方法,通过自然语言通信解决多智能体在受限环境中安全、敏捷且无 deadlock 的导航问题,实验显示其在目标到达时间及优先级任务完成率上显著提升。

Journal ref 2025 IEEE International Symposium on Multi-Robot and Multi-Agent Systems (MRS), 2025, pp. 1-7

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08310 2026-05-12 cs.CR cs.AI 79%

WebTrap: Stealthy Mid-Task Hijacking of Browser Agents During Navigation

WebTrap: 隐秘的中任务劫持攻击浏览器代理在导航过程中的行为

Zhichao Liu, Wenbo Pan, Haining Yu, Ge Gao, Tianqing Zhu, Xiaohua Jia

机构 * Harbin Institute of Technology(哈尔滨工业大学) City University of Hong Kong(香港城市大学) City University of Macau(澳门城市大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 WebTrap通过多步骤指令融合引导实现浏览器代理在导航任务中的隐秘劫持,提升攻击成功率同时保持系统可用性。

Comments 31 pages, 4 figures, 10 tables. Code: https://github.com/liuyaojialiuyaojia/WebTrap

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08269 2026-05-12 cs.RO cs.SY eess.SY 79%

Anatomical Landmark-Guided Deep Reinforcement Learning for Autonomous Gastric Navigation

基于解剖标志的深度强化学习用于自主胃部导航

Haoxuan Wu, Sishen Yuan, Haitao Gao, Zhen Li, Xiuli Zuo, Hongliang Ren

机构 * Department of Electronic Engineering, The Chinese University of Hong Kong, Hong Kong SAR, China(香港中文大学电子工程系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出基于解剖标志的深度强化学习框架,用于自主胃部导航,通过轻量边缘轮廓深度融合模块,利用低维地标坐标提升导航性能,实验显示在模拟和体外实验中均取得显著效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19966 2026-05-11 cs.RO 79%

GustPilot: A Hierarchical DRL-INDI Framework for Wind-Resilient Quadrotor Navigation

GustPilot:一种用于抗风四旋翼导航的分层DRL-INDI框架

Amir Atef Habel, Roohan Ahmed Khan, Fawad Mehboob, Clement Fortin, Dzmitry Tsetserukou

机构 * Intelligent Space Robotics Laboratory(智能空间机器人实验室) Center for Digital Engineering(数字工程中心) Skolkovo Institute of Science and Technology(斯克尔科夫科学与技术研究院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出GustPilot框架,结合深度强化学习与INDI控制器,通过风感知规划和快速扰动抑制提升四旋翼在风扰环境下的导航可靠性。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05960 2026-05-08 cs.RO 79%

Plug-and-Play Label Map Diffusion for Universal Goal-Oriented Navigation

即插即用标签地图扩散用于通用目标导向导航

Zhixuan Shen, Yijie Zeng, Shengxiang Luo, Tianrui Li, Haonan Luo

机构 * School of Computing and Artificial Intelligence(计算与人工智能学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出PLMD方法,通过扩散模型生成未知区域的障碍和语义标签,实现部分观测环境下的目标定位,同时提升导航策略的语义地图整合能力,实验表明其在三个目标导向导航任务中表现优异。

Comments 21 pages, 10 figures, Extended Version of accepted ICML 2026 Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07557 2026-05-05 cs.RO 79%

AutoSpatial: Visual-Language Reasoning for Social Robot Navigation through Efficient Spatial Reasoning Learning

AutoSpatial: 通过高效空间推理学习实现社交机器人导航的视觉-语言推理

Yangzhe Kong, Daeun Song, Jing Liang, Dinesh Manocha, Ziyu Yao, Xuesu Xiao

机构 * George Mason University(乔治·马歇尔大学) University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出AutoSpatial方法,通过结构化空间接地和大规模VQA对自动生成标签,提升VLMs在社交导航中的空间推理能力,实现更准确的空间感知、运动预测、推理、行动和解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13559 2026-05-01 cs.AI 79%

OpAgent: Operator Agent for Web Navigation

OpAgent:网页导航的运算代理

Yuyu Guo, Wenjie Yang, Siyuan Yang, Ziyang Liu, Cheng Chen, Yuan Wei, Yun Hu, Yang Huang, Guoliang Hao, Dongsheng Yuan, Jianming Wang, Xin Chen, Hang Yu, Lei Lei, Peng Di

机构 * Ant Group(蚂蚁集团)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 本文提出OpAgent,通过在线强化学习优化网页导航策略,结合层级多任务微调和混合奖励机制,实现71.6%的高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26839 2026-04-30 cs.RO 79%

Walk With Me: Long-Horizon Social Navigation for Human-Centric Outdoor Assistance

带我走:面向以人为本的户外助行的长周期社交导航

Lingfeng Zhang, Xiaoshuai Hao, Xizhou Bu, Yingbo Tang, Hongsheng Li, Jinghui Lu, Xiu-shen Wei, Jiayi Ma, Yu Liu, Jing Zhang, Hangjun Ye, Xiaojun Liang, Long Chen, Wenbo Ding

机构 * Tsinghua University(清华大学) Pengcheng Laboratory(鹏城实验室) Hefei University of Technology(合肥工业大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出Walk with Me框架,通过高阶视觉语言模型和轻量级兴趣点,实现无地图的长周期社交导航,结合语义意图定位、安全推理和低层动作生成,提升户外助行的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26504 2026-04-30 cs.RO 79%

HiPAN: Hierarchical Posture-Adaptive Navigation for Quadruped Robots in Unstructured 3D Environments

HiPAN:四足机器人在非结构化3D环境中的分层姿态自适应导航

Jeil Jeong, Minsung Yoon, Seokryun Choi, Heechan Shin, Taegeun Yang, Sung-eui Yoon

机构 * School of Computing, KAIST(韩国科学技术院计算机学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 HiPAN通过分层设计和路径引导课程学习,提升四足机器人在复杂3D环境中的导航效率与适应性,实现实时深度图像驱动的策略规划与姿态自适应控制。

Comments Accepted to RA-L 2026 | Project page: https://sgvr.kaist.ac.kr/~Jeil/project_page_HiPAN/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23648 2026-04-28 cs.RO 79%

Safe Navigation in Unknown and Cluttered Environments via Direction-Aware Convex Free-Region Generation

通过方向感知的凸自由区域生成实现未知和杂乱环境中的安全导航

Zhicheng Song, Yongjian Li, Kai Chen, Yulin Li, Fan Shi, Jun Ma

机构 * Robotics and Autonomous Systems Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)机器人与自主系统方向) Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电子与计算机工程系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种结合候选运动方向与机器人几何的凸自由区域生成框架,通过连续安全轨迹生成实现持续无碰撞运动,实验表明该方法在杂乱2D导航场景中生成更符合后续导航的自由区域,并在3D和真实世界中验证了其扩展性和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21130 2026-04-24 cs.RO 79%

Self-Predictive Representation for Autonomous UAV Object-Goal Navigation

自预测表征用于自主无人机目标-目标导航

Angel Ayala, Donling Sui, Francisco Cruz, Mitchell Torok, Mohammad Deghat, Bruno J. T. Fernandes

机构 * Escola Politécnica de Pernambuco, Universidade de Pernambuco(巴伊兰联邦大学皮奥伊技术学院) School of Computer Science and Engineering, University of New South Wales(新南威尔士大学计算机科学与工程学院) School of Mechanical and Manufacturing Engineering, University of New South Wales(新南威尔士大学机械与制造工程学院) Escuela de Ingeniería, Universidad Central de Chile(智利中央大学工程学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出自预测模型AmelPred,用于提升无人机在3D目标-目标导航中的数据样本效率和规划性能。

Comments Submitted to T-RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18779 2026-04-24 cs.CL cs.AI 79%

Mango: Multi-Agent Web Navigation via Global-View Optimization

Mango:通过全局视图优化实现多智能体网络导航

Weixi Tong, Yifeng Di, Tianyi Zhang

机构 * Purdue University(普渡大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 本文提出Mango方法,利用网站结构动态确定最优起始点,通过多臂老虎机问题和Thompson采样优化导航预算,并引入周期性记忆组件提升导航效率,实验显示在WebVoyager和WebWalkerQA上均优于基线方法。

Journal ref ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09574 2026-04-23 cs.RO 79%

Online Structure Learning and Planning for Autonomous Robot Navigation using Active Inference

基于主动推断的自主机器人导航在线结构学习与规划

Daria de tinguy, Tim Verbelen, Emilio Gamba, Bart Dhoedt

机构 * Ghent University(根特大学) Verses FlandersMake(弗拉芒制造)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出AIMAPP框架,通过统一生成模型实现映射、定位和决策,支持在不确定环境中自主探索和导航,无需预定义地图或大量训练。

Comments yet to be submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15518 2026-04-23 cs.RO 79%

Real-Time Initialization of Unknown Anchors for UWB-aided Navigation

UWB导航中未知锚点的实时初始化

Giulio Delama, Igor Borowski, Roland Jung, Stephan Weiss

机构 * Control of Networked Systems Group, University of Klagenfurt(网络化系统控制组,克雷根弗特大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出了一种实时初始化未知UWB锚点的框架,结合在线PDOP估计、轻量级异常检测和自适应鲁棒核,提升鲁棒性和实用性。通过保守的初始化指标,实现更优的初始化几何和更低的定位误差。

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06239 2026-04-23 cs.RO 79%

Open-Architecture End-to-End System for Real-World Autonomous Robot Navigation

面向真实世界的自主机器人导航开架系统

Venkata Naren Devarakonda, Ali Umut Kaypak, Raktim Gautam Goswami, Naman Patel, Rooholla Khorrambakht, Prashanth Krishnamurthy, Farshad Khorrami

机构 * Control/Robotics Research Laboratory (CRRL), Department of Electrical and Computer Engineering, NYU Tandon School of Engineering(控制/机器人研究实验室(CRRL),电气与计算机工程系,NYU塔恩顿工程学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种轻量级开架端到端系统,通过整合多组件实现四足机器人实时导航,利用自然语言任务和语义信息构建场景图,基于LLM生成动态计划,实现在多个室内环境中的零样本自主导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19536 2026-04-22 cs.RO 79%

LiveVLN: Breaking the Stop-and-Go Loop in Vision-Language Navigation

LiveVLN: 突破视觉语言导航中的停止与前进循环

Xiangchen Wang, Weiye Zhu, Teng Wang, TianTian Geng, Zekai Zhang, Zhiyuan Qi, Jinyu Yang, Feng Zheng

机构 * Southern University of Science and Technology(南方科技大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Spatialtemporal AI(时空AI)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 LiveVLN通过增强预训练视觉语言导航器,实现更连续的具身导航,减少等待时间并提升动作可用性,实验证明在真实部署中显著提升执行效率。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19267 2026-04-22 cs.RO 79%

Multimodal embodiment-aware navigation transformer

多模态具身感知导航Transformer

Louis Dezons, Quentin Picard, Rémi Marsal, François Goulette, David Filliat

机构 * LARIAD

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出ViLiNT,通过融合多模态数据提升机器人导航鲁棒性,利用Transformer和扩散模型生成可导航路径,实现在不同环境中导航成功率提升166%。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19064 2026-04-22 cs.CV 79%

The Essence of Balance for Self-Improving Agents in Vision-and-Language Navigation

视觉-语言导航中自改进智能体的平衡本质

Zhen Liu, Yuhan Liu, Jinjun Wang, Jianyi Liu, Wei Song, Jingwen Fu

机构 * State Key Laboratory of Human-Machine Hybrid Augmented Intelligence and the Institute of Artificial Intelligence and Robotics(人机混合增强智能国家重点实验室和人工智能与机器人研究院) School of Information Science and Technology(信息科学与技术学院) Zhongguancun Academy(中关村学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 本文提出SDB机制,通过平衡行为多样性与学习稳定性,提升视觉-语言导航中自改进性能,在R2R、SOON和REVERIE数据集上取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19034 2026-04-22 cs.CV 79%

Explore Like Humans: Autonomous Exploration with Online SG-Memo Construction for Embodied Agents

像人类一样探索:面向具身智能体的在线SG-Memo构建自主探索

Xu Chen, Shichao Xie, Zhining Gu, Lu Jia, Minghua Luo, Fei Liu, Zedong Chu, Yanfen Shen, Xiaolong Wu, Mu Xu

机构 * Alibaba Group(阿里巴巴集团)

专题命中 具身导航 :embodied agent(title);navigation(abstract);分类 cs.CV

AI总结 本文提出ABot-Explorer框架,通过在线RGB-only过程统一记忆构建与探索,利用VLMs提取语义导航 affordances,生成结构化SG-Memo以提升探索效率和环境覆盖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18223 2026-04-21 cs.CV 79%

Instruction-as-State: Environment-Guided and State-Conditioned Semantic Understanding for Embodied Navigation

指令作为状态:环境引导和状态条件的语义理解用于具身导航

Zhen Liu, Yuhan Liu, Jinjun Wang, Jianyi Liu, Wei Song, Jingwen Fu

机构 * National Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家重点实验室) The Institute of Artificial Intelligence and Robotics(人工智能与机器人研究所) School of Information Science and Technology(信息科学与技术学院) Zhongguancun Academy(中关村学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 本文提出了一种环境引导和状态条件的语义理解方法,通过动态指令-感知纠缠提升具身导航性能,实验表明在多个基准测试中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17679 2026-04-21 cs.RO 79%

A Hamilton-Jacobi Reachability-Guided Search Framework for Efficient and Safe Indoor Planar Robot Navigation

一种基于哈密顿-雅可比可达性的搜索框架用于高效安全的室内平面机器人导航

Hanyang Hu, Cameron Siu, Mo Chen

机构 * Simon Fraser University(西蒙弗雷泽大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出结合离线哈密顿-雅可比可达性与在线图搜索的方法,提升室内机器人导航的效率和安全性,通过预计算的HJ值函数作为启发式和安全约束,减少计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17407 2026-04-21 cs.RO 79%

Think before Go: Hierarchical Reasoning for Image-goal Navigation

先思后行:面向图像目标导航的层次推理

Pengna Li, Kangyi Wu, Shaoqing Xu, Fang Li, Lin Zhao, Long Chen, Zhi-Xin Yang, Nanning Zheng

机构 * National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, National Engineering Research Center for Visual Information and Applications, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(人机混合增强智能国家实验室、视觉信息与应用国家工程研究中心、人工智能与机器人研究所、西安交通大学) University of Macau(澳门大学) Xiaomi EV(小米电动车) School of Automation, Beijing Institute of Technology(自动化学院,北京理工大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出HRNav框架,通过分层规划与执行解决图像目标导航问题,利用视觉语言模型生成短期计划并结合在线强化学习策略,引入Wandering Suppression Penalty降低漂移问题,实验验证其有效性。

Comments Accepted by ACL2026 (main conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17190 2026-04-21 cs.CV 79%

LookasideVLN: Direction-Aware Aerial Vision-and-Language Navigation

LookasideVLN: 基于方向的空中视觉与语言导航

Yuwei Ning, Ganlong Zhao, Yipeng Qin, Si Liu, Yang Liu, Liang Lin, Guanbin Li

机构 * Sun Yat-sen University(中山大学) Peng Cheng Laboratory(鹏城实验室) The Chinese University of Hong Kong(香港中文大学) Centre for Perceptual and Interactive Intelligence(感知与交互智能中心) Cardiff University(卡迪夫大学) Beihang University(北航) Guangdong Key Laboratory of Big Data Analysis and Processing(广东大数据分析与处理重点实验室)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 本文提出LookasideVLN,通过利用自然语言中的方向线索提升空中视觉与语言导航的准确性和效率,采用方向感知图、空间地标知识库和方向MLLM导航代理三种核心组件。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16741 2026-04-21 cs.RO 79%

LiDAR-based Crowd Navigation with Visible Edge Group Representation

基于LiDAR的人群导航与可见边缘组表示

Allan Wang, Aaron Steinfeld

机构 * Miraikan, the National Museum of Emerging Science and Innovation(日本新兴科学与创新国家博物馆) the Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出基于LiDAR的人群导航方法,通过可见边缘组表示提升导航安全性与社交性,同时在密集人群环境中实现更快的计算速度。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14652 2026-04-17 cs.RO 79%

DigiForest: Digital Analytics and Robotics for Sustainable Forestry

DigiForest: 数字分析与机器人技术用于可持续林业

Marco Camurri, Enrico Tomelleri, Matías Mattamala, Sebastián Barbas Laina, Martin Jacquet, Jens Behley, Sunni Kanta Prasad Kushwaha, Fang Nan, Nived Chebrolu, Leonard Freißmuth, Marvin Chayton Harms, Meher V. R. Malladi, Fan Yang, Jonas Frey, Cesar Cadena, Marco Hutter, Janine Schweier, Kostas Alexis, Cyrill Stachniss, Maurice Fallon, Stefan Leutenegger

机构 * Dipartimento di Ingegneria Industriale, University of Trento(工业工程系,特伦托大学) Faculty of Engineering, Free University of Bozen-Bolzano(工程学院,博兹纳-博尔扎诺自由大学) Faculty of Agricultural, Environmental and Food Sciences, Free University of Bozen-Bolzano(农业、环境与食品科学学院,博兹纳-博尔扎诺自由大学) Competence Centre for Mountain Innovation Ecosystems(山地创新生态系统研究中心) School of Informatics, University of Edinburgh(信息学院,爱丁堡大学) Technical University of Munich, School of Computation, Information and Technology(慕尼黑技术大学,计算、信息与技术学院) Department of Engineering Cybernetics, Norwegian University of Science and Technology(工程 cybernetics 系,挪威科学技术大学) Center for Robotics, University of Bonn(机器人中心,波恩大学) Swiss Federal Research Institute WSL(瑞士联邦研究 institute WSL) Oxford Robotics Institute, Department of Engineering Science, University of Oxford(牛津大学机器人研究所,工程科学系) Mobile Robotics Lab, ETH Zürich, Department of Mechanical and Process Engineering(移动机器人实验室,苏黎世联邦理工学院机械与过程工程系)

专题命中 具身导航 :robotics(title,abstract);分类 cs.RO

AI总结 DigiForest通过数字技术和自主机器人实现大规模精准林业,包含自主机器人数据采集、自动提取树种特征、决策支持系统和低影响选择性采伐,已在芬兰、英国和瑞士等地验证。

Comments 34 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20913 2026-04-16 cs.CV 79%

LongVideo-R1: Smart Navigation for Low-cost Long Video Understanding

LongVideo-R1: 低成本长视频理解的智能导航

Jihao Qiu, Lingxi Xie, Xinyue Huo, Qi Tian, Qixiang Ye

机构 * University of Chinese Academy of Sciences(中国科学院大学) Huawei Consumer Business Group(华为消费者业务集团)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 本文提出LongVideo-R1,一种基于多模态大语言模型的智能导航系统,通过高效视频上下文导航减少冗余搜索,提升长视频理解的效率与准确性。

Comments 17 pages, 9 figures, 8 tables, accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13245 2026-04-16 cs.RO cs.SY eess.SY 79%

Capability-Aware Heterogeneous Control Barrier Functions for Decentralized Multi-Robot Safe Navigation

具备能力的异构控制屏障函数用于去中心化多机器人安全导航

Joonkyung Kim, Yanze Zhang, Wenhao Luo, Yiwei Lyu

机构 * Department of Computer Science and Engineering, Texas A&M University(德克萨斯A&M大学计算机科学与工程系) Department of Computer Science, University of Illinois Chicago(伊利诺伊大学芝加哥分校计算机科学系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出CA-HCBF框架,通过统一动力学模型和能力度量,实现异构机器人团队的安全一致性和能力感知协调,提升安全性和任务效率。

Comments 8 pages, 3 figures, 2 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13108 2026-04-16 cs.SE cs.AI 79%

Formal Architecture Descriptors as Navigation Primitives for AI Coding Agents

形式架构描述符作为AI编码代理的导航原语

Ruoqi Jin

机构 * Independent Researcher(独立研究者)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 本文研究了通过提供形式架构描述符减少AI编码代理在代码库探索中的导航开销,通过实验和观察证明了架构描述符在导航效率和错误检测方面的显著提升。

Comments 4 pages, 4 tables, preprint. Code and data: https://doi.org/10.5281/zenodo.19500105

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12872 2026-04-15 cs.RO 79%

OVAL: Open-Vocabulary Augmented Memory Model for Lifelong Object Goal Navigation

OVAL: 开放词汇增强记忆模型用于终身物体目标导航

Jiahua Pei, Yi Liu, Guoping Pan, Yuanhao Jiang, Houde Liu, Xueqian Wang

机构 * Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 OVAL提出一种开放词汇增强记忆框架,解决长期目标导航中的记忆限制问题,通过内存描述符和概率探索策略提升导航效率与鲁棒性。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏