LCLA: Language-Conditioned Latent Alignment for Vision-Language Navigation
LCLA:语言引导的潜在对齐用于视觉-语言导航
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 LCLA通过将视觉-语言观测对齐到专家策略的潜在空间,实现轻量级的视觉-运动学习,提升在不同环境下的泛化能力。
视觉与机器人
机器人、具身智能、机器人学习、操作、导航和具身世界模型。
LCLA:语言引导的潜在对齐用于视觉-语言导航
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 LCLA通过将视觉-语言观测对齐到专家策略的潜在空间,实现轻量级的视觉-运动学习,提升在不同环境下的泛化能力。
医疗无人机综述:从飞行动力学、导航与控制视角
机构 * Department of Mechanical Engineering, Texas Tech University(机械工程系,得克萨斯理工大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 本文从飞行动力学、导航与控制角度综述医疗无人机,探讨任务需求、载具设计、GNC算法及优化方向。
少即是多:从有限数据实现可扩展的视觉导航
机构 * ETH Zurich(苏黎世联邦理工学院) ; Stanford University(斯坦福大学) ; UC Berkeley(伯克利加州大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 本文提出Less is More方法,通过结合有限专家示范与规划器生成的监督,实现高效视觉导航。
Comments v2: Minor text edits, reference formatting fixes, and project page link added
基于用户反馈的视觉-语言导航适应
机构 * Mohamed bin Zayed University of Artificial Intelligence(Mohamed bin Zayed大学人工智能学院) ; School of Electrical Engineering and Computer Science, The University of Queensland(电气工程与计算机科学学院,昆士兰大学) ; University of Science and Technology of China(中国科学技术大学) ; School of Computer Science, The University of Adelaide(计算机科学学院,阿德莱德大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.AI
AI总结 本文提出基于用户反馈的视觉-语言导航适应方法,通过拓扑感知轨迹构建和持久记忆库机制,提升代理对用户指令的响应能力,实现高效模仿学习和跨指令风格的强适应性。
GenMRP:一种生成式多路径规划框架,用于高效且个性化的实时工业导航
机构 * Amap, Alibaba Group(阿里的地图公司) ; Southern University of Science and Technology(南方科技大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 GenMRP通过生成式多路径规划框架实现高效且个性化的实时工业导航,结合骨架到毛细血管方法和校正增强策略,提升路径规划的效率与多样性。
基于多线程的Recast路径搜索用于动态游戏环境中的可扩展导航
机构 * University of Kelaniya(凯利亚大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 本文提出一种多线程Recast-based A*路径搜索框架,通过网格生成、轨迹平滑和密度分析提升动态游戏环境中的导航性能。
一种针对解剖结构的导管引导机器人以提高血管导航
机构 * FuTURE Lab, Department of Robotics Engineering, Worcester Polytechnic Insitute (WPI)(未来实验室、机器人工程系、沃斯特理工学院)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 本文提出了一种针对解剖结构的导管引导机器人,通过模型预测和实验验证,实现了高精度的导管形状塑形和复杂血管导航能力。
Comments 7 pages, 7 figures, ISMR2026
具有可解释导航意图的统一多模态船舶轨迹预测
机构 * School of Computer Science and Artificial Intelligence, Wuhan University of Technology(武汉理工大学计算机科学与人工智能学院) ; School of Navigation, Wuhan University of Technology(武汉理工大学航海学院) ; Hubei Key Laboratory of Internet of Intelligence, School of Electronic Information and Communications, Huazhong University of Science and Technology(华中科技大学电子信息与通信学院智能互联网关键实验室) ; College of Computer Science and Electronic Engineering, Hunan University(湖南大学计算机科学与电子工程学院)
专题命中 具身导航 :navigation(title,abstract);分类 cs.LG
AI总结 本文提出了一种整合可解释导航意图的统一多模态船舶轨迹预测框架,通过构建持续性意图树和动态瞬时意图模型,提升预测的准确性和可解释性。
Journal ref IEEE Transactions on Intelligent Transportation Systems, vol. 27, no. 1, pp. 258-269, Jan. 2026
VISTA: 生成式视觉想象用于视觉-语言导航
机构 * Department of Computer Science and Engineering, Texas A&M University(计算机科学与工程系,德克萨斯大学阿姆斯特朗分校)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 VISTA通过生成式视觉想象与感知对齐策略,提升长距离视觉-语言导航任务的性能。
Comments 13 pages, 5 figures
模块化等周性软机器人桁架用于月球应用
机构 * Ira A. Fulton School of Engineering, Mechanical Engineering Department, Brigham Young University(伊拉·A·福尔顿工程学院,机械工程系, Brigham Young 大学)
专题命中 具身导航 :robotic(title,abstract);分类 cs.RO
AI总结 该研究提出了一种模块化等周性软机器人桁架,用于月球应用,通过可重新配置的结构实现高效太阳能阵列和移动设备。
StepNav: 为高效且多模态视觉导航引入结构化轨迹先验
机构 * University of Chinese Academy of Sciences(中国科学院大学) ; Technology and Engineering Center for Space Utilization, Chinese Academy of Sciences(中国科学院空间利用技术与工程中心)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 StepNav通过结构化多模态轨迹先验提升视觉导航的鲁棒性、效率和安全性。
Comments 8 pages, 7 figures; Accepted by ICRA 2026
USS-Nav: 一体化空间语义场景图用于轻量级无人机零样本物体导航
机构 * School of Aeronautic Science and Engineering, Beihang University, Beijing 100191, China(北京航空航天大学航空科学与工程学院) ; State Key Laboratory of Industrial Control Technology, Zhejiang University, Hangzhou 310027, China(浙江大学工业控制技术状态重点实验室) ; Differential Robotics, Hangzhou 311121, China(杭州差分机器人)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 USS-Nav通过构建一体化空间语义场景图,实现轻量级无人机在未知环境中的高效零样本物体导航,提升计算效率和实时更新能力。
通过误差最小化重新映射和导航嵌入空间:认知在自然和人工系统中的基本组织原则
机构 * Allen Discovery Center at Tufts University(塔夫茨大学阿伦发现中心) ; Wyss Institute for Biologically Inspired Engineering at Harvard University(哈佛大学生物启发工程研究所)
专题命中 具身导航 :navigation(title,abstract);分类 cs.AI
AI总结 通过误差最小化重新映射和导航嵌入空间,揭示认知在自然和人工系统中的基本组织原则。
Comments 41 pages, 5 figures
JSR-GFNet: 针对未来认知全球导航卫星系统干扰分类的干扰-信号比感知动态门控
机构 * National Key Laboratory of Wireless Communications, University of Electronic Science and Technology of China(中国电子科技大学无线通信国家重点实验室) ; University of Electronic Science and Technology of China(中国电子科技大学) ; Shanghai Aerospace Electronic Technology Institute(上海航天电子技术研究所) ; Shanghai Key Laboratory of Collaborative Computing in Spacial Heterogeneous Networks (CCSN)(上海空间异构网络协同计算重点实验室) ; Anhui Science and Technology University(安徽科技大学) ; University of Oxford(牛津大学) ; Shanghai Xiaoyuan Innovation center(上海小元创新中心)
专题命中 具身导航 :navigation(title,abstract);分类 cs.AI
AI总结 JSR-GFNet通过结合相位敏感的IQ样本与STFT频谱图,利用动态门控机制提升GNSS干扰分类的准确性和鲁棒性。
在线导航优化:通过关联标准定义和在线感知地图实现车道级引导
机构 * Amap, Alibaba Group(阿里的Amap部门) ; School of Aerospace, BUAA(北京航空航天大学航空学院) ; Key Laboratory of Spacecraft Design Optimization and Dynamic Simulation Technology, Ministry of Education(教育部航天器设计优化与动态仿真技术重点实验室) ; State Key Laboratory of High-Efficiency Reusable Aerospace Transportation Technology(高效可重复使用航天运输技术国家重点实验室)
专题命中 具身导航 :navigation(title,abstract);分类 cs.CV
AI总结 本文提出在线导航优化方法,通过关联标准定义地图与在线感知地图,实现车道级导航,提升导航精度与实时性。
Comments Author Affiliation Standardization
Lantern: 一种极简主义的机器人物体平台
机构 * Johns Hopkins University(约翰霍普金斯大学) ; Rice University(里士满大学)
专题命中 具身导航 :robotic(title,abstract);分类 cs.RO
AI总结 Lantern通过极简主义设计和开源平台,探索人机交互场景,降低HRI研究门槛。
动态拓扑感知:突破视觉语言导航中的粒度刚性
机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空航天信息研究所) ; School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院) ; Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系)
专题命中 具身导航 :navigation(title,abstract);分类 cs.CV
AI总结 DGNav通过动态拓扑导航框架,解决视觉语言导航中的粒度刚性问题,提升导航效率与安全性。
IROS: 一种用于实时基于视觉语言模型的室内导航的双过程架构
机构 * Yonsei University(延世大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 IROS是一种结合视觉语言模型上下文推理与轻量级感知模块的双过程架构,实现低延迟的室内导航。
辅助惯性导航策略用于自主水下航行器的松散耦合系统:姿态误差建模与方差传播
机构 * State Key Laboratory of Ocean Sensing, Ocean College of Zhejiang University(浙江大学海洋传感国家重点实验室)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 本文提出一种结合姿态误差建模与方差传播的松散耦合惯性导航策略,有效抑制长期误差发散,提升自主水下航行器的导航精度。
SCoPE VLM:面向视觉语言模型高效文档导航的 selective context processing
机构 * Georgia Institute of Technology(佐治亚理工学院) ; Konkuk University(韩国康克伦大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.CV
AI总结 SCoPE VLM通过引入滚动链机制和定制强化学习方法,实现高效文档导航,提升视觉语言模型在多页文档问答中的代理阅读能力。
提升基于SE2(3)群的扩展卡尔曼滤波器自主性以实现集成导航:应用
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 本文提出改进基于SE2(3)群的扩展卡尔曼滤波器自主性,通过实验和模拟验证其在高精度导航中的应用效果。
Comments arXiv admin note: substantial text overlap with arXiv:2601.16062. substantial text overlap with arXiv:2601.16062. substantial text overlap with arXiv:2601.16062. substantial text overlap with arXiv:2601.16062
CLASH:协作式大-小层级框架用于连续视觉-语言导航
机构 * Tongji University(同济大学) ; Key Laboratory of Smart Manufacturing in Energy Chemical Process, Ministry of Education, East China University of Science and Technology(能源化工过程智能制造重点实验室,教育部,东华大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 CLASH通过整合反应式小模型规划器与反思式大模型推理器,实现连续视觉-语言导航任务中的高效协作与鲁棒导航,显著提升任务性能和鲁棒性。
提升基于SE2(3)群的扩展卡尔曼滤波器在集成导航中的自主性:理论分析
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 本文提出了一种基于SE2(3)群的导航模型构建方法,以提升高精度导航中误差传播的自主性,解决地球自转和惯性设备偏置带来的挑战。
通过视觉语言模型探索社交合规机器人导航的提示设计
机构 * Hokkaido University(北海道大学) ; The University of Tokyo(东京大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 本文通过设计社交合规的提示策略,提升小型视觉语言模型在机器人导航中的行动准确性,发现与自我竞争的提示设计效果最佳。
教机器人像教狗一样:从诱饵、手势和言语中学习敏捷导航
机构 * Department of Artificial Intelligence, Korea University(人工智能系,韩国大学) ; Department of Computer Science, ETH Zurich(计算机科学系,苏黎世联邦理工学院) ; Department of Mechanical and Aerospace Engineering, UCLA(机械与航空航天工程系,加州大学洛杉矶分校)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 本研究提出了一种人机协同框架,通过手势、言语和诱饵等多模态输入,使机器人高效学习敏捷导航,实验显示在少于1小时的数据下任务成功率高达97.15%。
Comments 10 pages, 7 figures
利用光能提升轻于空气微型无人机的续航与导航能力
机构 * TU Delft(代尔夫特理工大学) ; The University of Auckland(奥克兰大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 本研究提出了一种利用光能进行能量收集和导航的紧凑型轻于空气微型无人机,通过高保真仿真框架、太阳能集成和点对点导航算法,实现了可持续的自主飞行和导航能力。
FocusNav: 有人机器人局部导航中的空间选择性注意力与路径引导
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 FocusNav通过路径引导的空间交叉注意力机制和稳定性感知的选通门模块,提升人形机器人在动态复杂环境中的导航鲁棒性。
Comments 12 pages, 11 figures
空间视觉导航:具有显式空间感知和探索的零样本视觉-语言导航
机构 * Robotics and Control Laboratory, School of Advanced Manufacturing and Robotics, and the State Key Laboratory of Turbulence and Complex Systems, Peking University(机器人与控制实验室、先进制造与机器人学院,以及湍流与复杂系统国家重点实验室,北京大学) ; Defense Innovation Institute, Academy of Military Sciences, Beijing(国防科技创新研究院,军事科学院,北京) ; Tianjin Artificial Intelligence Innovation Center, Tianjin(天津人工智能创新中心,天津) ; Institute of Computing and Intelligence, Harbin Institute of Technology (Shenzhen)(计算与智能学院,哈尔滨工业大学(深圳))
专题命中 具身导航 :navigation(title,abstract);分类 cs.CV
AI总结 Spatial-VLN通过增强空间感知和探索机制,提升零样本视觉-语言导航在复杂环境中的泛化与鲁棒性。
通过诱导弯曲的约束带实现高曲率导航的翻转机器人
机构 * Department of Surgical Sciences, University of Turin(都灵大学外科科学系) ; PRISMA Lab, Department of Electrical Engineering and Information Technology, University of Naples Federico II(那不勒斯费德里科二世大学电气工程与信息技术系PRISMA实验室) ; School of Biomedical Engineering and Imaging Sciences, King’s College London(伦敦国王学院生物医学工程与成像科学学院)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 本文提出通过约束带降低翻转机器人弯曲刚度,实现高曲率导航,提升在狭窄路径中的机动性。
LLM-Glasses: 基于生成式AI的具有触觉反馈的眼镜用于盲人导航
机构 * Skolkovo Institute of Science and Technology (Skoltech)(斯克尔科沃科学与技术研究所)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 LLM-Glasses通过生成式AI和触觉反馈为视障人士提供导航支持,实验显示其在不同障碍物环境下具有较高的导航准确性。