What does really matter in image goal navigation?
图像目标导航中真正重要的什么?
机构 * NAVER LABS Europe(NAVER欧洲实验室)
专题命中 具身导航 :navigation(title,abstract);embodied AI(abstract);分类 cs.RO、cs.CV
AI总结 本文研究图像目标导航中通过端到端强化学习训练智能体的可行性,并探讨了建筑选择对相对位姿估计器产生和导航性能的影响。
视觉与机器人
机器人、具身智能、机器人学习、操作、导航和具身世界模型。
图像目标导航中真正重要的什么?
机构 * NAVER LABS Europe(NAVER欧洲实验室)
专题命中 具身导航 :navigation(title,abstract);embodied AI(abstract);分类 cs.RO、cs.CV
AI总结 本文研究图像目标导航中通过端到端强化学习训练智能体的可行性,并探讨了建筑选择对相对位姿估计器产生和导航性能的影响。
当注意力背叛时:通过重建视觉标记在机器人策略中消除后门攻击
机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) ; Faculty of Artificial Intelligence, Hubei University(湖北大学人工智能学院) ; Institute of Technological Sciences, Wuhan University(武汉大学技术科学研究院) ; School of Robotics, Wuhan University(武汉大学机器人学院)
专题命中 具身导航 :robotic(title,abstract);robotics(abstract);分类 cs.RO
AI总结 Bera通过重建视觉标记消除机器人策略中的后门攻击,无需重新训练模型即可有效防御后门风险。
Comments ICRA2026 accepted
VISTA: 生成式视觉想象用于视觉-语言导航
机构 * Department of Computer Science and Engineering, Texas A&M University(计算机科学与工程系,德克萨斯大学阿姆斯特朗分校)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 VISTA通过生成式视觉想象与感知对齐策略,提升长距离视觉-语言导航任务的性能。
Comments 13 pages, 5 figures
模块化等周性软机器人桁架用于月球应用
机构 * Ira A. Fulton School of Engineering, Mechanical Engineering Department, Brigham Young University(伊拉·A·福尔顿工程学院,机械工程系, Brigham Young 大学)
专题命中 具身导航 :robotic(title,abstract);分类 cs.RO
AI总结 该研究提出了一种模块化等周性软机器人桁架,用于月球应用,通过可重新配置的结构实现高效太阳能阵列和移动设备。
StepNav: 为高效且多模态视觉导航引入结构化轨迹先验
机构 * University of Chinese Academy of Sciences(中国科学院大学) ; Technology and Engineering Center for Space Utilization, Chinese Academy of Sciences(中国科学院空间利用技术与工程中心)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 StepNav通过结构化多模态轨迹先验提升视觉导航的鲁棒性、效率和安全性。
Comments 8 pages, 7 figures; Accepted by ICRA 2026
USS-Nav: 一体化空间语义场景图用于轻量级无人机零样本物体导航
机构 * School of Aeronautic Science and Engineering, Beihang University, Beijing 100191, China(北京航空航天大学航空科学与工程学院) ; State Key Laboratory of Industrial Control Technology, Zhejiang University, Hangzhou 310027, China(浙江大学工业控制技术状态重点实验室) ; Differential Robotics, Hangzhou 311121, China(杭州差分机器人)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 USS-Nav通过构建一体化空间语义场景图,实现轻量级无人机在未知环境中的高效零样本物体导航,提升计算效率和实时更新能力。
通过误差最小化重新映射和导航嵌入空间:认知在自然和人工系统中的基本组织原则
机构 * Allen Discovery Center at Tufts University(塔夫茨大学阿伦发现中心) ; Wyss Institute for Biologically Inspired Engineering at Harvard University(哈佛大学生物启发工程研究所)
专题命中 具身导航 :navigation(title,abstract);分类 cs.AI
AI总结 通过误差最小化重新映射和导航嵌入空间,揭示认知在自然和人工系统中的基本组织原则。
Comments 41 pages, 5 figures
代理利益相关者方法用于包容性导航的需求工程
专题命中 具身导航 :navigation(title,abstract)
AI总结 本文提出代理利益相关者方法,用于设计更包容的导航技术,以满足认知障碍者的需求。
IMAGINE: 基于 Godot 的智能多智能体室内网络探索
机构 * Institute for Systems and Robotics(系统研究所)
专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.LG
AI总结 本文提出基于Godot的多智能体强化学习方法,用于解决室内未知环境中的自主协作探索问题,通过高保真模拟和课程学习提升训练效率与鲁棒性。
Comments 12 pages, submitted to a journal
在未知环境中安全控制的共形可达性
机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校)
专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI
AI总结 本文提出了一种结合共形预测与可达性分析的概率验证框架,用于在未知环境中实现安全控制,通过优化奖励和规划范围,实现强安全保证。
零样本大视觉语言模型提示法用于古放射学x光档案中骨骼自动识别
专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV
AI总结 利用大视觉语言模型实现古放射学x光图像中骨骼自动识别,提升内容导航效率。
LEVIO:轻量级嵌入式视觉惯性里程计用于资源受限设备
机构 * Integrated Systems Laboratory and the Center for Project-Based Learning, ETH Zurich(集成系统实验室和项目导向学习中心,苏黎世联邦理工学院) ; Center for Project-Based Learning, ETH Zurich(项目导向学习中心,苏黎世联邦理工学院) ; Department of Electrical, Electronic and Information Engineering, University of Bologna(电子、电气与信息工程系,博洛尼亚大学)
专题命中 具身导航 :robotics(abstract);分类 cs.RO、cs.CV
AI总结 LEVIO是一种为资源受限设备优化的轻量级视觉惯性里程计,通过高效架构和硬件软件协同优化,在低功耗平台上实现高精度的六自由度实时感知。
Comments This article has been accepted for publication in the IEEE Sensors Journal (JSEN)
Journal ref IEEE Sensors Journal ( Volume: 26, Issue: 3, 01 February 2026)
OptiPMB:通过优化的泊松多伯努利滤波增强3D多目标跟踪
机构 * School of Electronic Information Engineering, Beihang University(电子信息工程学院,北京航空航天大学) ; School of Automation and Intelligent Sensing, Shanghai Jiaotong University(自动化与智能感知学院,上海交通大学) ; Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(计算机科学与工程系,香港科技大学) ; College of Science and Engineering, James Cook University(科学与工程学院,詹姆斯库克大学) ; School of Artificial Intelligence and Computer Science, Nantong University(人工智能与计算机科学学院,南通大学) ; Faculty of Data Science, City University of Macau(数据科学学院,澳门城市大学) ; Research Laboratory of Smart Driving and Intelligent Transportation Systems, Southeast University(智能驾驶与智能交通系统研究实验室,东南大学)
专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV
AI总结 OptiPMB通过优化的泊松多伯努利滤波器和创新设计提升3D多目标跟踪的准确性与性能
全栈代理:通过面向开发的测试和仓库反翻译增强全栈网页编码
机构 * Multimedia Laboratory (MMLab), The Chinese University of Hong Kong(香港中文大学多媒体实验室) ; Shenzhen Loop Area Institute(深圳河套学院)
专题命中 具身导航 :navigation(abstract);分类 cs.CV
AI总结 FullStack-Agent通过面向开发的测试和仓库反翻译提升全栈网页编码能力,其多代理框架和自我改进方法在多个测试用例中表现出色。
基于场景图的开放集合语义映射方法
专题命中 具身导航 :robotic(abstract);分类 cs.RO
AI总结 本文提出基于场景图的开放集合语义映射方法,通过实时更新三维语义场景图,实现大规模环境中的稳定、可验证的映射结构,提升感知与高层推理的一致性与效率。
基于接触运动学分析导数的碰撞检测
机构 * Department of Mechanical and Nuclear Engineering, Khalifa University of Science and Technology(卡利法大学科学与技术学院机械与核工程系) ; Khalifa University Center for Autonomous Robotic Systems (KUCARS)(卡利法大学自主机器人系统中心) ; The BioRobotics Institute, Scuola Superiore Sant’Anna(圣安娜高等学院生物机器人研究所) ; Department of Excellence in Robotics and AI, Scuola Superiore Sant’Anna(圣安娜高等学院机器人与人工智能卓越部门) ; LS2N Laboratory, Institut Mines Telecom Atlantique(Atlantique电信学院LS2N实验室)
专题命中 具身导航 :robotics(abstract);分类 cs.RO
AI总结 iDCOL通过几何正则化和隐式可微框架实现鲁棒的碰撞检测与接触运动学计算,适用于路径规划和接触物理模拟。
Comments 12 pages, 9 figures, 2 tables
SATORIS-N:基于谱分析的交通密度观测恢复 via 有信息子空间和核范数最小化
机构 * Thomas Lord Department of Computer Science University of Southern California Los Angeles, USA(托马斯·劳德计算机科学系 美国南加州大学 洛杉矶)
专题命中 具身导航 :navigation(abstract);分类 cs.LG
AI总结 SATORIS-N通过利用子空间信息和核范数最小化,有效恢复部分缺失的交通密度数据,提升高遮挡情况下的准确性。
RPL:在复杂地形上学习鲁棒的人形感知移动
专题命中 具身导航 :manipulation(abstract);分类 cs.RO
AI总结 RPL通过两阶段训练框架在复杂地形上实现稳健的多方向人形移动,结合深度蒸馏和增强技术,提升机器人负载下的移动能力。
映射未知:利用基础模型的动态标签统一提示式全景映射
机构 * 1 Applied AI Institute, Moscow 121205 , Russia ; (R.S.) 2 School of Computer Science, University of Lincoln, Lincoln LN6 7TS , UK 3 Independent Researcher, Dubai 500001, United Arab Emirates
专题命中 具身导航 :分类 cs.RO、cs.AI、cs.CV;robotics(journal_ref)
AI总结 UPPM通过基础模型引入动态描述符,实现开放式词汇与统一结构的协调,提升全景地图的几何和语义准确性。
Journal ref Robotics, vol. 15, no. 2, article 31, 2026
无遮挡的符合性透镜用于3D城市分析中的时空可视化
专题命中 具身导航 :navigation(abstract)
AI总结 本研究提出了一种无遮挡的符合性透镜可视化方法,用于3D城市分析中的时空数据展示,通过切口去遮挡技术和符合映射算法提升时间-空间关联效率。
Comments Accepted at IEEE VR 2026
闭环:通用仓库表示法与RPG-编码器
专题命中 具身导航 :navigation(abstract)
AI总结 RPG-Encoder通过统一表示和闭环推理,实现复杂代码库的高精度理解和生成。
飞行员及其他星链Ku波段下行链路中的可预测元素
专题命中 具身导航 :navigation(abstract)
AI总结 研究通过利用星链Ku波段下行链路中的可预测元素,实现低成本接收机的高精度时间到达估计。
大语言模型赋能的可视化交互现状
专题命中 具身导航 :navigation(abstract)
AI总结 本文系统回顾了大语言模型与可视化交互的研究现状,分析了6个维度的48篇论文,突出了新兴设计模式和评估挑战,旨在指导未来LLM增强的可视化研究和系统设计。
Comments Submitted to STARs of EuroVis'26