arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-02-04 至 2026-02-04 共收录 23 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 23 篇

2507.01667 2026-02-04 cs.CV cs.RO 84%

What does really matter in image goal navigation?

图像目标导航中真正重要的什么?

Gianluca Monaci, Philippe Weinzaepfel, Christian Wolf

机构 * NAVER LABS Europe(NAVER欧洲实验室)

专题命中 具身导航 :navigation(title,abstract);embodied AI(abstract);分类 cs.RO、cs.CV

AI总结 本文研究图像目标导航中通过端到端强化学习训练智能体的可行性,并探讨了建筑选择对相对位姿估计器产生和导航性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03153 2026-02-04 cs.RO 83%

When Attention Betrays: Erasing Backdoor Attacks in Robotic Policies by Reconstructing Visual Tokens

当注意力背叛时:通过重建视觉标记在机器人策略中消除后门攻击

Xuetao Li, Pinhan Fu, Wenke Huang, Nengyuan Pan, Songhua Yang, Kaiyan Zhao, Guancheng Wan, Mengde Li, Jifeng Xuan, Miao Li

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) Faculty of Artificial Intelligence, Hubei University(湖北大学人工智能学院) Institute of Technological Sciences, Wuhan University(武汉大学技术科学研究院) School of Robotics, Wuhan University(武汉大学机器人学院)

专题命中 具身导航 :robotic(title,abstract);robotics(abstract);分类 cs.RO

AI总结 Bera通过重建视觉标记消除机器人策略中的后门攻击,无需重新训练模型即可有效防御后门风险。

Comments ICRA2026 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07868 2026-02-04 cs.RO 79%

VISTA: Generative Visual Imagination for Vision-and-Language Navigation

VISTA: 生成式视觉想象用于视觉-语言导航

Yanjia Huang, Mingyang Wu, Renjie Li, Zhengzhong Tu

机构 * Department of Computer Science and Engineering, Texas A&M University(计算机科学与工程系,德克萨斯大学阿姆斯特朗分校)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 VISTA通过生成式视觉想象与感知对齐策略,提升长距离视觉-语言导航任务的性能。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02915 2026-02-04 cs.RO 79%

Modular Isoperimetric Soft Robotic Truss for Lunar Applications

模块化等周性软机器人桁架用于月球应用

Mihai Stanciu, Isaac Weaver, Adam Rose, James Wade, Kaden Paxton, Chris Paul, Spencer Stowell, Nathan Usevitch

机构 * Ira A. Fulton School of Engineering, Mechanical Engineering Department, Brigham Young University(伊拉·A·福尔顿工程学院,机械工程系, Brigham Young 大学)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO

AI总结 该研究提出了一种模块化等周性软机器人桁架,用于月球应用,通过可重新配置的结构实现高效太阳能阵列和移动设备。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02590 2026-02-04 cs.RO 79%

StepNav: Structured Trajectory Priors for Efficient and Multimodal Visual Navigation

StepNav: 为高效且多模态视觉导航引入结构化轨迹先验

Xubo Luo, Aodi Wu, Haodong Han, Xue Wan, Wei Zhang, Leizheng Shu, Ruisuo Wang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Technology and Engineering Center for Space Utilization, Chinese Academy of Sciences(中国科学院空间利用技术与工程中心)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 StepNav通过结构化多模态轨迹先验提升视觉导航的鲁棒性、效率和安全性。

Comments 8 pages, 7 figures; Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00708 2026-02-04 cs.RO 79%

USS-Nav: Unified Spatio-Semantic Scene Graph for Lightweight UAV Zero-Shot Object Navigation

USS-Nav: 一体化空间语义场景图用于轻量级无人机零样本物体导航

Weiqi Gai, Yuman Gao, Yuan Zhou, Yufan Xie, Zhiyang Liu, Yuze Wu, Xin Zhou, Fei Gao, Zhijun Meng

机构 * School of Aeronautic Science and Engineering, Beihang University, Beijing 100191, China(北京航空航天大学航空科学与工程学院) State Key Laboratory of Industrial Control Technology, Zhejiang University, Hangzhou 310027, China(浙江大学工业控制技术状态重点实验室) Differential Robotics, Hangzhou 311121, China(杭州差分机器人)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 USS-Nav通过构建一体化空间语义场景图,实现轻量级无人机在未知环境中的高效零样本物体导航,提升计算效率和实时更新能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14096 2026-02-04 cs.AI 79%

Remapping and navigation of an embedding space via error minimization: a fundamental organizational principle of cognition in natural and artificial systems

通过误差最小化重新映射和导航嵌入空间:认知在自然和人工系统中的基本组织原则

Benedikt Hartl, Léo Pio-Lopez, Chris Fields, Michael Levin

机构 * Allen Discovery Center at Tufts University(塔夫茨大学阿伦发现中心) Wyss Institute for Biologically Inspired Engineering at Harvard University(哈佛大学生物启发工程研究所)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 通过误差最小化重新映射和导航嵌入空间,揭示认知在自然和人工系统中的基本组织原则。

Comments 41 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02869 2026-02-04 cs.SE 78%

A Proxy Stakeholder Approach to Requirements Engineering for Inclusive Navigation

代理利益相关者方法用于包容性导航的需求工程

Wei Wang, Anuradha Madugalla, John Grundy, Paul McIntosh, Charmine E. J. Härtel

专题命中 具身导航 :navigation(title,abstract)

AI总结 本文提出代理利益相关者方法,用于设计更包容的导航技术,以满足认知障碍者的需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02858 2026-02-04 cs.RO cs.LG cs.MA cs.NI cs.SY eess.SY 73%

IMAGINE: Intelligent Multi-Agent Godot-based Indoor Networked Exploration

IMAGINE: 基于 Godot 的智能多智能体室内网络探索

Tiago Leite, Maria Conceição, António Grilo

机构 * Institute for Systems and Robotics(系统研究所)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 本文提出基于Godot的多智能体强化学习方法,用于解决室内未知环境中的自主协作探索问题,通过高保真模拟和课程学习提升训练效率与鲁棒性。

Comments 12 pages, submitted to a journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03799 2026-02-04 cs.RO cs.AI 62%

Conformal Reachability for Safe Control in Unknown Environments

在未知环境中安全控制的共形可达性

Xinhang Ma, Junlin Wu, Yiannis Kantaros, Yevgeniy Vorobeychik

机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种结合共形预测与可达性分析的概率验证框架,用于在未知环境中实现安全控制,通过优化奖励和规划范围,实现强安全保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03750 2026-02-04 cs.CV cs.AI 62%

Zero-shot large vision-language model prompting for automated bone identification in paleoradiology x-ray archives

零样本大视觉语言模型提示法用于古放射学x光档案中骨骼自动识别

Owen Dong, Lily Gao, Manish Kota, Bennett A. Landmana, Jelena Bekvalac, Gaynor Western, Katherine D. Van Schaik

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 利用大视觉语言模型实现古放射学x光图像中骨骼自动识别,提升内容导航效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03294 2026-02-04 cs.CV cs.RO eess.IV 62%

LEVIO: Lightweight Embedded Visual Inertial Odometry for Resource-Constrained Devices

LEVIO:轻量级嵌入式视觉惯性里程计用于资源受限设备

Jonas Kühne, Christian Vogt, Michele Magno, Luca Benini

机构 * Integrated Systems Laboratory and the Center for Project-Based Learning, ETH Zurich(集成系统实验室和项目导向学习中心,苏黎世联邦理工学院) Center for Project-Based Learning, ETH Zurich(项目导向学习中心,苏黎世联邦理工学院) Department of Electrical, Electronic and Information Engineering, University of Bologna(电子、电气与信息工程系,博洛尼亚大学)

专题命中 具身导航 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 LEVIO是一种为资源受限设备优化的轻量级视觉惯性里程计,通过高效架构和硬件软件协同优化,在低功耗平台上实现高精度的六自由度实时感知。

Comments This article has been accepted for publication in the IEEE Sensors Journal (JSEN)

Journal ref IEEE Sensors Journal ( Volume: 26, Issue: 3, 01 February 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12968 2026-02-04 cs.CV cs.RO 62%

OptiPMB: Enhancing 3D Multi-Object Tracking with Optimized Poisson Multi-Bernoulli Filtering

OptiPMB:通过优化的泊松多伯努利滤波增强3D多目标跟踪

Guanhua Ding, Yuxuan Xia, Runwei Guan, Qinchen Wu, Tao Huang, Weiping Ding, Jinping Sun, Guoqiang Mao

机构 * School of Electronic Information Engineering, Beihang University(电子信息工程学院,北京航空航天大学) School of Automation and Intelligent Sensing, Shanghai Jiaotong University(自动化与智能感知学院,上海交通大学) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(计算机科学与工程系,香港科技大学) College of Science and Engineering, James Cook University(科学与工程学院,詹姆斯库克大学) School of Artificial Intelligence and Computer Science, Nantong University(人工智能与计算机科学学院,南通大学) Faculty of Data Science, City University of Macau(数据科学学院,澳门城市大学) Research Laboratory of Smart Driving and Intelligent Transportation Systems, Southeast University(智能驾驶与智能交通系统研究实验室,东南大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 OptiPMB通过优化的泊松多伯努利滤波器和创新设计提升3D多目标跟踪的准确性与性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03798 2026-02-04 cs.SE cs.CL cs.CV 57%

FullStack-Agent: Enhancing Agentic Full-Stack Web Coding via Development-Oriented Testing and Repository Back-Translation

全栈代理:通过面向开发的测试和仓库反翻译增强全栈网页编码

Zimu Lu, Houxing Ren, Yunqiao Yang, Ke Wang, Zhuofan Zong, Mingjie Zhan, Hongsheng Li

机构 * Multimedia Laboratory (MMLab), The Chinese University of Hong Kong(香港中文大学多媒体实验室) Shenzhen Loop Area Institute(深圳河套学院)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 FullStack-Agent通过面向开发的测试和仓库反翻译提升全栈网页编码能力,其多代理框架和自我改进方法在多个测试用例中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03781 2026-02-04 cs.RO 57%

A Scene Graph Backed Approach to Open Set Semantic Mapping

基于场景图的开放集合语义映射方法

Martin Günther, Felix Igelbrink, Oscar Lima, Lennart Niecksch, Marian Renz, Martin Atzmueller

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 本文提出基于场景图的开放集合语义映射方法,通过实时更新三维语义场景图,实现大规模环境中的稳定、可验证的映射结构,提升感知与高层推理的一致性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03250 2026-02-04 cs.RO 57%

Collision Detection with Analytical Derivatives of Contact Kinematics

基于接触运动学分析导数的碰撞检测

Anup Teejo Mathew, Anees Peringal, Daniele Caradonna, Frederic Boyer, Federico Renda

机构 * Department of Mechanical and Nuclear Engineering, Khalifa University of Science and Technology(卡利法大学科学与技术学院机械与核工程系) Khalifa University Center for Autonomous Robotic Systems (KUCARS)(卡利法大学自主机器人系统中心) The BioRobotics Institute, Scuola Superiore Sant’Anna(圣安娜高等学院生物机器人研究所) Department of Excellence in Robotics and AI, Scuola Superiore Sant’Anna(圣安娜高等学院机器人与人工智能卓越部门) LS2N Laboratory, Institut Mines Telecom Atlantique(Atlantique电信学院LS2N实验室)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 iDCOL通过几何正则化和隐式可微框架实现鲁棒的碰撞检测与接触运动学计算,适用于路径规划和接触物理模拟。

Comments 12 pages, 9 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03138 2026-02-04 cs.LG 57%

SATORIS-N: Spectral Analysis based Traffic Observation Recovery via Informed Subspaces and Nuclear-norm minimization

SATORIS-N:基于谱分析的交通密度观测恢复 via 有信息子空间和核范数最小化

Sampad Mohanty, Bhaskar Krishnamachari

机构 * Thomas Lord Department of Computer Science University of Southern California Los Angeles, USA(托马斯·劳德计算机科学系 美国南加州大学 洛杉矶)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 SATORIS-N通过利用子空间信息和核范数最小化,有效恢复部分缺失的交通密度数据,提升高遮挡情况下的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03002 2026-02-04 cs.RO 57%

RPL: Learning Robust Humanoid Perceptive Locomotion on Challenging Terrains

RPL:在复杂地形上学习鲁棒的人形感知移动

Yuanhang Zhang, Younggyo Seo, Juyue Chen, Yifu Yuan, Koushil Sreenath, Pieter Abbeel, Carmelo Sferrazza, Karen Liu, Rocky Duan, Guanya Shi

专题命中 具身导航 :manipulation(abstract);分类 cs.RO

AI总结 RPL通过两阶段训练框架在复杂地形上实现稳健的多方向人形移动,结合深度蒸馏和增强技术,提升机器人负载下的移动能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02162 2026-02-04 cs.CV cs.AI cs.RO 56%

Mapping the Unseen: Unified Promptable Panoptic Mapping with Dynamic Labeling using Foundation Models

映射未知:利用基础模型的动态标签统一提示式全景映射

Mohamad Al Mdfaa, Raghad Salameh, Geesara Kulathunga, Sergey Zagoruyko, Gonzalo Ferrer

机构 * 1 Applied AI Institute, Moscow 121205 , Russia (R.S.) 2 School of Computer Science, University of Lincoln, Lincoln LN6 7TS , UK 3 Independent Researcher, Dubai 500001, United Arab Emirates

专题命中 具身导航 :分类 cs.RO、cs.AI、cs.CV;robotics(journal_ref)

AI总结 UPPM通过基础模型引入动态描述符,实现开放式词汇与统一结构的协调,提升全景地图的几何和语义准确性。

Journal ref Robotics, vol. 15, no. 2, article 31, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03743 2026-02-04 cs.HC cs.GR 50%

Occlusion-Free Conformal Lensing for Spatiotemporal Visualization in 3D Urban Analytics

无遮挡的符合性透镜用于3D城市分析中的时空可视化

Roberta Mota, Julio D. Silva, Fabio Miranda, Usman Alim, Ehud Sharlin, Nivan Ferreira

专题命中 具身导航 :navigation(abstract)

AI总结 本研究提出了一种无遮挡的符合性透镜可视化方法,用于3D城市分析中的时空数据展示,通过切口去遮挡技术和符合映射算法提升时间-空间关联效率。

Comments Accepted at IEEE VR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02084 2026-02-04 cs.CL cs.SE 50%

Closing the Loop: Universal Repository Representation with RPG-Encoder

闭环:通用仓库表示法与RPG-编码器

Jane Luo, Chengyu Yin, Xin Zhang, Qingtao Li, Steven Liu, Yiming Huang, Jie Wu, Hao Liu, Yangyu Huang, Yu Kang, Fangkai Yang, Ying Xin, Scarlett Li

专题命中 具身导航 :navigation(abstract)

AI总结 RPG-Encoder通过统一表示和闭环推理,实现复杂代码库的高精度理解和生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02627 2026-02-04 eess.SP 50%

Pilots and Other Predictable Elements of the Starlink Ku-Band Downlink

飞行员及其他星链Ku波段下行链路中的可预测元素

Wenkai Qin, Mark L. Psiaki, John R. Bowman, Todd E. Humphreys

专题命中 具身导航 :navigation(abstract)

AI总结 研究通过利用星链Ku波段下行链路中的可预测元素,实现低成本接收机的高精度时间到达估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14943 2026-02-04 cs.HC 50%

State of the Art of LLM-Enabled Interaction with Visualization

大语言模型赋能的可视化交互现状

Mathis Brossier, Tobias Isenberg, Konrad Schönborn, Jonas Unger, Mario Romero, Johanna Björklund, Anders Ynnerman, Lonni Besançon

专题命中 具身导航 :navigation(abstract)

AI总结 本文系统回顾了大语言模型与可视化交互的研究现状,分析了6个维度的48篇论文,突出了新兴设计模式和评估挑战,旨在指导未来LLM增强的可视化研究和系统设计。

Comments Submitted to STARs of EuroVis'26

详情

展开后加载摘要…

URL PDF HTML 收藏