arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 14074 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 14074 篇

2604.01723 2026-04-03 cs.RO cs.AI 62%

Causal Scene Narration with Runtime Safety Supervision for Vision-Language-Action Driving

基于运行时安全监督的因果场景叙述用于视觉-语言-动作驾驶

Yun Li, Yidu Zhang, Simon Thompson, Ehsan Javanmardi, Manabu Tsukada

机构 * Graduate School of Information Science and Technology, The University of Tokyo(东京大学信息科学与技术研究生院) TIER IV, Inc.(TIER IV 公司)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出CSN方法,通过意图约束对齐、定量 grounding 和结构分离重构VLA文本输入,提升驾驶评分并增强安全性。

Comments 18 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00363 2026-04-02 cs.RO cs.CV 62%

A Dual-Stream Transformer Architecture for Illumination-Invariant TIR-LiDAR Person Tracking

一种用于光照不变TIR-LiDAR人体跟踪的双流Transformer架构

Yuki Minase, Kanji Tanaka

机构 * Graduate School of Engineering, University of Fukui(福井大学工学研究科)

专题命中 具身导航 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 本文提出一种双流Transformer架构,利用LiDAR和TIR摄像头实现全天候鲁棒的人体跟踪,通过知识迁移策略提升性能,实验显示在AO和SR指标上优于传统方法。

Comments 6 pages, 4 figures, technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00036 2026-04-02 q-bio.NC cs.AI cs.LG cs.NE physics.bio-ph 62%

When and Where: A Model Hippocampal Network Unifies Formation of Time Cells and Place Cells

何时与何地:一种海马网络模型统一了时间细胞和位置细胞的形成

Qiaorong S. Yu, Zhaoze Wang, Vijay Balasubramanian

机构 * New York University(纽约大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种海马网络模型,通过动态机制统一了时间细胞和位置细胞的形成,揭示了两者共享的起源与任务驱动的差异。

Comments 18 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25686 2026-03-27 cs.CV cs.AI 62%

Just Zoom In: Cross-View Geo-Localization via Autoregressive Zooming

只需放大:通过自回归放大进行跨视角地理定位

Yunus Talha Erzurumlu, Jiyong Kwag, Alper Yilmaz

机构 * Photogrammetric Computer Vision Lab, The Ohio State University(俄亥俄州立大学摄影测量与计算机视觉实验室)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出一种基于自回归放大的方法,用于跨视角地理定位,通过城市级俯视地图进行粗到细的空间推理,提升了定位精度。

Comments 18 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10461 2026-03-27 cs.LG cs.AI math.OC 62%

T-SKM-Net: Trainable Neural Network Framework for Linear Constraint Satisfaction via Sampling Kaczmarz-Motzkin Method

T-SKM-Net:基于采样Kaczmarz-Motzkin方法的可训练神经网络框架用于线性约束满足

Haoyu Zhu, Yao Zhang, Jiashen Ren, Qingchun Hou

专题命中 具身导航 :robotic(abstract);分类 cs.AI、cs.LG

AI总结 本文提出T-SKM-Net框架,通过将混合约束问题转化为纯不等式问题,并结合采样Kaczmarz-Motzkin方法进行迭代求解,实现神经网络在约束满足中的高效处理,同时保证了端到端的可训练性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24908 2026-03-27 cs.RO cs.AI cs.MA 62%

Integrated Multi-Drone Task Allocation, Sequencing, and Optimal Trajectory Generation in Obstacle-Rich 3D Environments

集成多无人机任务分配、任务序列和最优轨迹生成在障碍密集的3D环境中

Yunes Alqudsi, Murat Makaraci

机构 * Aerospace Engineering Department, Faculty of Aeronautics and Astronautics, Kocaeli University(科贾埃利大学航空与航天学院航空航天工程系) Interdisciplinary Research Center for Aviation and Space Exploration, KFUPM(法赫德国王石油矿产大学航空与空间探索跨学科研究中心) Mechanical Engineering Department, Faculty of Aeronautics and Astronautics, Kocaeli University(科贾埃利大学航空与航天学院机械工程系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出IMD-TAPP框架,通过结合离散任务规划和连续轨迹合成,解决多无人机在障碍密集环境中的任务分配、序列规划和安全轨迹生成问题,实现动态可行且无碰撞的高效路径。

Comments Resubmission following accepted appeal (MOD-78958). Resubmitting to cs.RO with cross-lists cs.MA and cs.AI as advised by arXiv Support

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04607 2026-03-26 cs.OS cs.AI cs.LG 62%

From Imperative to Declarative: Towards LLM-friendly OS Interfaces for Boosted Computer-Use Agents

从命令式到声明式:面向提升计算机使用代理的LLM友好操作系统接口

Yuan Wang, Mingyu Li, Haibo Chen

机构 * Key Laboratory of System Software (Chinese Academy of Sciences)(中国科学院系统软件重点实验室) Institute of Software Chinese Academy of Sciences(中国科学院软件研究所) Shanghai Jiao Tong University(上海交通大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Declarative Model Interface (DMI),通过将传统GUI转化为三种声明式原语,提升LLM驱动的计算机使用代理的任务成功率和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22583 2026-03-25 cs.CV cs.RO 62%

A vision-language model and platform for temporally mapping surgery from video

一种用于手术时间映射的视觉-语言模型和平台

Dani Kiyasseh

机构 * Halsted AI

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出Halsted模型,基于Halsted手术图谱实现手术行为映射,提供更全面且高效的解决方案,并开发Halsted平台使外科医生能自动映射自身手术。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22312 2026-03-25 cs.AI cs.CL cs.LG 62%

The Efficiency Attenuation Phenomenon: A Computational Challenge to the Language of Thought Hypothesis

思维效率衰减现象:对思维语言假说的计算挑战

Di Zhang

机构 * School of Advanced Technology(先进技术学院)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文通过计算实验探讨思维是否需要语言式格式,提出AI私有语言假想实验,证明在多智能体强化学习中,高效协议在被迫使用人类可理解语言时效率下降,挑战了思维语言假说。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21987 2026-03-24 cs.CV cs.AI 62%

LRC-WeatherNet: LiDAR, RADAR, and Camera Fusion Network for Real-time Weather-type Classification in Autonomous Driving

LRC-WeatherNet:用于自动驾驶中实时天气类型分类的激光雷达、雷达和摄像头融合网络

Nour Alhuda Albashir, Lars Pernickel, Danial Hamoud, Idriss Gouigah, Eren Erdal Aksoy

机构 * Halmstad University, School of Information Technology, Center for Applied Intelligent Systems Research(哈姆斯塔德大学,信息科技学院,应用智能系统研究中心)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出LRC-WeatherNet,通过融合激光雷达、雷达和摄像头数据,实现在恶劣天气下的实时天气分类,优于单一传感器基线,且在MSU-4S数据集上表现优异。

Comments Accepted for publication at IEEE Intelligent Vehicles Symposium - IVS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21565 2026-03-24 cs.CV cs.AI 62%

Rethinking SAR ATR: A Target-Aware Frequency-Spatial Enhancement Framework with Noise-Resilient Knowledge Guidance

重新思考SAR ATR:一种具有噪声鲁棒知识引导的靶向频率-空间增强框架

Yansong Lin, Zihan Cheng, Jielei Wang, Guoming Lua, Zongyong Cui

机构 * the Institute of Intelligent Computing, University of Electronic Science and Technology of China (UESTC)(智能计算研究院,电子科技大学) Ubiquitous Intelligence and Trusted Services Key Laboratory of Sichuan Province(四川省 ubiquitous 智能与可信服务重点实验室) the School of Information and Communication Engineering, University of Electronic Science and Technology of China (UESTC)(信息与通信工程学院,电子科技大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出FSCE框架,通过频率-空间浅特征自适应增强模块和教师-学生学习范式提升SAR目标识别的鲁棒性,实验表明DSAFNet-L在多个数据集上表现优异,DSAFNet-M在保持精度的同时降低模型复杂度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19474 2026-03-23 cs.LG cs.AI 62%

TRACE: Trajectory Recovery with State Propagation Diffusion for Urban Mobility

轨迹恢复:基于状态传播扩散的轨迹恢复用于城市移动

Jinming Wang, Hai Wang, Hongkai Wen, Geyong Min, Man Luo

机构 * University of Exeter Department of Computer Science(埃克塞特大学计算机科学系) University of Warwick Department of Computer Science(沃里克大学计算机科学系)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出TRACE模型,通过状态传播扩散机制从稀疏不完整输入中恢复密集连续轨迹,提升城市移动应用的数据质量与公平性。

Comments This article is accepted by WWW 2026, Dubai, United Arab Emirates

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16214 2026-03-23 cs.RO cs.AI 62%

Adaptive Relative Pose Estimation Framework with Dual Noise Tuning for Safe Approaching Maneuvers

具有双噪声调节的自适应相对位姿估计框架用于安全接近 maneuver

Batu Candan, Murat Berke Oktay, Simone Servadio

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出一种结合先进计算机视觉与自适应非线性滤波的框架,用于提升主动清轨任务中对非规则卫星的相对位姿估计精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19137 2026-03-20 cs.CV cs.RO 62%

GSMem: 3D Gaussian Splatting as Persistent Spatial Memory for Zero-Shot Embodied Exploration and Reasoning

GSMem: 3D高斯溅射作为持久空间记忆用于零样本具身探索与推理

Yiren Lu, Yi Du, Disheng Liu, Yunlai Zhou, Chen Wang, Yu Yin

机构 * Case Western Reserve University(凯斯西储大学) Spatial AI & Robotics (SAIR) Lab, University at Buffalo(布法罗大学空间人工智能与机器人实验室)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出GSMem框架,利用3D高斯溅射构建持久空间记忆,解决具身探索中空间知识遗忘问题,通过检索机制与混合探索策略提升视觉语言模型推理效果。

Comments Project page at https://vulab-ai.github.io/GSMem/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10651 2026-03-20 cs.RO cs.AI 62%

Interleaving Scheduling and Motion Planning with Incremental Learning of Symbolic Space-Time Motion Abstractions

交织调度与运动规划的增量学习符号时空运动抽象

Elisa Tosello, Arthur Bit-Monnot, Davide Lusuardi, Alessandro Valentini, Andrea Micheli

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出一种交织调度与运动规划的增量学习框架,用于多物体共享空间的调度与运动规划,通过符号时空运动抽象提升复杂时空约束下的执行效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18447 2026-03-20 cs.DB cs.AI cs.CL cs.CV cs.IR 62%

SODIUM: From Open Web Data to Queryable Databases

SODIUM:从开放网络数据到可查询数据库

Chuxuan Hu, Philip Li, Maxwell Yang, Daniel Kang

机构 * UIUC(伊利诺伊大学香槟分校)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 研究针对需要整合多源网络数据的分析问题,提出SODIUM任务,通过系统化构建潜在数据库支持查询。开发SODIUM-Agent系统,采用ATP-BFS算法实现深度网络探索与结构化信息提取,准确率达91.1%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18218 2026-03-20 cs.CV cs.RO 62%

Semantic Segmentation and Depth Estimation for Real-Time Lunar Surface Mapping Using 3D Gaussian Splatting

基于3D高斯溅射的实时月球表面制图中的语义分割与深度估计

Guillem Casadesus Vila, Adam Dai, Grace Gao

机构 * Department of Aeronautics and Astronautics(航空航天系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出一种实时制图框架,结合密集感知模型与3D高斯溅射表示,在挑战性环境下实现高精度月球表面制图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17948 2026-03-19 cs.CV cs.AI 62%

VideoAtlas: Navigating Long-Form Video in Logarithmic Compute

VideoAtlas: 在对数计算中导航长视频

Mohamed Eltahir, Ali Habibullah, Yazan Alshoibi, Lama Ayash, Tanveer Hussain, Naeemullah Khan

机构 * King Abdullah University of Science and Technology (KAUST)(卡斯特大学) Department of Computer Science, King Khalid University (KKU)(国王 Khalid 大学计算机科学系) Department of Computer Science, Edge Hill University(Edge Hill 大学计算机科学系)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 VideoAtlas通过层次化网格结构实现长视频的无损表示,解决视频表示和长上下文问题,提出Video-RLM架构,展示对数计算增长、环境预算和自适应计算分配等贡献。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11903 2026-03-19 cs.RO cs.CV 62%

Aion: Towards Hierarchical 4D Scene Graphs with Temporal Flow Dynamics

Aion:面向具有时间流动态的分层4D场景图

Iacopo Catalano, Eduardo Montijano, Javier Civera, Julio A. Placed, Jorge Pena-Queralta

机构 * University of Turku(图尔库大学) Centre for Artificial Intelligence, Zürich University of Applied Sciences(应用科学大学人工智能中心) Instituto Tecnológico de Aragón (ITA) and the University of Zaragoza(阿兰理工大学和萨拉戈萨大学) University of Zaragoza(萨拉戈萨大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 Aion通过在分层3D场景图中嵌入时间流动态,提升动态环境中导航规划和交互的可解释性和可扩展性。

Comments Accepted at ICRA 2026, 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22057 2026-03-19 cs.CV cs.AI 62%

Unsupervised Decomposition and Recombination with Discriminator-Driven Diffusion Models

无监督分解与重组:基于判别器驱动的扩散模型

Archer Wang, Emile Anand, Yilun Du, Marin Soljačić

机构 * Research Laboratory of Electronics, MIT, Cambridge, MA 02139, USA(MIT电子研究实验室) Department of Physics, Massachusetts Institute of Technology, MIT, Cambridge, MA, USA(麻省理工学院物理系) NSF AI Institute for Artificial Intelligence(国家科学基金会人工智能与基本相互作用研究所) Kempner Institute, Harvard University, Cambridge, MA, USA(哈佛大学 Kempner 院) Google DeepMind, Mountain View, CA, USA(Google DeepMind) School of Computer Science, Georgia Institute of Technology, Atlanta, USA(佐治亚理工学院计算机科学系)

专题命中 具身导航 :robotic(abstract);分类 cs.AI、cs.CV

AI总结 本文提出基于判别器驱动的扩散模型,用于无监督分解和重组数据,通过对抗训练提升潜在因子发现和生成质量,实验显示在多个数据集上优于基线方法,且在机器人视频轨迹中实现新应用。

Comments 28 pages, 16 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14998 2026-03-17 cs.CV cs.RO 62%

Thermal Image Refinement with Depth Estimation using Recurrent Networks for Monocular ORB-SLAM3

利用循环网络进行热成像细化的单目ORB-SLAM3深度估计

Hürkan Şahin, Huy Xuan Pham, Van Huyen Dang, Alper Yegenoglu, Erdal Kayacan

机构 * Automatic Control Group (RAT), Paderborn University(自动控制组(RAT),波恩大学) Department of Electrical and Computer Engineering, Aarhus University(电气与计算机工程系,阿arhus大学) Upteko ApS(Upteko公司)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出利用轻量级监督网络和循环块进行热成像细化,以提升无人机在低光环境下的实时深度估计和SLAM性能,实验表明其在非辐射热数据集上具有更高的精度和鲁棒性。

Comments 8 pages, 8 figures, 2 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14739 2026-03-17 cs.CV cs.AI 62%

TrajMamba: An Ego-Motion-Guided Mamba Model for Pedestrian Trajectory Prediction from an Egocentric Perspective

TrajMamba:一种基于自身运动的Mamba模型,用于从第一人称视角预测行人轨迹

Yusheng Peng, Gaofeng Zhang, Liping Zheng

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出基于Mamba模型的TrajMamba模型,通过提取行人和自身运动特征,结合自身运动引导解码器预测未来轨迹,实现在自动驾驶和机器人导航中的高性能表现。

Comments Accept by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12244 2026-03-17 cs.LG cs.AI 62%

Separable neural architectures as a primitive for unified predictive and generative intelligence

可分离神经架构作为统一预测与生成智能的原始构件

Reza T. Batley, Apurba Sarker, Rajib Mostakim, Andrew Klichine, Sourav Saha

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出可分离神经架构(SNA),通过约束交互阶数和张量秩,将高维映射分解为低 arity 组件,揭示了混沌时空动态与语言自回归的结构类比,并在多个领域展示了其统一预测与生成智能的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02289 2026-03-17 cs.RO cs.LG cs.MA 62%

Federated Multi-Agent Mapping for Planetary Exploration

联邦多智能体制图用于行星探索

Tiberiu-Ioan Szatmari, Abhishek Cauligi

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.LG

AI总结 本文提出一种联邦多智能体制图方法,通过隐式神经制图生成高效适应性表示,减少数据传输达93.8%,并利用元初始化加速地图收敛,实现火星地形和冰川数据集的高路径规划F1分数。

Comments 7 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13298 2026-03-17 cs.LG cs.AI 62%

FusionCast: Enhancing Precipitation Nowcasting with Asymmetric Cross-Modal Fusion and Future Radar Priors

FusionCast: 通过不对称跨模态融合和未来雷达先验增强降水现在预报

Henan Wang, Shengwu Xiong, Yifang Zhang, Wenjie Yin, Chen Zhou, Yuqiang Zhang, Pengfei Duan

机构 * School of Computer Science and Artificial Intelligence, Wuhan University of Technology(武汉理工大学计算机科学与人工智能学院) School of Earth and Space Science and Technology, Wuhan University(武汉大学地球和空间科学与技术学院)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出FusionCast框架,结合历史雷达QPE、PWV数据和预测雷达QPE,通过不对称融合和未来先验提升降水现在预报精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08420 2026-03-13 cs.RO cs.AI cs.HC 62%

Human-Aware Robot Behaviour in Self-Driving Labs

具有人类意识的自主驾驶实验室中的机器人行为

Satheeshkumar Veeramani, Anna Kisil, Abigail Bentley, Hatem Fakhruldeen, Gabriella Pizzuto, Andrew I. Cooper

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种基于AI的具身感知方法,通过预测人类意图实现自主驾驶实验室中机器人与人类的主动交互,提升实验室自动化流程的效率和协调性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08150 2026-03-10 cs.CV cs.RO 62%

Edged USLAM: Edge-Aware Event-Based SLAM with Learning-Based Depth Priors

边缘化USLAM:基于事件的边缘感知SLAM与学习深度先验

Şebnem Sarıözkan, Hürkan Şahin, Olaya Álvarez-Tuñón, Erdal Kayacan

机构 * Automatic Control Group (RAT), Paderborn University(自动控制组(RAT),帕德博恩大学) EIVA A/S(EIVA公司) IT University of Copenhagen (ITU)(丹麦技术大学(ITU))

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 Edged USLAM通过边缘感知前端和轻量级深度模块,结合事件相机和惯性传感器,实现稳健的视觉-惯性SLAM,适用于复杂光照和动态环境下的空中导航任务。

Comments 8 pages, 7 figures, 3 tables. Accepted to ICRA 2026. Project code and datasets available at https://github.com/sebnem-byte/Edged-USLAM

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07973 2026-03-10 cs.RO cs.AI 62%

VORL-EXPLORE: A Hybrid Learning Planning Approach to Multi-Robot Exploration in Dynamic Environments

VORL-EXPLORE: 多机器人在动态环境中的混合学习规划方法

Ning Liu, Sen Shen, Zheng Li, Sheng Liu, Dongkun Han, Shangke Lyu, Thomas Braunl

机构 * The University of Western Australia(西澳大学) The Chinese University of Hong Kong(香港中文大学) Karlsruhe Institute of Technology(卡尔斯鲁厄大学) Nanjing University(南京大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 VORL-EXPLORE通过混合学习和规划方法,解决多机器人在动态环境中探索时的执行保真度问题,提升路径效率与安全交互。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07351 2026-03-10 cs.RO cs.LG stat.ML 62%

A Distributed Gaussian Process Model for Multi-Robot Mapping

多机器人制图的分布式高斯过程模型

Seth Nabarro, Mark van der Wilk, Andrew J. Davison

机构 * Dyson Robotics Lab, Imperial College London(帝京大学伦敦分校戴森机器人实验室) Department of Computer Science, University of Oxford(牛津大学计算机科学系)

专题命中 具身导航 :robot learning(abstract);分类 cs.RO、cs.LG

AI总结 DistGP通过分布式高斯过程实现多机器人协同制图,优于现有方法并在动态环境下表现更优。

Comments ICRA 2026, 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18606 2026-03-10 cs.RO cs.CV 62%

OVerSeeC: Open-Vocabulary Costmap Generation from Satellite Images and Natural Language

OVerSeeC: 从卫星图像和自然语言生成开放词汇成本图

Rwik Rana, Jesse Quattrociocchi, Dongmyeong Lee, Christian Ellis, Amanda Adkins, Adam Uccello, Garrett Warnell, Joydeep Biswas

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) DEVCOM Army Research Laboratory(陆军研究实验室)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 OVerSeeC通过模块化基础模型实现从卫星图像和自然语言生成开放词汇成本图,支持任务自适应的全球规划。

Comments Website : https://amrl.cs.utexas.edu/overseec/

详情

展开后加载摘要…

URL PDF HTML 收藏