arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 14074 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 14074 篇

2509.13666 2026-02-11 cs.RO cs.AI 62%

DREAM: Domain-aware Reasoning for Efficient Autonomous Underwater Monitoring

DREAM:面向高效自主水下监测的领域感知方法

Zhenqi Wu, Abhinav Modi, Angelos Mavrogiannis, Kaustubh Joshi, Nikhil Chopra, Yiannis Aloimonos, Nare Karapetyan, Ioannis Rekleitis, Xiaomin Lin

机构 * Electrical Engineering, University of South Florida(佛罗里达州立大学电气工程系) Maryland Robotics Center (MRC), University of Maryland(马里兰大学机器人中心) Woods Hole Oceanographic Institution (WHOI)(伍兹霍尔海洋研究所) Mechanical Engineering, University of Delaware(德雷克塞尔大学机械工程系)

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 DREAM通过视觉语言模型引导的自主框架,实现了高效、低耗的水下长期监测,显著提升了目标物体探测效率与覆盖范围。

Comments In Proceeding of ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07227 2026-02-10 cs.LG cs.RO 62%

Cerebellar-Inspired Residual Control for Fault Recovery: From Inference-Time Adaptation to Structural Consolidation

小脑启发的残差控制用于故障恢复:从推理时间适应到结构巩固

Nethmi Jayasinghe, Diana Gontero, Spencer T. Brown, Vinod K. Sangwan, Mark C. Hersam, Amit Ranjan Trivedi

机构 * University of Illinois at Chicago(伊利诺伊大学芝加哥分校) Northwestern University(西北大学)

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.LG

AI总结 该研究提出了一种小脑启发的残差控制框架,通过在线纠正动作实现故障恢复,提升机器人在训练后扰动下的鲁棒性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05789 2026-02-06 cs.CV cs.AI 62%

Allocentric Perceiver: Disentangling Allocentric Reasoning from Egocentric Visual Priors via Frame Instantiation

非自体参照感知器:通过帧实例化解耦非自体参照推理与自体参照视觉先验

Hengyi Wang, Ruiqiang Zhang, Chang Liu, Guanjie Wang, Zehua Ma, Han Fang, Weiming Zhang

机构 * Anhui Province Key Laboratory of Digital Security, University of Science(安徽数字安全重点实验室,科学大学) National University of Singapore(新加坡国立大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 非自体参照感知器通过帧实例化解耦非自体参照推理与自体参照视觉先验,提升空间推理任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04975 2026-02-06 cs.LG cs.AI physics.chem-ph physics.plasm-ph 62%

Stochastic hierarchical data-driven optimization: application to plasma-surface kinetics

随机分层数据驱动优化:应用于等离子体-表面动力学

José Afonso, Vasco Guerra, Pedro Viegas

机构 * Instituto de Plasmas e Fusão Nuclear(等离子体与核聚变研究所) Instituto Superior Técnico(技术高等学院)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种随机分层数据驱动优化方法,用于高效校准物理模型,特别是在等离子体-表面相互作用中的应用,通过减少的Hessian近似和概率公式提升样本效率。

Comments 19 pages and 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04517 2026-02-05 cs.CV cs.RO 62%

S-MUSt3R: Sliding Multi-view 3D Reconstruction

S-MUSt3R:滑动多视角三维重建

Leonid Antsfeld, Boris Chidlovskii, Yohann Cabon, Vincent Leroy, Jerome Revaud

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 S-MUSt3R通过序列分割和轻量级优化实现高效单目三维重建,利用MUSt3R模型在大规模RGB流中实现高精度重建。

Comments 8 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00771 2026-02-05 cs.CV cs.AI 62%

EAG3R: Event-Augmented 3D Geometry Estimation for Dynamic and Extreme-Lighting Scenes

EAG3R:事件增强的3D几何估计用于动态和极端光照场景

Xiaoshan Wu, Yifei Yu, Xiaoyang Lyu, Yihua Huang, Bo Wang, Baoheng Zhang, Zhongrui Wang, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) Southern University of Science and Technology(南方科技大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 EAG3R通过引入事件流和改进的损失函数,提升了动态低光照环境下3D几何估计的鲁棒性。

Comments Accepted at NeurIPS 2025 (spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03799 2026-02-04 cs.RO cs.AI 62%

Conformal Reachability for Safe Control in Unknown Environments

在未知环境中安全控制的共形可达性

Xinhang Ma, Junlin Wu, Yiannis Kantaros, Yevgeniy Vorobeychik

机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种结合共形预测与可达性分析的概率验证框架,用于在未知环境中实现安全控制,通过优化奖励和规划范围,实现强安全保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03750 2026-02-04 cs.CV cs.AI 62%

Zero-shot large vision-language model prompting for automated bone identification in paleoradiology x-ray archives

零样本大视觉语言模型提示法用于古放射学x光档案中骨骼自动识别

Owen Dong, Lily Gao, Manish Kota, Bennett A. Landmana, Jelena Bekvalac, Gaynor Western, Katherine D. Van Schaik

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 利用大视觉语言模型实现古放射学x光图像中骨骼自动识别,提升内容导航效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03294 2026-02-04 cs.CV cs.RO eess.IV 62%

LEVIO: Lightweight Embedded Visual Inertial Odometry for Resource-Constrained Devices

LEVIO:轻量级嵌入式视觉惯性里程计用于资源受限设备

Jonas Kühne, Christian Vogt, Michele Magno, Luca Benini

机构 * Integrated Systems Laboratory and the Center for Project-Based Learning, ETH Zurich(集成系统实验室和项目导向学习中心,苏黎世联邦理工学院) Center for Project-Based Learning, ETH Zurich(项目导向学习中心,苏黎世联邦理工学院) Department of Electrical, Electronic and Information Engineering, University of Bologna(电子、电气与信息工程系,博洛尼亚大学)

专题命中 具身导航 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 LEVIO是一种为资源受限设备优化的轻量级视觉惯性里程计,通过高效架构和硬件软件协同优化,在低功耗平台上实现高精度的六自由度实时感知。

Comments This article has been accepted for publication in the IEEE Sensors Journal (JSEN)

Journal ref IEEE Sensors Journal ( Volume: 26, Issue: 3, 01 February 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12968 2026-02-04 cs.CV cs.RO 62%

OptiPMB: Enhancing 3D Multi-Object Tracking with Optimized Poisson Multi-Bernoulli Filtering

OptiPMB:通过优化的泊松多伯努利滤波增强3D多目标跟踪

Guanhua Ding, Yuxuan Xia, Runwei Guan, Qinchen Wu, Tao Huang, Weiping Ding, Jinping Sun, Guoqiang Mao

机构 * School of Electronic Information Engineering, Beihang University(电子信息工程学院,北京航空航天大学) School of Automation and Intelligent Sensing, Shanghai Jiaotong University(自动化与智能感知学院,上海交通大学) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(计算机科学与工程系,香港科技大学) College of Science and Engineering, James Cook University(科学与工程学院,詹姆斯库克大学) School of Artificial Intelligence and Computer Science, Nantong University(人工智能与计算机科学学院,南通大学) Faculty of Data Science, City University of Macau(数据科学学院,澳门城市大学) Research Laboratory of Smart Driving and Intelligent Transportation Systems, Southeast University(智能驾驶与智能交通系统研究实验室,东南大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 OptiPMB通过优化的泊松多伯努利滤波器和创新设计提升3D多目标跟踪的准确性与性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02481 2026-02-03 cs.RO cs.AI 62%

Flow Policy Gradients for Robot Control

用于机器人控制的流匹配策略梯度

Brent Yi, Hongsuk Choi, Himanshu Gaurav Singh, Xiaoyu Huang, Takara E. Truong, Carmelo Sferrazza, Yi Ma, Rocky Duan, Pieter Abbeel, Guanya Shi, Karen Liu, Angjoo Kanazawa

机构 * Amazon FAR(亚马逊Far) UC Berkeley(加州大学伯克利分校) Stanford(斯坦福大学) HKU(香港大学) CMU(卡内基梅隆大学)

专题命中 具身导航 :manipulation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种基于流匹配的策略梯度方法,用于训练更复杂的机器人控制策略,实现了在四肢运动、人形运动跟踪和操作任务中的成功,并展示了在仿真到现实迁移中的鲁棒性。

Comments Project webpage: https://hongsukchoi.github.io/fpo-control

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00709 2026-02-03 cs.AI cs.LG 62%

Physics-informed Diffusion Generation for Geomagnetic Map Interpolation

基于物理的扩散生成用于地磁图插值

Wenda Li, Tongya Zheng, Kaixuan Chen, Shunyu Liu, Haoze Jiang, Yunzhi Hao, Rui Miao, Zujie Ren, Mingli Song, Hang Shi, Gang Chen

机构 * State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室) High-Performance Intelligent Computing Research Center for Ultra-Large Scale Graph Data(超大规模图数据高性能智能计算研究中心) School of Computer and Computing Science(计算机与计算科学学院) Hangzhou City University(杭州市大学) Zhejiang Lab(浙江实验室)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于物理的扩散生成框架PDG,通过物理引导的掩码策略和约束,提升地磁图插值的精度与可靠性。

Comments 5 pages, 2 figures, IEEE ICASSP'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22545 2026-02-02 cs.RO cs.AI 62%

Adapting Reinforcement Learning for Path Planning in Constrained Parking Scenarios

在受限停车场景中适应强化学习用于路径规划

Feng Tao, Luca Paparusso, Chenyi Gu, Robin Koehler, Chenxu Wu, Xinyu Huang, Christian Juette, David Paz, Ren Liu

机构 * Bosch Research(博世研究)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本研究提出了一种深度强化学习框架,用于在受限停车场景中实现高效的实时路径规划,通过序列决策问题建模和新基准的开发,实现了更高的成功率和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02492 2026-01-30 cs.RO cs.AI 62%

Industrial Internet Robot Collaboration System and Edge Computing Optimization

工业互联网机器人协作系统与边缘计算优化

Haopeng Zhao, Dajun Tao, Tian Qi, Jingyuan Xu, Zijie Zhou, Lipeng Liu

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出一种基于边缘计算的工业机器人协作系统,通过三层神经网络和模拟退火算法优化全局路径规划,提升机器人在随机环境下的导航鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14587 2026-01-30 cs.CV cs.RO 62%

Visual Localization via Semantic Structures in Autonomous Photovoltaic Power Plant Inspection

通过语义结构实现自主光伏电站巡检的定位

Viktor Kozák, Karel Košnar, Jan Chudoba, Miroslav Kulich, Libor Přeučil

机构 * Czech Institute of Informatics, Robotics, and Cybernetics, Czech Technical University in Prague(捷克信息学、机器人学和自动化研究院,捷克技术大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出了一种通过语义结构实现光伏电站巡检自动定位的方法,结合模块检测与导航,提升实时定位精度与鲁棒性。

Comments 50 pages, 23 figures. Submitted for review to Array

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19707 2026-01-28 cs.LG cs.RO 62%

Scalable Exploration for High-Dimensional Continuous Control via Value-Guided Flow

通过价值引导流实现高维连续控制的可扩展探索

Yunyue Wei, Chenhui Zuo, Yanan Sui

机构 * Tsinghua University(清华大学)

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.LG

AI总结 Qflex通过价值引导流在高维动作空间中实现高效探索,优于现有方法并在复杂控制任务中表现出色。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17383 2026-01-27 cs.CV cs.AI 62%

Physical Prompt Injection Attacks on Large Vision-Language Models

针对大视觉-语言模型的物理提示注入攻击

Chen Ling, Kai Hu, Hangcheng Liu, Xingshuo Han, Tianwei Zhang, Changhai Ou

机构 * School of Cyber Science and Engineering, Wuhan University(武汉大学计算机科学与工程学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) College of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(南京航空航天大学计算机科学与技术学院)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 本研究提出了一种无需访问模型或输入的物理提示注入攻击方法,通过物理物体注入恶意指令,成功攻击多种大视觉-语言模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02328 2026-01-27 cs.RO cs.LG 62%

Path Planning using a One-shot-sampling Skeleton Map

基于一次性采样骨架图的路径规划

Gabriel O. Flores-Aquino, Octavio Gutierrez-Frias, Juan Irving Vasquez

机构 * Centro de Investigación en Matematicas (CIMAT), A.C.(数学研究所(CIMAT)) Unidad Profesional Interdisciplinaria en Ingeniería y Tecnologías Avanzadas (UPIITA), Instituto Politécnico Nacional (IPN)(跨学科工程与先进技术单位(UPIITA),墨西哥理工学院(IPN)) Centro de Innovación y Desarrollo Tecnológico en Cómputo (CIDETEC), Instituto Politécnico Nacional (IPN)(计算创新与技术发展中心(CIDETEC),墨西哥理工学院(IPN))

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.LG

AI总结 本文提出基于SkelUnet的高效路径规划方法,通过一次性采样骨架图快速生成安全路径,提升导航效率和安全性。

Comments Submitted to IEEE Latin America Transactions

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13170 2026-01-27 cs.CV cs.AI 62%

Unified-EGformer: Exposure Guided Lightweight Transformer for Mixed-Exposure Image Enhancement

统一曝光引导轻量变换器:用于混合曝光图像增强

Eashan Adhikarla, Kai Zhang, Rosaura G. VidalMata, Manjushree Aithal, Nikhil Ambha Madhusudhana, John Nicholson, Lichao Sun, Brian D. Davison

机构 * Lehigh University(莱维大学) Lenovo Research(联想研究)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 Unified-EGformer通过轻量级变换器架构实现混合曝光图像增强,具备高效推理和跨任务泛化能力。

Comments Under submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15025 2026-01-22 cs.RO cs.CV 62%

ExPrIS: Knowledge-Level Expectations as Priors for Object Interpretation from Sensor Data

ExPrIS:基于知识层面期望的物体解释先验知识

Marian Renz, Martin Günther, Felix Igelbrink, Oscar Lima, Martin Atzmueller

机构 * German Research Center for Artificial Intelligence(德国人工智能研究中心) Osnabrück University(奥斯纳布吕克大学)

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 ExPrIS通过整合知识层面的期望与异构图神经网络,提升机器人从传感器数据中对物体的解释能力,增强场景理解的鲁棒性和一致性。

Comments This preprint has not undergone peer review or any post-submission improvements or corrections. The Version of Record of this article is published in KI - Künstliche Intelligenz, and is available online at https://doi.org/10.1007/s13218-026-00901-7

Journal ref Künstl Intell (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13541 2026-01-21 cs.RO cs.CV 62%

PERSEUS: Perception with Semantic Endoscopic Understanding and SLAM

PERSEUS:具有语义内窥镜理解和SLAM的感知

Ayberk Acar, Fangjie Li, Susheela Sharma Stern, Lidia Al-Zogbi, Hao Li, Kanyifeechukwu Jane Oguine, Dilara Isik, Brendan Burkhart, Jesse F. d'Almeida, Robert J. Webster, Ipek Oguz, Jie Ying Wu

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 PERSEUS提出了一种结合语义分割与实时单目SLAM的感知管道,用于自然开口手术,实现高精度的场景理解和手术指导。

Comments 13 pages, 6 figures, 2 tables. Under review for The 17th International Conference on Information Processing in Computer-Assisted Interventions (IPCAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11617 2026-01-21 cs.CV cs.GR cs.RO 62%

PointSLAM++: Robust Dense Neural Gaussian Point Cloud-based SLAM

PointSLAM++: 基于密集神经高斯点云的鲁棒SLAM

Xu Wang, Boyao Han, Xiaojun Chen, Ying Liu, Ruihui Li

专题命中 具身导航 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 PointSLAM++通过分层约束神经高斯表示和动态神经图实现高精度三维重建与逼真渲染,优于现有SLAM方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18177 2026-01-21 cs.CV cs.LG cs.MA 62%

Scene-Aware Vectorized Memory Multi-Agent Framework with Cross-Modal Differentiated Quantization VLMs for Visually Impaired Assistance

具有跨模态差异化量化功能的场景感知向量内存多智能体框架用于视障辅助

Xiangxiang Wang, Xuanyu Wang, YiJia Luo, Yongbin Yu, Manping Fan, Jingtao Zhang, Liyong Ren

机构 * School of Information Software Engineering, University of Electronic Science Sichuan Provincial Key Laboratory for Human Disease Gene Study, Sichuan Academy of Medical Sciences \& Sichuan Provincial People's Hospital, University of Electronic Science Faculty of Computing, Harbin Institute of Technology, Harbin, China

专题命中 具身导航 :navigation(abstract);分类 cs.CV、cs.LG

AI总结 本文提出了一种具有跨模态差异化量化的多智能体框架,通过减少内存消耗和提升处理效率,为视障人士提供更高效的环境感知与辅助导航支持。

Comments 28 pages,9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09578 2026-01-15 cs.RO cs.CV 62%

Multimodal Signal Processing For Thermo-Visible-Lidar Fusion In Real-time 3D Semantic Mapping

多模态信号处理用于热-可见-激光雷达融合的实时3D语义制图

Jiajun Sun, Yangyi Ou, Haoyuan Zheng, Chao yang, Yue Ma

机构 * College of Mechatronics and Control Engineering, Shenzhen University(深圳大学机械与控制工程学院) School of Robotics, Xi’an-Jiaotong Liverpool University(西安交通大学利物浦大学机器人学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出通过多模态信号处理融合热、可见和激光雷达数据,提升实时3D语义制图的精度与语义理解能力,适用于灾害评估和工业维护等场景。

Comments 5 pages,7 figures. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08185 2026-01-14 cond-mat.mtrl-sci cs.AI cs.LG cs.MA physics.comp-ph 62%

Autonomous Materials Exploration by Integrating Automated Phase Identification and AI-Assisted Human Reasoning

通过整合自动化相识别和AI辅助的人类推理实现自主材料探索

Ming-Chiang Chang, Maximilian Amsler, Duncan R. Sutherland, Sebastian Ament, Katie R. Gann, Lan Zhou, Louisa M. Smieska, Arthur R. Woll, John M. Gregoire, Carla P. Gomes, R. Bruce van Dover, Michael O. Thompson

机构 * Department of Materials Science and Engineering, Cornell University, Ithaca, NY 14853, United States(材料科学与工程系,康奈尔大学,Ithaca, NY 14853, United States) Department of Computer Science, Cornell University, Ithaca, NY 14853, United States(计算机科学系,康奈尔大学,Ithaca, NY 14853, United States) Joint Center for Artificial Photosynthesis, California Institute of Technology, Pasadena, CA 91125(人工光合作研究中心,加州理工学院,Pasadena, CA 91125) Cornell High Energy Synchrotron Source, Cornell University, Ithaca, NY 14850, United States(康奈尔高能同步辐射源,康奈尔大学,Ithaca, NY 14850, United States)

专题命中 具身导航 :robotic(abstract);分类 cs.AI、cs.LG

AI总结 通过整合自动化相识别和AI辅助的人类推理,实现自主材料探索,提升材料合成效率和发现新材料的能力。

Comments Main manuscript: 21 pages(including references), 6 figures. Supplementary Information: 12 pages, 9 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07718 2026-01-13 cs.RO cs.AI 62%

Hiking in the Wild: A Scalable Perceptive Parkour Framework for Humanoids

野外徒步:一种可扩展的感知跳跃框架用于人形机器人

Shaoting Zhu, Ziwen Zhuang, Mengjie Zhao, Kun-Ying Lee, Hang Zhao

机构 * IIIS, Tsinghua University(清华大学人工智能研究院) Shanghai Qi Zhi Institute(上海启智研究院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种可扩展的感知跳跃框架,通过结合地形边缘检测和脚部体积点,实现人形机器人在复杂地形中的稳健徒步。

Comments Project Page: https://project-instinct.github.io/hiking-in-the-wild

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06285 2026-01-13 cs.CV cs.RO 62%

NAS-GS: Noise-Aware Sonar Gaussian Splatting

NAS-GS: 噪声感知的声纳高斯点云技术

Shida Xu, Jingqi Jiang, Jonatan Scharff Willners, Sen Wang

机构 * I-X and Department of Electrical and Electronic Engineering, Imperial College London, UK(I-X 和 电气与电子工程系,帝国理工学院伦敦分校) Frontier Robotics, The National Robotarium, Edinburgh UK(前沿机器人技术,国家机器人中心,爱丁堡)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 NAS-GS通过双向点云技术和高斯混合噪声模型,提升声纳图像的3D重建和新视角合成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06137 2026-01-13 cs.LG cs.AI 62%

RainBalance: Alleviating Dual Imbalance in GNSS-based Precipitation Nowcasting via Continuous Probability Modeling

RainBalance: 通过连续概率建模缓解GNSS基降水nowcasting中的双重不平衡

Yifang Zhang, Shengwu Xiong, Henan Wang, Wenjie Yin, Jiawang Peng, Duan Zhou, Yuqiang Zhang, Chen Zhou, Hua Chen, Qile Zhao, Pengfei Duan

机构 * Sanya Science and Education Innovation Park, Wuhan University of Technology(武汉理工大学三亚科技创新园) Wuhan University of Technology(武汉理工大学) School of Computer Science and Artificial Intelligence, Wuhan University of Technology(武汉理工大学计算机科学与人工智能学院) School of Earth and Space Science and Technology, Wuhan University(武汉大学地球空间科学与技术学院) Wuhan University(武汉大学) School of Water Resources and Hydropower Engineering, Wuhan University(武汉大学水利水电工程学院) GNSS Research Center, Wuhan University(武汉大学GNSS研究中心)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 RainBalance通过连续概率建模缓解GNSS基降水nowcasting中的双重不平衡问题,提升模型性能。

Comments 11pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11618 2026-01-13 cs.AI cs.LG eess.SP 62%

Benchmarking Spatiotemporal Reasoning in LLMs and Reasoning Models: Capabilities and Challenges

在大语言模型和推理模型中评估时空推理:能力和挑战

Pengrui Quan, Brian Wang, Kang Yang, Liying Han, Mani Srivastava

机构 * Department of Electrical and Computer Engineering, UCLA(电气与计算机工程系,加州大学洛杉矶分校)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出STARK基准测试,评估大语言模型和推理模型在时空推理任务中的能力和挑战,发现推理模型在复杂任务中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02382 2026-01-07 cs.NI cs.AI cs.IR cs.LG 62%

How to Discover Knowledge for FutureG: Contextual RAG and LLM Prompting for O-RAN

如何为未来G发现知识:面向O-RAN的上下文RAG和LLM提示

Nathan Conger, Nathan Scollar, Kemal Davaslioglu, Yalin E. Sagduyu, Sastry Kompella

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出上下文RAG方法,通过引导文档检索和上下文增强LLM性能,提升ORAN领域问答的准确性和效率,同时保持低运行时间和碳排放。

详情

展开后加载摘要…

URL PDF HTML 收藏