arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 8673 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 8673 篇

2601.03055 2026-01-07 cs.RO 57%

A Fast Semidefinite Convex Relaxation for Optimal Control Problems With Spatio-Temporal Constraints

一种快速的半正定凸松弛方法用于具有时空约束的最优控制问题

Shiying Dong, Zhipeng Shen, Rudolf Reiter, Hailong Huang, Bingzhao Gao, Hong Chen, Wen-Hua Chen

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 本文提出了一种快速半正定凸松弛方法,用于解决具有时空约束的最优控制问题,通过时间缩放直接多重射击方案和稀疏模式利用,提升计算效率与解的最优性。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10449 2026-01-07 cs.AI cs.CL cs.CR 57%

When Reject Turns into Accept: Quantifying the Vulnerability of LLM-Based Scientific Reviewers to Indirect Prompt Injection

当拒绝转为接受:量化基于LLM的科学评审员对间接提示注入的脆弱性

Devanshu Sahoo, Manish Prasad, Vasudev Majhi, Jahnvi Singh, Vinay Chamola, Yash Sinha, Murari Mandal, Dhruv Kumar

机构 * BITS Pilani KIIT University(KIIT大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 本研究量化了基于LLM的科学评审系统对间接提示注入攻击的脆弱性,揭示了通过隐藏文本注入和布局感知攻击翻转评审决定的风险,并提出WAVS指标评估此类攻击的严重性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13759 2026-01-07 cs.CV 57%

Geolocation with Real Human Gameplay Data: A Large-Scale Dataset and Human-Like Reasoning Framework

基于真实人类游戏数据的定位:一个大规模数据集和类人推理框架

Zirui Song, Jingpu Yang, Yuan Huang, Jonathan Tonglet, Zeyu Zhang, Tao Cheng, Meng Fang, Iryna Gurevych, Xiuying Chen

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 本文提出GeoComp大规模数据集和GeoCoT类人推理框架,通过多步骤推理提升定位任务的准确性和可解释性。

Comments Update new version

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02020 2026-01-06 cs.CV 57%

Adapting Depth Anything to Adverse Imaging Conditions with Events

在恶劣成像条件下适应Depth Anything以应对事件

Shihan Peng, Yuyang Xiong, Hanyu Zhou, Zhiwei Shi, Haoyue Liu, Gang Chen, Luxin Yan, Yi Chang

机构 * National Key Lab of Multispectral Information Intelligent Processing Technology, School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(multispectral information intelligent processing technology 国家重点实验室,人工智能与自动化学院,华中科技大学) School of Computing, National University of Singapore(computing 学院,新加坡国立大学) School of Computer Science and Engineering, Sun Yat-Sen University(computer science and engineering 学院,中山大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 本文提出ADAE框架,通过熵感知空间融合和运动引导时间校正,提升Depth Anything在恶劣成像条件下的深度估计性能。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01676 2026-01-06 cs.CV 57%

LabelAny3D: Label Any Object 3D in the Wild

LabelAny3D: 在真实世界中标注任意物体的3D

Jin Yao, Radowan Mahmud Redoy, Sebastian Elbaum, Matthew B. Dwyer, Zezhou Cheng

机构 * University of Virginia(弗吉尼亚大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 LabelAny3D通过分析-合成框架生成高质量3D标注,提升单目3D检测性能,推动真实世界3D识别发展。

Comments NeurIPS 2025. Project page: https://uva-computer-vision-lab.github.io/LabelAny3D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00562 2026-01-05 cs.CV 57%

A Cascaded Information Interaction Network for Precise Image Segmentation

用于精确图像分割的级联信息交互网络

Hewen Xiao, Jie Mei, Guangfu Ma, Weiren Wu

机构 * The Institute of Space Science and Applied Technology(空间科学与应用技术研究所) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 本文提出一种级联信息交互网络,通过融合低级纹理与高级语义特征提升图像分割精度,尤其在复杂环境中的表现优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00421 2026-01-05 cs.AI 57%

Can Semantic Methods Enhance Team Sports Tactics? A Methodology for Football with Broader Applications

语义方法能否提升团队体育战术?一种适用于足球的通用方法

Alessio Di Rubbo, Mattia Neri, Remo Pareschi, Marco Pedroni, Roberto Valtancoli, Paolino Zica

机构 * Stake Lab, University of Molise, Italy(斯泰克实验室,莫利塞大学,意大利) Bioretics, Bologna, Italy(生物反应公司,博洛尼亚,意大利) Institute for Generative Strategy, Ferrara, Italy(生成战略研究所,费拉拉,意大利) Cesena Femminile Football Club, Cesena, Italy(塞斯纳女子足球俱乐部,塞斯纳,意大利) Zica Sport, Benevento, Italy(齐卡体育,贝内文托,意大利)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI

AI总结 本文提出了一种基于语义空间推理的团队体育战术决策方法,通过多维向量表示球员属性并评估战术契合度,为足球及其他团队领域提供通用决策框架。

Comments Submitted to Sci (MDPI) for peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00352 2026-01-05 cs.CV 57%

OmniVaT: Single Domain Generalization for Multimodal Visual-Tactile Learning

OmniVaT:单域泛化用于多模态视觉-触觉学习

Liuxiang Qiu, Hui Da, Yuzhen Niu, Tiesong Zhao, Yang Cao, Zheng-Jun Zha

机构 * Fujian Key Laboratory for Intelligent Processing and Wireless Transmission of Media Information(福建智能媒体信息处理与无线传输重点实验室) College of Physics and Information Engineering(物理与信息工程学院) Fuzhou University(福州市大学) College of Computer and Data Science(计算机与数据科学学院) MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition(MoE脑启发智能感知与认知重点实验室) University of Science and Technology of China(中国科学技术大学)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.CV

AI总结 OmniVaT通过多模态分数傅里叶适配器和离散树生成模块,首次实现单域泛化多模态视觉-触觉学习任务,提升跨领域适应性与泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00303 2026-01-05 cs.CL cs.AI 57%

DepFlow: Disentangled Speech Generation to Mitigate Semantic Bias in Depression Detection

DepFlow:解耦语音生成以缓解抑郁检测中的语义偏差

Yuxin Li, Xiangyu Zhang, Yifei Li, Zhiwei Guo, Haoyang Zhang, Eng Siong Chng, Cuntai Guan

机构 * College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院) School of Electrical Engineering and Telecommunications, UNSW(新南威尔士大学电信工程学院) School of Software and Microelectronics, Peking University(北京大学软件与微电子学院) Center for AI in Medicine (C-AIM), Lee Kong Chian School of Medicine, NTU(人工智能医学中心(C-AIM)、李光耀医学院、南洋理工大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 DepFlow通过三阶段框架解耦语音生成,缓解抑郁症检测中的语义偏差,提升模型鲁棒性并提供可控合成平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23400 2026-01-05 cs.SI cs.LG 57%

Quantum Intelligence Meets BD-RIS-Enabled AmBC: Challenges, Opportunities, and Practical Insights

量子智能遇见BD-RIS赋能的AmBC:挑战、机遇与实用洞察

Abd Ullah Khan, Uman Khalid, Trung Q. Duong, Hyundong Shin

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.LG

AI总结 本文探讨了BD-RIS在AmBC中的应用,分析了其挑战与机遇,并通过量子增强的机器学习模型提升波束成形性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07955 2026-01-05 cs.RO 57%

PLK-Calib: Single-shot and Target-less LiDAR-Camera Extrinsic Calibration using Plücker Lines

PLK-Calib: 基于普吕弗线的单次拍摄无目标激光雷达-摄像头外参校准

Yanyu Zhang, Jie Xu, Wei Ren

机构 * Department of Electrical and Computer Engineering, University of California, Riverside(电气与计算机工程系,加州大学河滨分校)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出基于普吕弗线的单次拍摄无目标算法,用于高精度激光雷达-摄像头外参校准,通过几何特性分解旋转和平移,提升校准精度。

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), pp. 16091-16097, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24680 2026-01-01 cs.RO 57%

ReSPIRe: Informative and Reusable Belief Tree Search for Robot Probabilistic Search and Tracking in Unknown Environments

ReSPIRe: 信息性和可重用的信念树搜索用于未知环境中的机器人概率搜索与跟踪

Kangjie Zhou, Zhaoyang Li, Han Gao, Yao Su, Hangxin Liu, Junzhi Yu, Chang Liu

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 ReSPIRe通过分层粒子结构和可重用信念树搜索,在未知环境中实现高效且稳定的机器人目标搜索与跟踪。

Comments 17 pages, 12 figures, accepted to IEEE Transactions on Systems, Man, and Cybernetics: Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23135 2026-01-01 cs.RO 57%

Beyond URDF: The Universal Robot Description Directory for Shared, Extensible, and Standardized Robot Models

超越URDF:通用机器人描述目录用于共享、可扩展和标准化的机器人模型

Roshan Klein-Seetharaman, Daniel Rakita

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出URDD,一种模块化机器人描述目录,通过自动化生成和标准化,提升机器人模型的共享与扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07345 2026-01-01 cs.RO 57%

Reproducibility in the Control of Autonomous Mobility-on-Demand Systems

自动驾驶按需出行系统中的可重复性

Xinling Li, Meshal Alharbi, Daniele Gammelli, James Harrison, Filipe Rodrigues, Maximilian Schiffer, Marco Pavone, Emilio Frazzoli, Jinhua Zhao, Gioele Zardini

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文系统研究了自动驾驶按需出行系统中可重复性问题,提出评估和改进可重复性的结构化框架及具体指南。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20676 2026-01-01 cs.CV 57%

SciceVPR: Stable Cross-Image Correlation Enhanced Model for Visual Place Recognition

SciceVPR: 稳定跨图像相关性增强模型用于视觉位置识别

Shanshan Wan, Yingmei Wei, Lai Kang, Tianrui Shen, Haixuan Wang, Yee-Hong Yang

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 SciceVPR通过增强跨图像相关性,提升视觉位置识别的稳定性和性能,优于现有单阶段和两阶段方法。

Comments This work has been accepted by Neurocomputing. The final version can be accessed via https://www.sciencedirect.com/science/article/pii/S0925231225032114

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23431 2025-12-30 cs.RO cs.MA 57%

Optimal Scalability-Aware Allocation of Swarm Robots: From Linear to Retrograde Performance via Marginal Gains

蜂群机器人最优可扩展性感知分配:通过边际收益从线性到反向性能

Simay Atasoy Bingöl, Tobias Töpfer, Sven Kosub, Heiko Hamann, Andreagiovanni Reina

机构 * Department of Computer and Information Science, Universität Konstanz, Germany(康斯坦茨大学计算机与信息科学系) Centre for the Advanced Study of Collective Behaviour (CASCB), Universität Konstanz, Germany(康斯坦茨大学集体行为高级研究所以) Department of Collective Behaviour, Max Planck Institute of Animal Behavior, Konstanz, Germany(动物行为Max Planck研究所集体行为系)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.RO

AI总结 本文提出了一种基于边际收益的高效算法,用于优化蜂群机器人在不同可扩展性任务中的分配,以实现最大集体性能。

Comments 14 pages, 11 figures, Accepted for publication in IEEE Transactions on Systems, Man, and Cybernetics: Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23219 2025-12-30 cs.CV 57%

MM-UAVBench: How Well Do Multimodal Large Language Models See, Think, and Plan in Low-Altitude UAV Scenarios?

MM-UAVBench: 多模态大语言模型在低空无人机场景中的感知、推理与规划能力如何?

Shiqi Dai, Zizhi Ma, Zhicong Luo, Xuesong Yang, Yibin Huang, Wanyue Zhang, Chi Chen, Zonghao Guo, Wang Xu, Yufei Sun, Maosong Sun

机构 * Tsinghua University(清华大学) Nankai University(南开大学) Northwest Polytechnical University(西北工业大学) Chinese Academy of Sciences(中国科学院) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 MM-UAVBench通过系统评估多模态大语言模型在低空无人机场景中的感知、推理与规划能力,揭示其在复杂任务中的性能瓶颈与改进方向。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22819 2025-12-30 cs.CV 57%

Depth Anything in $360^\circ$: Towards Scale Invariance in the Wild

360度深度估计:迈向野外的尺度不变性

Hualie Jiang, Ziyang Song, Zhiqiang Lou, Rui Xu, Minglang Tan

机构 * Insta360 Research(Insta360研究院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 DA360通过学习ViT主干的位移参数,实现全景深度估计的尺度不变性,显著提升室内和户外深度估计性能。

Comments https://insta360-research-team.github.io/DA360

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05526 2025-12-30 cs.CV 57%

When Deepfake Detection Meets Graph Neural Network:a Unified and Lightweight Learning Framework

当深度伪造检测遇见图神经网络:一种统一且轻量级的学习框架

Haoyu Liu, Chaoyu Gong, Mengke He, Jiate Li, Kai Han, Siqiang Luo

机构 * Nanyang Technological University(南洋理工大学) University of Southern California(南加州大学) The University of Hong Kong(香港大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 本文提出SSTGNN,一种统一且轻量级的深度伪造检测框架,通过图神经网络联合处理空间、时间及频谱信息,实现高效且准确的伪造检测。

Comments Accepted to KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05822 2025-12-30 cs.CV 57%

Video Event Reasoning and Prediction by Fusing World Knowledge from LLMs with Vision Foundation Models

通过融合来自LLM的世界知识与视觉基础模型进行视频事件推理与预测

L'ea Dubois, Klaus Schmidt, Chengyu Wang, Ji-Hoon Park, Lin Wang, Santiago Munoz

机构 * INRIA(法国国家信息与自动化研究所) Max Planck Institute for Intelligent Systems(人工智能研究所) San Francisco State University(旧金山州立大学) Seoul AI Institute (SAII)(首尔人工智能研究所) Vision & Robotics Center, Tsinghua University(清华大学视觉与机器人中心) Polytechnic University of Madrid(马德里理工大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出融合视觉基础模型与LLM的世界知识,以提升视频事件推理与预测能力,实现从简单识别到高级认知理解的突破。

Comments 22 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14404 2025-12-30 cs.CV 57%

ViC-Bench: Benchmarking Visual-Interleaved Chain-of-Thought Capability in MLLMs with Free-Style Intermediate State Representations

ViC-Bench: 用自由式中间状态表示法对多模态大语言模型的视觉交错链式思维能力进行基准测试

Xuecheng Wu, Jiaxing Liu, Danlei Huang, Yifan Wang, Yunyun Shi, Kedi Chen, Junxiao Xue, Yang Liu, Chunlin Chen, Hairong Dong, Dingkang Yang

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) Meituan Inc.(美团公司) Institute of Advanced Technology, University of Science and Technology of China(中国科学技术大学先进技术研究院) School of Computer Science and Technology, East China Normal University(华东师范大学计算机科学与技术学院) Research Center for Space Computing System, Zhejiang Lab(浙江实验室空间计算系统研究中心) College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院) School of Robotics and Automation, Nanjing University(南京大学机器人与自动化学院) College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 ViC-Bench 通过自由式中间状态表示法,系统评估多模态大语言模型的视觉交错链式思维能力,涵盖四个任务并提出新评估指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22470 2025-12-30 cs.AI 57%

DarkPatterns-LLM: A Multi-Layer Benchmark for Detecting Manipulative and Harmful AI Behavior

DarkPatterns-LLM: 一种多层基准用于检测操纵性和有害的AI行为

Sadia Asif, Israel Antonio Rosales Laguan, Haris Khan, Shumaila Asif, Muneeb Asif

机构 * Rensselaer Polytechnic Institute(拉特格斯理工学院) National University of Sciences and Technology(国立科学与技术大学) School of Electrical Engineering & Computer Science(电子与计算机科学学院)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 DarkPatterns-LLM提出了一种多层基准用于检测LLM中的操纵性行为,通过细粒度分析和专家标注,评估七个危害类别下的内容,揭示模型在自主性检测方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07348 2025-12-30 cs.LG 57%

Zero-Shot Context Generalization in Reinforcement Learning from Few Training Contexts

在少量训练上下文中进行零样本上下文泛化于强化学习

James Chapman, Kedar Karhadkar, Guido Montufar

机构 * Department of Mathematics University of California, Los Angeles(数学系加州大学洛杉矶分校)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.LG

AI总结 本文提出上下文增强的贝尔曼方程(CEBE)和上下文样本增强(CSE)方法,以提升在少量训练上下文中强化学习的泛化能力。

Comments 10 pages, 8 figures, 3 tables, publushed at Neurips 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22047 2025-12-29 cs.CV 57%

MAI-UI Technical Report: Real-World Centric Foundation GUI Agents

MAI-UI 技术报告:以现实为中心的基础 GUI 代理

Hanzhang Zhou, Xu Zhang, Panrong Tong, Jianan Zhang, Liangyu Chen, Quyu Kong, Chenglin Cai, Chen Liu, Yue Wang, Jingren Zhou, Steven Hoi

机构 * Tongyi Lab(通义实验室) Alibaba Group(阿里巴巴集团)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 MAI-UI 提出了一种基于现实的 GUI 代理框架,通过自演化数据管道、设备-云协作系统和在线 RL 框架,实现了 GUI 地基和移动导航的突破性进展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11953 2025-12-25 cs.CV 57%

SPOC: Spatially-Progressing Object State Change Segmentation in Video

SPOC: 视频中空间性推进的对象状态变化分割

Priyanka Mandikal, Tushar Nagarajan, Alex Stoken, Zihui Xue, Kristen Grauman

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 SPOC提出空间性推进的对象状态变化分割任务,通过伪标签和动态约束方法,解决视频中对象变化位置和速度的精确定位问题。

Comments Accepted at WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20013 2025-12-24 cs.CV 57%

SegEarth-R2: Towards Comprehensive Language-guided Segmentation for Remote Sensing Images

SegEarth-R2: 向远程 sensing 图像的全面语言引导分割迈进

Zepeng Xin, Kaiyu Li, Luodi Chen, Wanchen Li, Yuchen Xiao, Hui Qiao, Weizhan Zhang, Deyu Meng, Xiangyong Cao

机构 * Xi’an Jiaotong University(西安交通大学) China Telecom Shaanxi Branch(中国电信陕西分支)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.CV

AI总结 SegEarth-R2通过MLLM架构实现远程 sensing 图像的全面语言引导分割,解决复杂场景下的多目标和隐含意图识别问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19992 2025-12-24 cs.AI cs.CY 57%

S$^3$IT: A Benchmark for Spatially Situated Social Intelligence Test

S$^3$IT:一种用于空间情境社交智能测试的基准

Zhe Sun, Xueyuan Yang, Yujie Lu, Zhenliang Zhang

机构 * State Key Laboratory of General Artificial Intelligence, Beijing Institute for General Artificial Intelligence (BIGAI)(通用人工智能国家重点实验室,北京通用人工智能研究院)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.AI

AI总结 S$^3$IT基准通过座位安排任务评估代理在现实情境中整合物理与社会约束的能力,揭示LLMs在空间智能上的不足及在冲突解决中的潜力。

Comments 10 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19725 2025-12-24 cs.LG 57%

Out-of-Distribution Detection for Continual Learning: Design Principles and Benchmarking

持续学习中的分布外检测:设计原则与基准测试

Srishti Gupta, Riccardo Balia, Daniele Angioni, Fabio Brau, Maura Pintor, Ambra Demontis, Alessandro Sebastian, Salvatore Mario Carta, Fabio Roli, Battista Biggio

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.LG

AI总结 本文探讨了持续学习中分布外检测的设计原则与基准测试,旨在提升AI系统在动态环境中的适应性和鲁棒性。

Comments International Journal of Computer Vision

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18279 2025-12-24 cs.CV 57%

UniMPR: A Unified Framework for Multimodal Place Recognition with Heterogeneous Sensor Configurations

UniMPR: 一种用于异构传感器配置的多模态地点识别统一框架

Zhangshuo Qi, Jingyi Xu, Luqi Cheng, Shichen Wen, Yiming Ma, Guangming Xiong

机构 * Beijing Institute of Technology(北京理工大学) Shanghai Jiao Tong University(上海交通大学) The University of New South Wales(新南威尔士大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 UniMPR提出了一种统一框架,能够适应多种异构传感器配置,通过极坐标BEV特征空间和多分支网络实现多模态地点识别的高效与鲁棒性。

Comments 14 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10780 2025-12-24 cs.RO cs.SY eess.SY 57%

Learning Stack-of-Tasks Management for Redundant Robots

为冗余机器人学习任务堆栈管理

Alessandro Adami, Aris Synodinos, Matteo Iovino, Ruggero Carli, Pietro Falco

机构 * University of Padova, Dept. of Information Engineering(帕多瓦大学信息工程系) ABB Corporate Research(ABB企业研究) Mobile Robotics Lab, ETH Zürich(苏黎世联邦理工学院移动机器人实验室) Polytechnic of Bari Dept. of Electrical and Information Engineering(巴里理工学院电气与信息工程系)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种自动学习冗余机器人任务堆栈控制器的方法,通过优化用户定义的成本函数实现任务优先级和控制参数的自适应调整,确保在真实机器人上安全精确的运动表现。

详情

展开后加载摘要…

URL PDF HTML 收藏