arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 497 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 497 篇

2607.25918 2026-07-29 cs.RO 新提交 57%

DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models

DC-WAM:用于世界-动作模型的以动态为中心的视觉监督与推理

Haoyuan Ji, Lingxiang Fan, Shang Su, Yinqiao Lu, Mengkai Shi, Jun Gao, Shuo Feng

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 研究如何让基于RGB的世界-动作模型从外观主导的重建转向交互诱导的视觉动态,提出DC-WAM框架,通过重新分配监督和计算,结合时间差分流匹配等方法,提升策略性能,尤其在多种分布外扰动下表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25140 2026-07-29 cs.AI cs.CL cs.GR cs.MA 新提交 57%

How Affect Propagates among LLM Agents: Emergent Emotional Contagion in Crowd Simulation

情感如何在大语言模型智能体之间传播:人群模拟中的涌现情感传染

Funda Durupinar

机构 * University of Massachusetts(马萨诸塞大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 研究多智能体人群模拟中情感传播,通过感知 - 评估 - 表达循环及借鉴相关模型构建架构,在多场景评估,揭示情感传染动态,包括警报扩散、个性影响等,还发现评估步骤动态依赖后端。

Comments 31 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23870 2026-07-28 cs.MA cs.AI 新提交 57%

MulRobBench: A Decision-Level Benchmark for Safe and Security-Policy-Compliant Multimodal UAV Agents

MulRobBench:用于安全且符合安全策略的多模态无人机智能体的决策级基准测试

Belal S. Alsinglawi, Weizheng Wang, Junyi Wu, Yi Jiang, Lianhai Lin, Merouane Debbah, Izzat Alsmadi

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 智慧城市中无人机需在复杂条件下决策,MulRobBench作为决策级基准测试,将多模态观测、安全策略等集成,含多任务样本和评分维度,评估结合多种方式,给出模型得分,通过研究找出决策不稳定原因,为无人机多模态决策提供可重复基准。

Comments 22 pages, 18 figures, 17 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23694 2026-07-28 cs.CV 新提交 57%

Parameter-Efficient Adaptation of SAM3 for Prompt-Driven Surgical Concept Segmentation

用于提示驱动手术概念分割的 SAM3 的参数高效适配

Changjing Liu, Yiming Huang, Beilei Cui, Liangjing Shao, Long Bai, Yanheng Li, Haoxuan Che, Hongliang Ren

机构 * The Chinese University of Hong Kong(香港中文大学) XGEN Labs(XGEN实验室)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 针对手术数据与预训练数据的领域差距及现有方法计算消耗大效率低的问题,提出用低秩适配(LoRA)对 SAM3 进行参数高效适配用于手术概念分割,该方法在单个 GPU 上训练且性能优于主流基线,结果可支持下游手术场景重建和模拟。

Comments Accepted by The 2nd MICCAI Workshop on Efficient Medical AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22832 2026-07-28 cs.LG 新提交 57%

MEMENTO: Memory-Guided Memetic Code-as-Policy Evolution

MEMENTO:内存引导的基于代码的策略进化的模因算法

Alkis Sygkounas, Victor Aregbede, Amy Loutfi, Andreas Persson

机构 * Center for Applied Autonomous Sensor Systems (AASS), Örebro University(应用自主传感器系统中心(AASS),于默奥大学) Örebro University(于默奥大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.LG

AI总结 研究长期具身任务中基于代码的策略进化问题,提出内存引导单精英模因框架MEMENTO,通过进化展开评估器及利用反馈指标改进策略,在相关领域实验中性能优于基线,还证明了模拟到现实转移的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22030 2026-07-27 cs.RO 新提交 57%

Impedance Control of Ship-Borne Manipulators via Optimization-based Task-Space Inverse Dynamics

基于优化的任务空间逆动力学的舰载机械手阻抗控制

Lingxiao Meng, Bi-Ke Zhu, Xuheng Gao, Zhe Zhang, Jiankun Yang, Jiankun Wang, Haibo Lu, Max Q. -H. Meng

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 针对舰载机械手受波浪基座运动影响问题,提出基于扭矩水平优化控制框架,结合任务空间逆动力学和误差状态卡尔曼滤波器,经仿真与实验验证,有效降低跟踪误差,实现动态销孔插入,提升操作成功率并减少接触力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21986 2026-07-27 cs.RO 新提交 57%

Mag4D-SLAM Dataset: A Repeated-Traversal Multi-Modal 4D Geomagnetic Dataset for Localization and Mapping

Mag4D-SLAM数据集:用于定位和映射的重复遍历多模态4D地磁数据集

Bibhutibhusan Nayak, Hyoseok Ju, Giseop Kim

机构 * Department of Robotics and Mechatronics Engineering, DGIST(大邱庆北科学技术院机器人与机电工程系)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 该研究提出Mag4D-SLAM这一首个大规模室外地磁SLAM数据集,含多传感器同步测量与地面真值姿态。通过重复遍历实验分析磁场重复性等特性,支持偏航漂移缓解等研究,还能开启地磁传感补充其他模态及应对特殊情况的新研究。

Comments Accepted to IROS 2026. 8 pages, 8 figures. *Bibhutibhusan Nayak and Hyoseok Ju contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21571 2026-07-24 cs.RO 新提交 57%

Beyond Episodic Evaluation: Memory Architectural Bottlenecks in Sequential Embodied Question Answering

超越情节性评估:序列式具身问答中的内存架构瓶颈

Zikui Cai, Kaushal Janga, Tan Dat Dao, Seungjae Lee, Shivin Dass, Mingyo Seo, Kaiyu Yue, Mintong Kang, Nandhu Pillai, Monte Hoover, Aadi Palnitkar, Ruchit Rawal, Ruijie Zheng, Bo Li, Yuke Zhu, Roberto Martín-Martín, Tom Goldstein, Furong Huang

机构 * University of Maryland, College Park(马里兰大学帕克分校) The University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 研究序列式具身问答中不同内存架构表现,发现仅保留现有记忆不足,短视情节数据训练的智能体有时间不匹配问题。强调结构化、基于空间记忆的必要性,实验表明其能打破准确性-效率权衡,对真实机器人连续智能操作至关重要。

Comments Accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21309 2026-07-24 cs.RO 新提交 57%

Factorized Spatio-Temporal Convolutions for Human Pose Estimation from Planar Lidar

用于基于平面激光雷达的人体姿态估计的分解时空卷积

Simone Arreghini, Mirko Nava, Nicholas Carlotti, Antonio Paolillo, Alessandro Giusti

机构 * Dalle Molle Institute for Artificial Intelligence (IDSIA), USI-SUPSI(瑞士意大利语区大学提契诺大学人工智能达勒莫利研究所)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 针对服务机器人仅配备平面激光雷达和普通处理器的情况,提出基于时空块的轻量级网络,用于全向人体检测和相对2D姿态估计,通过跨模态自监督训练,优于基线模型,适用于计算受限的服务机器人空间感知。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19243 2026-07-22 cs.CL cs.AI 新提交 57%

Inference-Time Steering for Cross-Lingual Factual Consistency in LLMs

大语言模型中跨语言事实一致性的推理时引导

Alexander Manev

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 研究大语言模型跨语言事实不一致问题,评估零样本上下文引导、CAA、DPO四种干预策略,通过实验发现角色提示是最强干预方式,CAA对配置敏感,DPO适配器收益窄且可转移性低,表明跨语言不一致部分是选择问题,简单干预可能更优。

Comments 8 pages (21 in total), 2 figures, 4 tables. Original manuscript for a Guided Research project conducted at the Technical University of Munich, detailing the complete methodology, full data pipeline, and comprehensive experimental results. A related, condensed subset of this work was subsequently adapted and published at the StereACuLT 2026 workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19196 2026-07-22 eess.SY cs.RO cs.SY 新提交 57%

STL-GCS: A Planner-Controller Framework for Signal Temporal Logic via Graphs of Time-varying Convex Sets

STL-GCS:一种基于时变凸集图的信号时序逻辑规划器-控制器框架

Nicola De Carli, Gregorio Marchesini, Dimos V. Dimarogonas

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 提出用于满足凸谓词上STL规范的统一轨迹规划与控制框架,规划层将任务编码为时变凸集,结合GCS框架并由B样条参数化轨迹,控制层据此设计反馈控制器,通过仿真和实际实验验证了该方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18887 2026-07-22 cs.AI 新提交 57%

NaviAIS: A Scenario-Level Vessel Trajectory Prediction Dataset withVectorized Lane Priors and the NaviLane Forecasting Framework

NaviAIS:一个具有矢量化航道先验的场景级船舶轨迹预测数据集及NaviLane预测框架

Yuan Gui, Hongchen Luo, Liqi Qu, Longyue Fu, Jiao Wang

机构 * Northeastern University(东北大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 研究针对复杂海洋环境下船舶轨迹预测问题,引入NaviAIS数据集并提出NaviLane框架,通过轨迹-地图联合编码、离散宏动作码本及模块优化评估等方法,提升船舶轨迹预测性能,优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18847 2026-07-22 cs.CR cs.AI 新提交 57%

Data Leakage Prevention in Agentic Applications via Preemptive Hardening

通过先发制硬化防止智能应用中的数据泄露

Akansha Shukla, Emily Bellov, Parth Atulbhai Gandhi, Yuval Elovici, Asaf Shabtai

机构 * Faculty of Computer and Information Science(计算机与信息科学系) Ben-Gurion University of the Negev(内盖夫本· Gurion大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 研究智能应用数据泄露问题,提出预部署管道,通过分析提示模板等识别泄露模式并生成补丁,经硬化和验证确保应用功能不受影响,评估显示能有效减少数据泄露。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18578 2026-07-22 cs.RO eess.SP 新提交 57%

Two-Stage Extrinsic Calibration of a Static Line-Scanning Lidar with a Rotary Platform

基于旋转平台的静态线扫描激光雷达的两阶段外部校准

Vikram Shree, Hike Danakian, Long Nguyen, Rajanish Gokidi, Patrick Nercessian

机构 * SiLC Technologies(SiLC技术公司)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 研究基于旋转平台的静态线扫描激光雷达校准问题,探索自动方法静态和动态估计旋转轴变换,通过真实数据集验证算法并研究其收敛特性。

Comments 8 pages, 13 figures. Manuscript accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18548 2026-07-22 cs.AI cs.MA cs.SY eess.SY 新提交 57%

Engineering Trustworthy Agentic AI for Critical Systems

为关键系统设计可靠的智能体人工智能

Omar Al-Refai, Ibrahim Shahbaz, Adam Ali Husseinat, Michael Mandulak, Jaewon Kim, Eman Hammad

机构 * Texas A&M University(德克萨斯A&M大学) Innovations in Systems Trust and Resilience (iSTAR) Laboratory(系统信任与弹性创新(iSTAR)实验室) Texas A&M Institute of Data Science - Security, Privacy and Resilience for Trusted AI (SPARTA) Thematic Lab.(德克萨斯A&M大学数据科学研究所 - 可信人工智能的安全、隐私与弹性(SPARTA)主题实验室) Texas A&M Global Cyber Research Institute (GCRI)(德克萨斯A&M大学全球网络研究所)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI

AI总结 研究针对关键工程领域智能体人工智能,将可靠性作为首要工程属性,采用围绕五个维度的可靠性模型及保证工作流程,综述相关架构、机制等,经多领域检验,指出其可靠性是单一问题并勾勒跨域保证框架路径。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18210 2026-07-21 cs.RO 新提交 57%

Optimization of sim-to-real transfer in the humanoid robot NICO

人形机器人NICO中模拟到现实转换的优化

Juraj Gavura, Igor Farkaš

机构 * Comenius University Bratislava(布拉迪斯拉发夸美纽斯大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 研究针对人形机器人模拟到现实转换中因定位误差妨碍抓取的问题,通过添加多种检测和定位方法及校正,形成基于校准的抓取管道,并实现视觉反馈模型,提高了抓取成功率。

Comments 12 pages, 8 figures, accepted to International Conference on Artificial Neural Networks 2026, Neurorobotics workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18154 2026-07-21 cs.RO 新提交 57%

World Translation: Minimizing Sim-to-Real Gap with Backward Dynamics Extraction and Unpaired Domain Translation

世界翻译:通过反向动力学提取和非配对域翻译最小化模拟与现实之间的差距

Xinchen Yao, Leixin Chang, Hua Chen

机构 * Zhejiang University(浙江大学) LimX Dynamics(LimX动力学公司)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 研究模拟与现实差距问题,提出“世界翻译”方法,利用模拟器和学习动力学互补优势,反向提取动力学信息并跨域转换,实验表明该方法能更准确建模,在特定情况下优势明显,还证实可改进策略转移。

Comments 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17701 2026-07-21 cs.AI 新提交 57%

ProEvent: An Event-centric Benchmark for Proactive Agents

ProEvent:面向主动智能体的以事件为中心的基准测试

Guanzhen Li, Liangming Pan, Leye Wang

机构 * School of Computing, Peking University(北京大学计算机学院)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 针对主动智能体研究忽视事件中心协助及评估难的问题,引入ProEvent基准测试,基于即时通讯聊天评估智能体维护用户时间表能力,实验发现当前智能体存在过度反应和事件取消处理难等问题,揭示了大语言模型的根本局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16630 2026-07-21 cs.RO 新提交 57%

AI-Augmented Model Predictive Control for Safe and Adaptive Rendezvous and Proximity Operations

用于安全和自适应交会及接近操作的人工智能增强模型预测控制

Luca Sportelli, Tyler Barr, Cagri Kilic, Di Wu

机构 * Embry–Riddle Aeronautical University(安柏瑞德航空航天大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 研究多智能体对抗场景下航天器自主交会及接近操作问题,提出结合约束滚动时域MPC与数据驱动监督调整层的框架,经蒙特卡罗模拟评估,该框架相比固定参数MPC有更好性能,为自适应航天器RPO提供模块化、可解释基础。

Comments 34 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16401 2026-07-21 cs.CV 新提交 57%

Apple-$π$: Benchmarking Thinking with Video Towards Law-Grounded Physical Intelligence

Apple-$π$:基于视频对基于法律的物理智能进行思维基准测试

Runmao Yao, Kairui Hu, Yukang Cao, Ruisi Wang, Shulin Tian, Ziang Cao, Weichen Fan, Ziqi Huang, Yuhao Dong, Hao Li, Zhaoxi Chen, Zhongang Cai, Lei Yang, Ziwei Liu

机构 * S-Lab, Nanyang Technological University(南洋理工大学S-Lab) The Chinese University of Hong Kong(香港中文大学)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.CV

AI总结 研究针对视频模型评估仅看输出层面的不足,提出Apple-PI基准,含数据集、协议和评估套件三部分,通过对11个模型测试发现其距可靠世界模拟器差距大,并揭示了一些瓶颈与差距,为指导视频模型发展提供诊断基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15733 2026-07-20 cs.RO 新提交 57%

A Task-Space Receding Horizon Controller for Fast Collision Avoidance

一种用于快速避碰的任务空间滚动时域控制器

Mattia Penzotti, Marco Controzzi

机构 * Biorobotics Institute and the Department of Excellence in Robotics and AI, Scuola Superiore Sant’Anna(生物机器人研究所和机器人与人工智能卓越系,圣安娜高等学校)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 研究机器人操纵器实时避碰问题,提出任务空间滚动时域控制器,通过短接触一致展开生成终端参考并计算首个输入,经迭代动力学求解器塑造参考,仿真与实验验证该方法在动态杂波中平衡多方面性能且提升成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15727 2026-07-20 cs.CV 新提交 57%

Event3R: Asynchronous-to-Global 3D Reconstruction from Event Camera via Spatial-Temporal Feature Aggregation

Event3R:通过时空特征聚合从事件相机进行异步到全局的3D重建

Jian Huang, Haotian Shen, Xinhao Lou, Chengrui Dong, Wenpu Li, Peidong Liu

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 研究针对事件相机异步、稀疏和高动态特性及缺乏标注数据集的问题,提出Event3R框架,通过时空体素表示、时间注意力模块、掩码箱建模策略及对比对齐和一致性正则化损失,实现鲁棒的3D重建,性能显著优于现有方法。

Comments accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15218 2026-07-17 cs.AI cs.CR 新提交 57%

When Words Are Safe But Actions Kill: Probing Physical Danger Beyond Text Safety in Hidden-State Risk Space

当言语安全但行动致命:在隐藏状态风险空间中探究超越文本安全的物理危险

Weimeng Wang, Ziqiang Wang, Zihang Zhan, Chuanpu Fu, Qi Li, Ke Xu

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.AI

AI总结 研究大语言模型中语言无害指令在现实世界中的物理危险与文本级内容危险是否相同,提出PRISM方法,通过隐藏状态方向分析等证明CD和PD可分离,PRISM在多个基准测试中表现良好,能检测物理危险而非仅依赖明确不安全措辞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15156 2026-07-17 cs.RO 新提交 57%

Assessing Physical Frailty and Fall-Risk Indicators with Social Robots: An in situ Evaluation with Older Adults

用社交机器人评估身体虚弱和跌倒风险指标:对老年人的现场评估

Aniol Civit, Antonio Andriella, Alba Martínez, Joan Ars, Aida Ribera, Cristian Barrué, Guillem Alenyà

机构 * Institut de Robòtica i Informàtica Industrial, CSIC-UPC(工业机器人与信息学研究所,西班牙科学与技术研究委员会 - 加泰罗尼亚理工大学) Parc Sanitari Pere Virgili(圣佩雷维吉利疗养院) RE-FiT Barcelona Research Group(巴塞罗那RE-FiT研究小组) Vall d’Hebron Institute of Research(瓦尔德希伯伦研究院) Aging Research Center, Department of Neurobiology, Care Sciences and Society (NVS), Karolinska Institutet and Stockholm University(衰老研究中心,神经生物学、护理科学与社会系(NVS),卡罗林斯卡学院和斯德哥尔摩大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 研究针对老年人虚弱评估资源密集且易忽略生物力学指标的问题,提出用行为树架构的机器人框架,通过视觉跟踪评估临床测试。经现场评估,该框架能提供可靠客观的评估,还可收集相关移动性指标。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14997 2026-07-17 cs.RO 新提交 57%

AeroAct: Action-Centered World-Action Models for Language-Conditioned Quadrotor Flight

AeroAct:用于语言条件四旋翼飞行的以动作中心的世界-动作模型

Xinhong Zhang, Qiyuan Zhu, Yubo Huang, Haolin Chen, Runqing Wang, Yuhao Mo, Zhongxin Chen, Yu Hu, Xinjiang Wang, Jian Sun, Gang Wang

机构 * School of Automation, Beijing Institute of Technology(北京理工大学自动化学院) School of Mechanical Engineering, Beijing Institute of Technology(北京理工大学机械工程学院)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 研究语言条件下四旋翼飞行问题,提出AeroAct模型,利用预训练视频扩散Transformer,结合相关采集设备和程序获取数据,经实验验证该模型能提升四旋翼飞行的目标跟踪和物体搜索性能,且对应策略可在实体四旋翼上执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14725 2026-07-17 cs.RO 新提交 57%

BridgeFlow: Fast and Robust SE(2)-Equivariant Motion Planning with Flow Matching

BridgeFlow:基于流匹配的快速且鲁棒的 SE(2) 等变运动规划

Xinzhe Zhou, Xuyang Wang, Xiaoming Duan, Jianping He

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 研究针对机器人运动规划中刚体变换等变性难题,提出BridgeFlow框架,通过轻量级模块实现等变性,结合布朗桥信息先验与最优传输加速推理,并嵌入环境感知,相比基线有速度和轨迹率优势,可稳健泛化。

Comments Accepted to the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026). 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14660 2026-07-17 cs.CV 新提交 57%

VIABench: A Comprehensive Video Benchmark Collected from Blind Individuals for Visual Impairment Assistance

VIABench:一个从视障人士收集的用于视障辅助的综合视频基准测试

Yunfeng Liu, Yuandong Yang, Jiarui Han, Zhenpeng Huang, Yuqing Tang, Xiangyu Zeng, Gangshan Wu, Limin Wang

机构 * Nanjing University(南京大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 针对视障人士视觉信息获取难及多模态大语言模型在视障辅助中实用价值待探索的问题,引入VIABench视频基准测试,定义三个核心任务,提出严格测试流程,实验表明当前模型对视障人士支持不足,有望推动定制模型开发以改善其体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14046 2026-07-16 cs.AI 新提交 57%

Earthquaker-AI: A Retrieval-Augmented Generation Framework with Rubric-Based Assessment for Primary School Earthquake Education

地震人工智能:一种基于评分标准评估的小学地震教育检索增强生成框架

Xanthi Kokkinou, Chaido Mizeli, Nafsika Koulaxidou, Marina Delianidi, Konstantinos Diamantaras

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI

AI总结 研究针对小学生地震教育问题,提出地震人工智能混合教育框架,集成检索增强生成对话式AI助手,结合乐高机器人、评分标准和AI,通过不同年级的渐进学习提升学生地震应对能力,实验显示有高可信度和准确性。

Comments 17 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13405 2026-07-16 cs.RO 新提交 57%

WNOJ-LIO: A White-Noise-on-Jerk Motion-Prior EKF for High-Dynamic LiDAR-IMU Fusion

WNOJ-LIO:一种用于高动态激光雷达-惯性测量单元融合的基于加加速度白噪声运动先验的扩展卡尔曼滤波器

Junning Lyu, Qizhi Guo, Xia Ning, Tao Song, Shaoming He

机构 * School of Aerospace Engineering, Beijing Institute of Technology(北京理工大学宇航学院)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 研究高动态驾驶下激光雷达-IMU融合问题,提出基于加加速度白噪声运动先验的扩展卡尔曼滤波器框架WNOJ-LIO,通过解耦先验预测状态、视IMU为高频测量源,经仿真和实际实验验证,提升了相关性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12965 2026-07-15 cs.RO 新提交 57%

MAMMOTH: A Multi-Modal End-to-End Policy for Off-Road Mobility Robust to Missing Modality

MAMMOTH:一种对缺失模态具有鲁棒性的越野移动多模态端到端策略

Ahaan Kotian, Shivani Subramanyan, Suresh Sundaram

机构 * Indian Institute of Science(印度科学研究所)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 研究针对非结构化越野环境自主导航难题,提出MAMMOTH多模态端到端策略。它融合多模态观测,用模态丢弃训练,还采用扩散策略学习联合概率分布,经实验验证性能优越,能提升避撞等能力及对缺失模态的泛化。

Comments Accepted to IROS 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏