arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 567 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 567 篇

2608.15995 2026-08-18 cs.RO cs.LG 新提交 62%

Learning Varying Physical Therapist-Patient Interactions for Robot-mediated Upper Limb Task-Specific Training

学习可变的治疗师-患者交互用于机器人介导的上肢任务特定训练

Jia Quan Loh, Vincent Crocher, Marlena Klaic, Denny Oetomo, Ying Tan

机构 * The University of Melbourne(墨尔本大学)

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.LG

AI总结 该研究针对康复机器人在任务特定训练中未体现显著优势的问题,提出基于TPGMM的演示学习框架,学习个性化治疗师-患者交互,在多任务评估中其表现略优于查找表。

Comments 12 pages, 4 figures, 3 tables Submitted to:IEEE Transactions on Neural Systems and Rehabilitation Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12515 2026-08-14 cs.CV cs.RO 新提交 62%

Can Vision-Language Models Assess Proxemic Risk from Egocentric Robot Images?

视觉-语言模型能否从机器人的第一人称视角图像评估人际距离风险?

Vladyslava Rudas, Dmytro Kuzmenko

机构 * National University of Kyiv-Mohyla Academy(基辅莫希拉国立大学) University of Turin(都灵大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 该研究评估了InternVL、Qwen-VL、SmolVLM三种VLM在机器人第一人称视角图像人际距离危险分类中的表现,发现Qwen-VL经特定优化后高危险召回率更高,当前VLM在相关推理定位上仍有局限。

Comments Accepted at the EMR 2026 workshop at ECCV 2026 (non-archival)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10023 2026-08-12 cs.RO cs.CV cs.SY eess.SY 新提交 62%

Protection Levels for Vision-Based Pose Estimation

基于视觉的位姿估计的保护水平

Olivia Beyer Bruvik, Romeo Valentin, Marc R. Schlichting, Don Walker, Mykel J. Kochenderfer

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 本研究扩展了现有视觉位姿估计框架,推导了适用于航空场景的非线性PnP问题保护水平算法,分析了相关因素对其的影响并展示了权衡关系,为视觉导航的完整性认证提供支持。

Comments 11 pages, 5 figures. Accepted for publication at the 2026 AIAA DATC/IEEE 45th Digital Avionics Systems Conference (DASC). O. Beyer Bruvik and R. Valentin contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07606 2026-08-11 cs.RO cs.AI cs.HC eess.IV 新提交 62%

Enhanced Real-Time 6-DOF Extended Reality Catheter Tracking for Evaluating Potential Improvement in Efficiency, Precision, and Depth Perception for Cardiac Interventions

用于评估心脏介入效率、精度和深度感知潜在提升的增强型实时六自由度扩展现实导管跟踪技术

Mohsen Annabestani, Sandhya Sriram, Andrew Kuzemczak, S. Chiu Wong, Alexandros Sigaras, Bobak Mosadegh

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本研究开发基于XR的实时6-DOF导管跟踪平台,经20名医学生测试,其可使心脏介入操作速度提升超5倍、导管移动距离减约5倍,还能提高精度、降低变异性,优化操作体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04732 2026-08-06 eess.SY cs.AI cs.RO cs.SY 新提交 62%

Toward Integrating Adaptive Experience Replay and Online Uncertainty Estimation in Safe Actor-Critic Optimal Control

在安全Actor-Critic最优控制中融合自适应经验回放与在线不确定性估计

Mahshad Rastegarmoghaddam, Davoud Nikkhouy, Shima Samadzadeh

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 该研究在安全Actor-Critic最优控制中提出融合自适应经验回放与在线不确定性估计的集成架构,在二维机器人导航任务的测试中,该集成配置在极端压力测试下实现零接触且全部种子到达目标,性能优于仅移除不确定性估计的配置。

Comments Code, deterministic seeds, data, figures, and protocol files are archived at https://doi.org/10.5281/zenodo.21515850 and https://github.com/SDNT8810/safe-actor-critic-aer-ue-reproducibility

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02320 2026-08-04 cs.RO cs.CV 新提交 62%

TravKAN: Fast and Interpretable Nonlinear Traversability Analysis with Kolmogorov-Arnold Networks

TravKAN:基于Kolmogorov-Arnold网络的快速可解释非线性可通行性分析

Daniel Fusaro, Simone Mosco, Wanmeng Li, Alberto Pretto

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出基于Kolmogorov-Arnold网络的TravKAN框架,结合LiDAR反射率手工特征,在公开数据集上性能优于传统深度模型,兼具可解释性与高效性,适用于安全关键的机器人可通行性分析。

Comments This paper has been accepted for publication at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27194 2026-07-30 cs.CV cs.RO 新提交 62%

VidMap: Exploiting Temporal Structure for Video-Based Structure-from-Motion

VidMap:利用时序结构实现基于视频的运动恢复结构

Zador Pataki, Paul-Edouard Sarlin, Marc Pollefeys

机构 * ETH Zurich(苏黎世联邦理工学院) Google(谷歌) Microsoft(微软)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 VidMap结合SLAM序列约束与SfM全局优化,利用宽基线匹配和深度先验,在多样挑战性数据集上,较最新SLAM和SfM更鲁棒准确,可实现任意长未标定视频的度量重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24983 2026-07-29 cs.LG cs.AI math.OC stat.ML 新提交 62%

Generative Distributionally Robust Optimization

生成式分布鲁棒优化

Ziwei Zhang, Jonathan Yu-Meng Li, Zhihao Jin

机构 * Telfer School of Management, University of Ottawa(渥太华大学泰尔弗管理学院) Department of Electrical and Computer Engineering, Western University(西安大略大学电气与计算机工程系)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 研究提出生成式分布鲁棒优化(GDRO)框架,接受可采样条件生成器为名义模型,通过采样器-辛科恩配对限制最坏情况法则,可直接有限样本近似和可微实现,相比名义决策降低了罕见上下文库存遗憾和SocialGAN导航碰撞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24083 2026-07-28 cs.LG cs.RO 新提交 62%

Learning Reusable Hybrid Motion Priors for Humanoid Locomotion from Motion Imitation

从运动模仿中学习可重复使用的类人运动混合先验

Valerio Belli, Valerio Modugno, Enrico Mingo Hoffman, Fabio Amadio

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.LG

AI总结 研究提出三阶段流程,将运动模仿技能转化为可重复使用的类人运动混合先验(HMP)。先训练专家策略模仿人类运动,再提炼为冻结架构,最后训练任务级策略。经模拟评估和机器人验证,HMP可重复使用,还揭示可解释码本结构,训练码本技巧能减少下游跌倒。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22166 2026-07-27 cs.RO cs.AI 新提交 62%

Learning Spatiotemporal Decision Priors for Efficient Path Planning under Partial Observability

学习时空决策先验以实现部分可观测性下的高效路径规划

Yi Liu, Hongda Zhang, Leyao Zou, Chunlei Meng, Ziqing Zhou, Yuning Chen, Zhuo Zou, Lida Xu, Zhongxue Gan, Chun Ouyang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(智能机器人与先进制造学院,复旦大学) School of Information Science and Technology, Fudan University(信息科学与技术学院,复旦大学) Department of Information Technology, Old Dominion University(信息技术系,老 Dominion 大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 研究部分可观测性下的路径规划问题,提出ImiPath框架,从示范轨迹提炼时空决策先验,经局部时空观测表示和时空注意力策略网络转换为决策先验并纳入异构规划器,提升路径质量与搜索效率,验证了框架的适应性和实际部署潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19971 2026-07-23 cs.RO cs.CV 新提交 62%

Unified Prediction and Planning via Conflict-Aware Disjoint Parameter Training

通过冲突感知不相交参数训练实现统一预测与规划

Taewon Seo, Seonae Jeon, Giwon Lee, Kuk-Jin Yoon, Daehee Park

机构 * DGIST(韩国科学技术院大邱庆北校区) KAIST(韩国科学技术院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究社交机器人在拥挤环境中统一预测与规划问题,提出基于模型合并的不相交参数训练框架DPT,通过分布式参数学习减轻技能冲突,稀疏合并提升性能,在标准基准测试中验证其在机器人导航上通用且有效。

Comments Accepted at ECCV 2026. 38 pages, 14 figures. Project page: https://dpt2026.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17994 2026-07-21 cs.CV cs.AI 新提交 62%

HAS: Highlight-guided Attention Steering for Multimodal LLM Video Summarization

HAS:用于多模态大语言模型视频摘要的高亮引导注意力转向

Rui Chu, Yingjie Lao

机构 * Tufts University(塔夫茨大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 针对视频摘要,提出HAS方法,通过全局找连续帧级高亮分布并作为注意力转向向量,让多模态大语言模型在推理时更关注高亮帧,避免丢失信息,在多种基准测试中性能出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17058 2026-07-21 cs.RO cs.CV 新提交 62%

DROID-ANCHOR: Odometry-Anchored Recurrent Metric Depth Estimation

DROID-ANCHOR:基于里程计锚定的循环度量深度估计

Yuxuan Chen, Brook Du

机构 * UC Berkeley(加州大学伯克利分校)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究针对单目系统尺度问题,提出Metric-DROID架构,通过集成里程计,利用LSTM更新算子、不确定性感知度量后端及选择性残差微调策略,实现视觉SLAM与物理现实锚定,有效解决尺度模糊等问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15621 2026-07-20 cs.RO cs.AI 新提交 62%

Think at 5 Hz, Act at 20 Hz: Asynchronous Fast-Slow Vision-Language-Action Inference for Closed-Loop Driving

以5Hz思考,20Hz行动:用于闭环驾驶的异步快慢视觉-语言-动作推理

Yun Li, Jiachen Gong, Simon Thompson, Ehsan Javanmardi, Qunli Zhang, Zifan Zeng, Shiming Liu, Peng Wang, Zixuan Guo, Manabu Tsukada

机构 * The University of Tokyo(东京大学) TIER IV, Inc.(TIER IV公司) Huawei(华为)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 研究针对大语言模型用于闭环驾驶时推理延迟与车辆控制速率冲突的问题,提出快慢架构,慢系统用冻结主干处理历史,快专家基于缓存和当前帧回归航路点,经训练在CARLA上提升路线完成率,降低误差且可零样本转移。

Comments 13 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14228 2026-07-17 cs.CV cs.AI 新提交 62%

SeeSE3: Emergence of 3D Space in Vision Features

SeeSE3:视觉特征中3D空间的出现

Caroline Chen, Sayna Ebrahimi, Fedor Kitashov, Ming-Hsuan Yang, Leonidas Guibas, Viorica Pătrăucean, Maks Ovsjanikov

机构 * Google DeepMind(谷歌DeepMind)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 研究视觉基础模型构建的表征与3D欧几里得空间内在属性的关系,提出从拓扑和几何角度评估的探测器,发现自监督视觉模型有相关潜在子空间,并基于此提出“潜在空间导航”技术用于视觉里程计和定位。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13584 2026-07-16 cs.NE cs.CV cs.RO 新提交 62%

Visual Place Recognition Using Rate-Encoded Spiking Neural Networks with Discrete STDP Learning

使用具有离散STDP学习的速率编码脉冲神经网络进行视觉场所识别

Altzi Tsanko, Oikonomou Katerina Maria, Antonios Gasteratos

机构 * Department of Production and Management Engineering, Democritus University of Thrace(生产与管理工程系,德摩克利特大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究基于STDP的SNN-VPR视觉场所识别,提出离散张量原生实现,用PyTorch和snnTorch在Nordland数据集评估。通过闭式张量管道神经元分配、查询后状态重置及速度补偿滑动窗口聚合提高召回精度,虽各机制贡献待进一步研究,但已展示推理阶段决策影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12801 2026-07-15 cs.RO cs.AI cs.SY eess.SY 新提交 62%

Autonomous Tracking and Terminal Guidance of Moving Targets for Fixed-Wing UAVs

固定翼无人机移动目标的自主跟踪与终端制导

Wei-Hao Liou, Teng-Hu Cheng

机构 * Department of Mechanical Engineering, National Yang Ming Chiao Tung University(国立阳明交通大学机械工程学系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 研究为固定翼无人机引入统一控制框架,采用三相策略,利用UKF融合视觉检测与惯性测量,结合带约束感知的NMPC及BPNG律,实现从目标检测到终端拦截的任务,仿真验证其能稳定跟踪并精确拦截,同时遵守相关约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08391 2026-07-10 cs.RO cs.LG 新提交 62%

On Exploring Input Resolution Scaling For Anytime LiDAR Object Detection

关于探索用于任意时刻激光雷达目标检测的输入分辨率缩放

Ahmet Soyyigit, Shuochao Yao, Heechul Yun

机构 * The National Defense University(国防大学) George Mason University(乔治梅森大学) The University of Kansas(堪萨斯大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.LG

AI总结 研究为处理激光雷达点云的深度神经网络实现任意时刻计算,提出新方法可多分辨率推理,引入期限感知调度器,内存高效只需单个模型,实验表明优于现有方法,部署在模拟系统可实现无碰撞导航并避免停顿。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03213 2026-07-07 cs.CV cs.AI cs.CL cs.HC 新提交 62%

OpenGlass: A Sensing-Computing Split Architecture for Local MLLM-Driven Real-Time Visual Assistance

OpenGlass:用于本地MLLM驱动的实时视觉辅助的传感-计算分离架构

Mengzhang Li, Yuan Yao

机构 * Shanghai Qizhi Institute(上海期智研究院) College of AI, Tsinghua University(清华大学人工智能学院)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 针对视障和低视力用户,OpenGlass以传感-计算分离解决云MLLM辅助需上传数据、有网络延迟,以及可穿戴眼镜计算和电量受限问题,在本地设备实现低延迟多模态视觉辅助,并给出评估结果。

Comments Accepted to ACL 2026 System Demonstrations. 11 pages, 5 figures, 8 tables

Journal ref Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 3: System Demonstrations), pages 829-839, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00832 2026-07-07 cs.CV cs.AI 新提交 62%

Pano2World: End-to-End 3D Generation via Unified Multi-View Sequences

Pano2World: 通过统一多视图序列进行端到端三维生成

Zhenjia Li, Jinrang Jia, Yifeng Shi

机构 * Ke Holdings Inc.(贝壳找房)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 提出Pano2World方法,利用全景扩散模型和视图感知注意力路由,从单张室内全景图直接生成可探索的三维高斯场景,解决多步管道误差累积和视频模型灵活性不足的问题。

Comments 10 pages, 3 figures, 3 tables. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00065 2026-07-02 cs.RO cs.AI 新提交 62%

Optimal any-angle path planning in static and dynamic environments

静态与动态环境中的最优任意角度路径规划

Yiyuan Zou, Clark Borst

机构 * Faculty of Aerospace Engineering, Delft University of Technology(航空航天工程学院,代尔夫特理工大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 提出椭圆前向扩展和视野技术加速最优任意角度路径规划,开发Zeta*和Zeta*-SIPP算法,在静态和动态环境中保持最优性,速度提升20倍以上。

Comments 33 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31216 2026-07-01 cs.RO cs.AI 新提交 62%

Information-Aided DVL Calibration

信息辅助的DVL标定

Zeev Yampolsky, Itzik Klein

机构 * The Hatter Department of Marine Technologies Charney School of Marine Sciences, University of Haifa(海法大学查尼海洋科学学院哈特海洋技术系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 针对DVL在GNSS不可用环境下无法标定的问题,提出信息辅助标定方法,在GNSS可用环境下提升精度,在无GNSS环境下实现自标定,实验显示速度估计平均提升20%和35%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26383 2026-06-26 cs.LG cs.AI cs.AR cs.MA cs.PF 新提交 62%

SOLAR: AI-Powered Speed-of-Light Performance Analysis

SOLAR: AI驱动的光速性能分析

Qijing Huang, Sana Damani, Zhifan Ye, Athinagoras Skiadopoulos, Siva Kumar Sastry Hari, Jason Clemons, Sahil Modi, Jingquan Wang, Aditya Kane, Edward C Lin, Humphrey Shi, Christos Kozyrakis

机构 * NVIDIA(英伟达)

专题命中 具身导航 :robotics(abstract);分类 cs.AI、cs.LG

AI总结 提出SOLAR框架,自动从PyTorch和JAX代码推导理论最小执行时间(光速界限),通过LLM前端和确定性分析实现无违反界限的多保真度性能分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25366 2026-06-25 cs.RO cs.AI 新提交 62%

Reliability-Asymmetric Spacecraft Autonomy: Co-Designing a Capable Learned GNC Stack with a Verified, Adaptation-Aware Runtime Shield

非对称可靠性航天器自主性:协同设计有能力的学得制导导航控制系统与经过验证的、适应感知的运行时防护盾

Alireza Shojaei

机构 * Myers-Lawson School of Construction, Virginia Tech(弗吉尼亚理工大学迈尔斯-劳森建筑学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 提出AMPLE-GNC三层制导导航控制系统,结合学得组件与运行时防护盾,实现深空任务自主性的能力与可认证性;通过边缘指挥官、故障自适应控制器和适应感知恢复证书,在仿真中验证了高自主性与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24712 2026-06-24 cs.RO cs.AI 新提交 62%

TACTFUL: Tactile-Driven Exploration For Object Localization and Identification in Confined Environments

TACTFUL: 受限环境中的触觉驱动探索用于物体定位与识别

Shivani Kamtikar, Chung Hee Kim, Camilla Tabasso, Tye Brady, Joshua Migdal, Taskin Padir

机构 * Amazon Fulfillment Technologies & Robotics(亚马逊履约技术与机器人) Siebel School of Computing and Data Science, University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校西贝尔计算与数据科学学院) Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 提出无视觉触觉探索框架TACTFUL,使多指机器人通过动态奖励策略平衡全局探索与局部表面细化,实现物体自主发现与识别,平均重建误差0.015米,成功率77%。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19920 2026-06-19 cs.RO cs.LG cs.MA 新提交 62%

Deep-Unfolded Coordination

深度展开协调

Hunter Kuperman, Minchan Jung, Rahul V. Ghosh, Alex Oshin, Evangelos A. Theodorou

机构 * Autonomous Control and Decision Systems Laboratory Georgia Institute of Technology United States(佐治亚理工学院自主控制与决策系统实验室)

专题命中 具身导航 :robotics(abstract);分类 cs.RO、cs.LG

AI总结 提出Deep Coordinator框架,通过深度展开ADMM-DDP迭代学习动态调整超参数,实现非凸优化器求解时自适应惩罚参数,在车队和四旋翼仿真中速度提升6.18-9.44倍且可扩展至8倍规模。

Comments The second and third authors contributed equally (equal second authorship). 35 pages (10 pages main text), 17 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19476 2026-06-19 cs.LG cs.AI 新提交 62%

Can In-Context Learning Support Intrinsic Curiosity?

上下文学习能否支持内在好奇心?

Eric Elmoznino, Sangnie Bhardwaj, Johannes von Oswald, Rajai Nasser, Blaise Agüera y Arcas, João Sacramento, Rif A. Saurous, Guillaume Lajoie

机构 * Google – Paradigms of Intelligence Team(Google – 智能范式团队) Google DeepMind(谷歌DeepMind)

专题命中 具身导航 :world model(abstract);分类 cs.AI、cs.LG

AI总结 研究利用序列模型的上下文学习能力作为即时无更新世界模型,以消除传统内在好奇心方法中梯度下降的计算瓶颈,理论证明在非时间设置下可渐近收敛到真实学习进度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17376 2026-06-17 cs.RO cs.CV 新提交 62%

Contactless Respiratory Monitoring on Heterogeneous Mobile Robots: A Multimodal Edge-Computing Framework

异构移动机器人上的非接触式呼吸监测:一种多模态边缘计算框架

Milind Rampure, Shadman Sakib, Haley Patel, Zahid Hasan, Nirmalya Roy

机构 * University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 提出一种适用于异构移动机器人的多模态非接触式呼吸率监测框架,通过自适应传感器选择、关键点引导的ROI提取和信号质量过滤,在多种平台和光照条件下实现鲁棒监测,无需平台特定调参。

Comments 8 pages, 6 figures. To appear in Proceedings of the 8th International Workshop on IoT Applications and Industry 5.0 (IoTI5 2026), co-located with IEEE DCOSS-IoT 2026, Reykjavik, Iceland, June 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16042 2026-06-16 cs.RO cs.AI 新提交 62%

Leveraging Deep Learning for Object and Position Recognition of Load Carriers for Autonomous Logistics Vehicles

利用深度学习实现自主物流车辆对载具的物体与位置识别

Christoph Legat, Tobias Miller, Marco Riess

机构 * Research Group on Cognitive Autonomy & Predictive Intelligence, Technical University of Applied Sciences, Augsburg, Germany(认知自主与预测智能研究组,奥格斯堡应用技术大学,德国) Grenzebach Maschinenbau GmbH, Asbach-Bäumenheim, Germany(Grenzebach Maschinenbau GmbH,德国阿斯巴赫-博伊门海姆)

专题命中 具身导航 :robotics(abstract);分类 cs.RO、cs.AI

AI总结 提出基于深度学习的框架,通过卷积神经网络从RGBD数据中识别载具上的预定义地标并计算其位姿,实现自主物流车辆对载具的检测与定位,实验验证了工业环境下的可靠性。

Comments 6 pages, 6 figures, IFAC World Congress2026, \c{opyright} 2026 the authors. This work has been accepted to IFAC for publication under a Creative Commons Licence CC-BY-NC-ND

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14773 2026-06-16 cs.CV cs.AI 新提交 62%

Double-Helix Vision (DH-V2): A Geometry-Based Visual Sampler for Bandwidth-Constrained Perception

双螺旋视觉 (DH-V2):一种基于几何的带宽受限感知视觉采样器

Jinwen Wen

机构 * Independent Researcher(独立研究者)

专题命中 具身导航 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 提出双螺旋视觉(DH),一种基于黄金比例螺旋轨迹的几何采样器,将2D图像压缩为1D信号,实现1433倍压缩比,在CPU上0.52ms完成感知,CIFAR-10上准确率提升6.03%。

Comments 5 pages, 3 figures, 5 tables. Code and benchmarks: https://github.com/JackJ-C/double-helix-vision-tool

详情

展开后加载摘要…

URL PDF HTML 收藏