arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-02-03 至 2026-02-03 共收录 3 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 机器人多传感器融合 3 篇

2602.00152 2026-02-03 cs.CV cs.AI eess.SP 76%

Real-Time Human Activity Recognition on Edge Microcontrollers: Dynamic Hierarchical Inference with Multi-Spectral Sensor Fusion

边缘微控制器上的实时人类活动识别:基于多光谱传感器融合的动态分层推理

Boyu Li, Kuangji Zuo, Lincong Li, Yonghui Wu

专题命中 机器人多传感器融合 :sensor fusion(title);分类 cs.CV、eess.SP

AI总结 HPPI-Net通过多光谱传感器融合和分层推理实现边缘微控制器上的实时人类活动识别,提升准确率并降低资源消耗。

Comments 24 pages, 6 figures. The manusrcipt is under review at Measurement

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04356 2026-02-03 cs.RO cs.AI cs.CV 62%

UNIC: Learning Unified Multimodal Extrinsic Contact Estimation

UNIC: 学习统一的多模态外在接触估计

Zhengtong Xu, Yuki Shirai

机构 * Edwardson School of Industrial Engineering, Purdue University(帕克大学工业工程学院) Mitsubishi Electric Research Laboratories(三菱电机研究实验室)

专题命中 机器人多传感器融合 :multimodal fusion(abstract);分类 cs.CV、cs.RO

AI总结 UNIC通过统一多模态框架实现无需先验知识的外在接触估计,提升手部操作的鲁棒性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01832 2026-02-03 cs.AI 50%

Synesthesia of Vehicles: Tactile Data Synthesis from Visual Inputs

车辆的联觉:从视觉输入合成触觉数据

Rui Wang, Yaoguang Cao, Yuyi Chen, Jianyi Xu, Zhuoyang Li, Jiachen Shang, Shichun Yang

机构 * Dept. of Transportation Science, Beihang Univ.(北京航空航天大学交通运输科学系) State Key Lab of Intelligent Transportation System, Beihang Univ.(北京航空航天大学智能交通系统国家重点实验室) Hangzhou International Innovation Institute, Beihang Univ.(杭州国际创新研究院) China Software Testing Center(Ministry of Industry and Information Technology Software and Integrated Circuit Promotion Center)(中国软件测试中心(工业和信息化部软件与集成电路促进中心))

专题命中 机器人多传感器融合 :multi-modal fusion(abstract)

AI总结 本文提出基于视觉输入的触觉数据合成方法,通过跨模态时空对齐和潜在扩散模型提升自动驾驶车辆的触觉感知能力,从而增强安全性能。

详情

展开后加载摘要…

URL PDF HTML 收藏