arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-02-02 至 2026-02-02 共收录 2 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 机器人多传感器融合 1 篇

2601.22406 2026-02-02 cs.RO 74%

Accurate Pedestrian Tracking in Urban Canyons: A Multi-Modal Fusion Approach

城市峡谷中精确的人行道跟踪:一种多模态融合方法

Shahar Dubiner, Peng Ren, Roberto Manduchi

专题命中 机器人多传感器融合 :multi-modal fusion(title);分类 cs.RO

AI总结 本文提出一种多模态融合方法,通过融合GNSS和惯性数据提升城市峡谷中行人定位精度,优于单独使用GNSS或惯性导航。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 融合架构与评测 1 篇

2601.22610 2026-02-02 cs.LG cs.AI 50%

Local-Global Multimodal Contrastive Learning for Molecular Property Prediction

局部-全局多模态对比学习用于分子性质预测

Xiayu Liu, Zhengyi Lu, Yunhong Liao, Chan Fan, Hou-biao Li

机构 * School of Mathematical Sciences(数学科学学院) University of Electronic Science and Technology of China(电子科技大学) Department of Computer Science and Engineer(计算机科学与工程系) Oakland University(奥克兰大学) Department of Electrical and Computer Engineering(电气与计算机工程系) College of Management Science(管理科学学院) Chengdu University of Technology(成都理工大学)

专题命中 融合架构与评测 :multimodal fusion(abstract)

AI总结 LGM-CL通过局部-全局多模态对比学习框架,整合分子结构和化学语义信息,提升分子性质预测的准确性与性能。

Comments 16 pages, 9 figures. Submitted to Briefings in Bioinformatics

详情

展开后加载摘要…

URL PDF HTML 收藏