arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-02-18 至 2026-02-18 共收录 2 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 医学影像融合 1 篇

2602.15346 2026-02-18 cs.CV 57%

Effective and Robust Multimodal Medical Image Analysis

高效且鲁棒的多模态医学图像分析

Joy Dhar, Nayyar Zaidi, Maryam Haghighat

机构 * Indian Institute of Technology Ropar(印度理工学院罗帕尔分校) Deakin University(德克萨斯大学) Queensland University of Technology(昆士兰理工大学)

专题命中 医学影像融合 :multimodal fusion(abstract);分类 cs.CV

AI总结 本文提出MAIL网络,通过高效残差学习和多模态交叉注意力模块,提升多模态医学图像分析的效率与鲁棒性,实现实验性能提升9.34%并降低计算成本78.3%。

Comments Accepted at Proceedings of the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人多传感器融合 1 篇

2602.15543 2026-02-18 cs.RO 57%

Selective Perception for Robot: Task-Aware Attention in Multimodal VLA

机器人选择性感知:多模态VLA中的任务感知注意力

Young-Chae Son, Jung-Woo Lee, Yoon-Ji Choi, Dae-Kwan Ko, Soo-Chul Lim

机构 * Dongguk University(东国大学)

专题命中 机器人多传感器融合 :information fusion(abstract);分类 cs.RO

AI总结 本文提出了一种动态信息融合框架,通过任务感知注意力提升机器人多模态VLA模型的效率与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏