CAST: Cross Attention based multimodal fusion of Structure and Text for materials property prediction
机构 * LG AI Research(LG人工智能研究)
专题命中 融合架构与评测 :multimodal fusion(title)
Comments 11 pages, 4 figures
视觉与机器人
面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。
机构 * LG AI Research(LG人工智能研究)
专题命中 融合架构与评测 :multimodal fusion(title)
Comments 11 pages, 4 figures
机构 * Xunguang Team, DAMO Academy, Alibaba Group(达摩院、阿里集团) ; Zhejiang University(浙江大学) ; Hupan Lab(虎盘实验室)
专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV
Comments 12 pages, 7 figures