Patch as Node: Human-Centric Graph Representation Learning for Multimodal Action Recognition
补丁作为节点:面向多模态动作识别的人本图表示学习
专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV
AI总结 本文提出PAN框架,通过人本图表示学习提升多模态动作识别性能,结合双路径和统一网络结构实现高效融合。
视觉与机器人
面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。
补丁作为节点:面向多模态动作识别的人本图表示学习
专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV
AI总结 本文提出PAN框架,通过人本图表示学习提升多模态动作识别性能,结合双路径和统一网络结构实现高效融合。
GPF-Net:门控渐进融合学习用于息肉重识别
机构 * Shanghai Jiao Tong University(上海交通大学) ; Peking University(北京大学) ; Shanghai Fifth People's Hospital(上海第五人民医院)
专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV
AI总结 GPF-Net通过门控渐进融合学习提升息肉重识别性能,结合多模态融合策略优于现有单模态模型。
Comments Work in progress
通过信息分解实现可解释的多模态回归
机构 * Zhejiang University(浙江大学) ; Georgia Institute of Technology(佐治亚理工学院) ; Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) ; UiT - The Arctic University of Norway(挪威北极大学)
专题命中 融合架构与评测 :multimodal fusion(abstract)
AI总结 本文提出基于部分信息分解的多模态回归框架,通过分解模态特定表示为唯一、冗余和协同组件,提升预测准确性和可解释性,并在多个数据集上验证其有效性。
Comments Project Page: https://github.com/zhaozhaoma/PIDReg
CEMG: 基于协作增强的多模态生成推荐
专题命中 融合架构与评测 :multimodal fusion(abstract)
AI总结 CEMG通过多模态融合层和残差量化变分自编码器,提升多模态生成推荐的性能。