Multi-Track Multimodal Learning on iMiGUE: Micro-Gesture and Emotion Recognition
多轨多模态学习于iMiGUE:微手势与情绪识别
机构 * Russian - Armenian University(俄罗斯-亚美尼亚大学) ; Sber AI Lab(Sber AI实验室) ; HSE University(俄罗斯高等经济大学) ; Innopolis University(Innopolis大学) ; ISP RAS Research Center for Trusted Artificial Intelligence(俄罗斯科学院可信人工智能研究中心)
专题命中 视频多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
AI总结 本文提出多模态框架,利用视频和骨骼姿态数据实现微手势识别和基于行为的情绪预测,通过交叉模态融合模块提升鲁棒性和准确性。