Reweighting Framewise Attention in Video Transformers for Facial Expression Understanding
视频Transformer中重加权帧级注意力用于面部表情理解
机构 * Inria, Université Côte d’Azur, France(法国国家信息与自动化研究所、法国滨海阿尔卑斯大学) ; Hanyang University, South Korea(韩国家阳大学) ; Pusan National University, South Korea(韩国釜山国立大学)
AI总结 提出MiRA框架,通过重加权帧级注意力增强ViT对细微面部动态的时空选择性,无需额外参数,在表情识别基准上持续提升性能。
Comments ECCV 2026