AV-Lip-Sync+: Leveraging AV-HuBERT to Exploit Multimodal Inconsistency for Deepfake Detection of Frontal Face Videos
AV-Lip-Sync+: 借助AV-HuBERT利用多模态不一致性的深度伪造检测方法
机构 * Social Networks and Human-Centered Computing Program, Taiwan International Graduate Program, Academia Sinica(学术.sinica.edu.tw 社会网络与人本计算计划,台湾国际研究生计划,台湾.sinica.edu.tw) ; Department of Computer Science, National Chengchi University(计算机科学系,国立政治大学) ; Institute of Information Systems and Applications, National Tsing Hua University(信息系统与应用研究所,国立清华大学) ; Research Center for Information Technology Innovation, Academia Sinica(资讯技术创新研究中心,学术.sinica.edu.tw) ; Institute of Information Science, Academia Sinica(资讯研究所,学术.sinica.edu.tw)
专题命中 音频语音多模态 :multimodal(title,abstract);audio-visual(abstract);分类 cs.CV、cs.AI、cs.MM
AI总结 本文提出AV-Lip-Sync+方法,利用AV-HuBERT和多模态不一致性检测深度伪造,实现对正面人脸视频的高精度检测。