Towards Generalizable Deepfake Detection via Forgery-aware Audio-Visual Adaptation: A Variational Bayesian Approach
面向可泛化的深度伪造检测的伪造感知音频视觉适应:一种变分贝叶斯方法
机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) ; Department of New Networks, Pengcheng Laboratory(鹏城实验室网络部) ; School of Cyber Science and Technology, Sun Yat-sen University(中山大学网络安全科学与技术学院) ; School of Computer Science and Cyber Engineering, Guangzhou University(广州大学计算机科学与网络工程学院) ; School of Cyberspace Science, Harbin Institute of Technology(哈尔滨工业大学网络空间科学学院)
AI总结 本文提出基于变分贝叶斯的伪造感知音频视觉适应方法,通过估计音频视觉相关性来提升深度伪造检测的泛化能力。
Comments TIFS AQE