Divide and Conquer: Multimodal Video Deepfake Detection via Cross-Modal Fusion and Localization
分而治之:通过跨模态融合与定位实现多模态视频深度伪造检测
专题命中 视频多模态 :multimodal(title,abstract);cross-modal(title);audio-visual(abstract);分类 cs.MM
AI总结 本文提出一种通过跨模态融合与定位实现多模态视频深度伪造检测的系统,通过音频和视觉模块的融合提升检测鲁棒性。
Comments The 3rd Place, IJCAI 2025 Workshop on Deepfake Detection, Localization, and Interpretability