Detecting Audio-Visual Deepfakes with Fine-Grained Inconsistencies
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments Accepted in BMVC 2024
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments Accepted in BMVC 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CL、cs.MM、eess.AS
Comments Accepted by ISCSLP2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments Accepted by ICML 2024
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.AI、cs.MM、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI、eess.AS
Comments 5 pages, 3 Figures, Accept by Interspeech 2024
Journal ref Proceedings of Interspeech 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments ECCV 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments under review
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI、eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.AI、cs.MM、eess.AS
Comments Accepted by ECCV24 AVGenL Workshop
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CL、cs.AI、eess.AS
Comments Accepted to IEEE SLT 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.AI、cs.MM、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.MM、eess.AS
Comments Accepted at ISMIR 2024. Data: https://doi.org/10.5281/zenodo.12709974 Code: https://github.com/mulab-mir/muchomusic Supplementary material: https://mulab-mir.github.io/muchomusic
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.MM、eess.AS
Comments Accepted to TASLP
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments Accepted in ICIP 2024
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL、cs.MM、eess.AS
Comments Accepted at INTERSPEECH 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments Accepted by TIP
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments Interspeech 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.AI、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、eess.AS
Comments Interspeech 2024
专题命中 音频语音多模态 :audio-visual(title);multimodal(abstract);分类 cs.CV、cs.MM、eess.AS
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL、cs.AI、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI、eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments Accepted to Interspeech 2024
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、eess.AS
Comments 10 Pages, 3 figures, ACL 2024 Main
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.AI、cs.MM、eess.AS
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.AI、cs.MM、eess.AS
专题命中 音频语音多模态 :multimodal(title);multi-modal(abstract);分类 cs.CL、cs.MM、eess.AS
Comments Accepted by ICASSP 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments 24 pages
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.MM
Comments Ranked 3rd in SemEval '24 Task 3 with F1 of 0.3435, close to 1st & 2nd by 0.0339 & 0.0025
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.AI、eess.AS
Comments CVPR 2024 Highlight. 13 pages, 10 figures