Zero-Shot Fake Video Detection by Audio-Visual Consistency
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.MM、eess.AS
Comments to be published in INTERSPEECH 2024
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.MM、eess.AS
Comments to be published in INTERSPEECH 2024
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL、eess.AS
Comments Accepted at INTERSPEECH 2024
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.AI、eess.AS
Comments IEEE/ACM Transactions on Audio, Speech, and Language Processing, 2024. 14 pages, 7 figures. Dataset is available on: https://github.com/yufenhuang/MOSA-Music-mOtion-and-Semantic-Annotation-dataset/tree/main and https://zenodo.org/records/11393449
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.AI、eess.AS
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL、eess.AS
Comments Accepted by Interspeech 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM
Comments IJCV 2024 Accepted. arXiv admin note: substantial text overlap with arXiv:2303.02344
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CL、cs.AI
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.AI、eess.AS
Journal ref Expert Systems with Applications 249 (2024): 123640
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.AI
Comments Accepted to ICRA 2024
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments Accepted to CVPR 2024
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、eess.AS
Comments 13+1 pages, 2 figures, accepted at the Human Motion Generation workshop (HuMoGen) at CVPR 2024
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CL、eess.AS
Comments TASLP
Journal ref IEEE/ACM Transactions on Audio, Speech, and Language Processing, 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments Accepted to FG2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments Project page: https://vision.cs.utexas.edu/projects/active_rir/
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments Accepted to FG2024
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、eess.AS
Comments 10 pages, 4 figures, 6 tables, CVPRw 2024
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、eess.AS
Comments 15 pages
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.AI、eess.AS
Comments 5 pages, 3 figures Accepted at ICASSP 2024
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL、eess.AS
Comments Accepted for publication at LREC-COLING'24
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、eess.AS
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL、cs.AI
Comments Accepted in LREC-COLING 2024 - The 2024 Joint International Conference on Computational Linguistics, Language Resources and Evaluation
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、eess.AS
Comments arXiv admin note: text overlap with arXiv:2312.03632
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.AI
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments Accepted by The Twelfth International Conference on Learning Representations (ICLR) 2024, see https://openreview.net/forum?id=PEuDO2EiDr
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL