The DKU Post-Challenge Audio-Visual Wake Word Spotting System for the 2021 MISP Challenge: Deep Analysis
专题命中 音频语音多模态 :audio-visual(title);multimodal(abstract);分类 eess.AS
Comments Accepted by ICASSP 2023
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(title);multimodal(abstract);分类 eess.AS
Comments Accepted by ICASSP 2023
专题命中 音频语音多模态 :multimodal(title,abstract);分类 eess.AS
Comments This paper was accepted by ICASSP 2022
专题命中 音频语音多模态 :multimodal(title,abstract);分类 eess.AS
Comments Accepted by ACM Multimedia 2022. Camera ready version and appendix
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments Submitted to TPAMI as a journal extension of ECCV 2022. Jinxing Zhou, Xuyang Shen, and Jianyuan Wang contribute equally to this work. Meng Wang and Yiran Zhong are the corresponding authors. Code is available at https://github.com/OpenNLPLab/AVSBench. Online benchmark is available at http://www.avlbench.opennlplab.cn. arXiv admin note: substantial text overlap with arXiv:2207.05042
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments Accepted in AAAI 2023
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 eess.AS
Comments Completed in October 2020 and submitted to ICASSP2021
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments Accepted to TPAMI; Dataset and Code are available at https://github.com/jasongief/CPSP. arXiv admin note: substantial text overlap with arXiv:2104.00239
专题命中 音频语音多模态 :multimodal(title,abstract);分类 eess.AS
Comments Submitted to ICASSP 2023. GitHub repo: https://github.com/ldzhangyx/vis2mus
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 eess.AS
Comments 13 pages
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.AI
Comments 14 pages, 4 figures, 8 tables, 1 algorithm
专题命中 音频语音多模态 :multimodal(title,abstract);分类 eess.AS
Comments 32 Pages. This article has been submitted for review to a prestigious journal
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 eess.AS
Comments Accepted to IEEE SLT 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
Comments arXiv admin note: text overlap with arXiv:2101.05975
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL
Comments Findings of ACL 2022
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 eess.AS
Comments Presented at ICASSP 2022
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.AI
Comments 73 pages, 54 figures, master thesis
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL
Comments 19 pages, Under review at ACM IMWUT
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments Accepted in ACM-MM 2022, 10 pages, 6 pages supplementary, 18 Figures
专题命中 音频语音多模态 :multimodal(title,abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments Accepted by ECCV 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments Accepted to CVPR 2022
专题命中 音频语音多模态 :any-to-any(title,abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments 8 pages, 6 figures
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 eess.AS
Comments 5 pages, 9 figures, to be published in EUSIPCO 2022
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.AI
Comments ICLR 2022 (Oral)
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.MM
Comments Accepted for publication at ICWSM 2022 as a full paper
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV
Comments ACM Transactions on Multimedia Computing, Communications, and Applications (Acceptance 07-Oct-2021)