Speaker Identification from emotional and noisy speech data using learned voice segregation and Speech VGG
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments Journal
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments Journal
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments Accepted to IWAENC 2022
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
Comments Uncertainty in Artificial Intelligence (UAI) 2022 13 pages, 4 figures
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments 13 pages;in submission
专题命中 音频语音多模态 :any-to-any(abstract);分类 eess.AS
Comments Accepted by Interspeech 2022
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.AI
Journal ref 2021 9th International Conference on Affective Computing and Intelligent Interaction Workshops and Demos (ACIIW)
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments 13 pages,56 figures, 5 tables. Used 12 data sets and 5 state-of-the-art models for comparison
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments Accepted by Neural Networks journal
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments 23 pages, 8 figures. Submitted to Sustainability
Journal ref MDPI Sustainability. 2022; 14(12):7485
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments Accepted by Interspeech2022
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
Comments Accepted by KDD 2022, ADS track
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
Comments 5 pages, 2 figures, 2 tables
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.MM
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CL
Comments Accepted at CLIC-it 2021
Journal ref Italian Conference on Computational Linguistics 2021
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
专题命中 音频语音多模态 :any-to-any(abstract);分类 eess.AS
Comments To appear in the proceedings of ICASSP 2022, equal contribution from first two authors
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
Comments To be published in 2022 Americas Conference on Information Systems
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS
Comments Submitted to INTERSPEECH 2022
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments Published at AAAI 2022
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS
Comments Submitted to Interspeech 2022
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.AI
专题命中 音频语音多模态 :any-to-any(abstract);分类 eess.AS
Comments Submitted to INTERSPEECH 2022
专题命中 音频语音多模态 :cross-modal(abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments Camera-ready, CVPR 2022. Code: https://github.com/zjsong/SSPL
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CL
Comments Accepted in the 19th International Conference on Natural Language Processing (ICON-2021)
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments submitted to ICIP 2022