LipSound2: Self-Supervised Pre-Training for Lip-to-Speech Reconstruction and Lip Reading
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.AI、eess.AS
Comments ACCEPTED IN IEEE Transactions on Neural Networks and Learning Systems
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.AI、eess.AS
Comments ACCEPTED IN IEEE Transactions on Neural Networks and Learning Systems
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV、eess.AS
Comments submitted to GCPR 2021
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL、cs.AI
Comments This is a preprint of an article published in "Journal of Computational Social Science". The final authenticated version is available online at: https://doi.org/10.1007/s42001-022-00178-4
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL、cs.AI
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CL、cs.AI
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CL、eess.AS
Comments To appear in ISMIR 2022
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CL、eess.AS
Comments Accepted to ISMIR 2022
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL、eess.AS
Comments This work has been submitted to the ACM TALLIP for possible publication
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.AI、eess.AS
Comments Accepted at PeerJ Computer Science
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV、eess.AS
Comments accepted to INTERSPEECH 2022 (Oral Presentation)
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.AI、eess.AS
Comments 8 pages, 8 figures. v2: IJCAI2022 published, format revisions and bugfixes
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV、eess.AS
Comments Dataset and code at https://github.com/L-YeZhu/D2M-GAN
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV、cs.MM
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.AI、eess.AS
Comments Accepted to Interspeech 2022
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CL、eess.AS
Comments 5 pages, 3 figures, Accepted for INTERSPEECH2022
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.MM、eess.AS
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL、cs.AI
Comments Semeval 2022, Task 5 submission 8 pages, 3 figures
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CL、eess.AS
Comments Accepted by ACL 2022 main conference
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.MM、eess.AS
Comments Accepted at International Computer Music Conference (ICMC) 2022
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CL、eess.AS
Comments Accepted by AAAI 2021, 11 pages, 3 figures, 13 tables
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI、eess.AS
Comments Accepted by ICASSP 2022
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL、eess.AS
Comments Submitted to Interspeech 2022
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV、cs.MM
Comments 10 pages, 7 figures, under review
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.AI、eess.AS
Comments accepted by ICASSP 2022
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.AI、eess.AS
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.AI、eess.AS
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI、eess.AS
Comments 5 pages, 4 figures, 2 tables, ICASSP 2022
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.MM、eess.AS
Comments IEEE MMSP 2021 - ERRATUM
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.MM、eess.AS
Comments Manuscript submitted for review to IEEE Transactions on Affective Computing