Speech inpainting: Context-based speech synthesis guided by video
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.AI、eess.AS
Comments Accepted in Interspeech23
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.AI、eess.AS
Comments Accepted in Interspeech23
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL、eess.AS
Comments Proceedings of the 18th Workshop on Innovative Use of NLP for Building Educational Applications (BEA) at ACL 2023
专题命中 音频语音多模态 :any-to-any(abstract);分类 cs.CL、eess.AS
Comments 5 page, 1 table, 2 figures. Accepted at Interspeech 2023
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CL、eess.AS
Comments Working in progress
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL、eess.AS
Comments 5 pages, 4 figures
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV、cs.MM
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV、eess.AS
Comments Code, data, and listening examples: https://github.com/francesclluis/points2sound
Journal ref EURASIP Journal on Audio, Speech, and Music Processing 2022 (1), 1-15
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CL、eess.AS
Comments ACL 2023 main conference
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL、eess.AS
Comments Journal Pre-print (15 Pages, 9 Figures, 3 Tables)
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV、eess.AS
Comments Accepted to CVPR 2023
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL、eess.AS
Comments Accepted by ICASSP 2023
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV、cs.AI
Comments accepted by CVPR 2023
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV、eess.AS
Comments CVPR 2023
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV、eess.AS
Comments Accepted by IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2023. 10 pages, 3 figures
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL、cs.AI
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CL、eess.AS
Comments 11 pages, 2 tables
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL、cs.AI
Comments 44 pages, 15 figures
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL、eess.AS
Comments 5 pages, conference
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL、eess.AS
Comments Accpeted to ICLR 2023
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV、eess.AS
Comments ICASSP 2023. Project page: https://facetts.github.io
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.MM、eess.AS
Comments Accepted by ICASSP 2023
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV、eess.AS
Comments ECCV 2022
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments Computer Speech & Language (Accepted)
Journal ref Computer Speech & Language (Volume: 79, April 2023)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL、eess.AS
Comments Accepted by the Creative AI Across Modalities workshop at AAAI 2023
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.MM、eess.AS
Comments 6 pages, 2 figures, accepted and presented at the 2022 14th International Conference on Quality of Multimedia Experience (QoMEX). Database is publicly accessible at https://qoevave.github.io/database/
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.MM、eess.AS
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV、eess.AS
Comments Proceedings edited by Jorge Calvo-Zaragoza, Alexander Pacha and Elona Shatri
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL、eess.AS