Learning Embodied Semantics via Music and Dance Semiotic Correlations
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV、eess.AS
Comments 24 pages, 1 figure, 5 tables
Journal ref Neural Computing and Applications, vol. 33, pp. 14481-14493, 2021
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV、eess.AS
Comments 24 pages, 1 figure, 5 tables
Journal ref Neural Computing and Applications, vol. 33, pp. 14481-14493, 2021
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL、eess.AS
Comments Accepted to IJCNN 2021 for the Special Session on Representation Learning for Audio, Speech, and Music Processing
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV、cs.CL
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV、cs.AI
Comments NeurIPS 2021, additional results and code at https://yilundu.github.io/gem/
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CL、eess.AS
Comments Published in ICASSP 2021
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV、cs.MM
Comments IEEE Transactions of Visualization and Computer Graphics (TVCG, Proc. VIS 2021), to appear
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CL、eess.AS
Comments 4page + 1page for citation + 2 pages for appendix
专题命中 音频语音多模态 :any-to-any(abstract);分类 cs.CL、eess.AS
Comments Submitted to ICASSP 2022. Code available at: https://github.com/s3prl/s3prl/tree/master/s3prl/downstream/a2o-vc-vcc2020
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV、eess.AS
Comments total 21 pages: main paper 8 pages, references 3 pages, supplementary material 10 pages
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments Accepted at ACL 2019
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV、eess.AS
Comments To appear in Interspeech 2021. Data will be available from https://github.com/clovaai/lookwhostalking
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV、eess.AS
Comments The dataset will be available for download from http://www.robots.ox.ac.uk/~vgg/data/voxceleb/voxconverse.html . The development set will be released in July 2020, and the test set will be released in October 2020
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL、eess.AS
Journal ref ICASSP 2021 - 2021 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 2021, pp. 6269-6273
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.AI、eess.AS
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL、cs.MM
Comments 15 pages. A preprint version of a publication at IEEE Transactions on Visualization and Computer Graphics (TVCG), 2021
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.MM、eess.AS
Comments accepted for International Computer Music Conference (ICMC) 2021
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV、cs.MM
Comments 6 pages, 3 figures, 4 tables, paper accepted in CBMI 2021 for publication and oral presentation
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL、eess.AS
Comments INTERSPEECH 2021. arXiv admin note: substantial text overlap with arXiv:2106.09668
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.MM、eess.AS
Comments Extended abstract presented in CVPR 2021 Women in Computer Vision Workshop
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV、eess.AS
Comments Accepted for publication at Interspeech 2021
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CL、eess.AS
Comments Accepted to Interspeech 2021
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL、eess.AS
专题命中 音频语音多模态 :any-to-any(abstract);分类 cs.CL、eess.AS
Comments Accepted by IEEE/ACM Transactions on Audio, Speech and Language Processing
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI、eess.AS
Comments accepted by IROS2020
Journal ref 2020 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV、eess.AS
Comments Accepted by ICPR2020
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments Accepted by ICONIP 2020
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL、cs.AI
Comments arXiv admin note: text overlap with arXiv:1909.12289
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.MM、eess.AS