A Perceptual Measure for Evaluating the Resynthesis of Automatic Music Transcriptions
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments Accepted by Multimedia Tools and Applications (2022); supplementary materials are in the latex sources
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments Accepted by Multimedia Tools and Applications (2022); supplementary materials are in the latex sources
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments Accepted by ACL 2022
专题命中 音频语音多模态 :cross-modal(abstract);分类 eess.AS
Comments Accepted at ICASSP 2022
专题命中 音频语音多模态 :cross-modal(abstract);分类 eess.AS
Comments Submitted to Transactions on Multimedia. arXiv admin note: substantial text overlap with arXiv:2105.02192
Journal ref IEEE Transactions on Multimedia 2022
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
Comments submitted to LREC 2022
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments Submitted to IEEE TMI
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments Accepted by TASLP
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.AI
Comments This is the preprint version. The final version is published in Robotics and Autonomous Systems, Volume 139, 2021, Page 103536, ISSN 0921-8890, https://doi.org/10.1016/j.robot.2020.103536
Journal ref Robotics and Autonomous Systems, vol 139, page 103536, year 2021
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.MM
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments 23 pages, 13 figures
Journal ref Published in Neural Computing and Applications. Vol. 33, issue 23, June 2021, pp. 16033-16055
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL
Comments 47 pages
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
Comments 5 pages, 3 figures. Submitted to ICASSP 2022
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments 21 pages, 15 figures
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments Accepted by IEEE/ACM Transactions on Audio, Speech, and Language Processing (TASLP); Demos available at https://zzhang68.github.io/mcmf-adl-mvdr/
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments 7 pages (2 columns), 5 tables, 7 figures, submitted to ACM Multimedia 2020
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments Submitted to ICASSP 2022
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Journal ref 2021 IEEE Virtual Reality and 3D User Interfaces (VR) (pp. 835-844)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
Comments 34 pages, 14 figures, 1 table
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments Accepted by IROS-2021
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments 6 pages, 5 figures, planning to submit to IEEE TVCG Short papers at a future date
专题命中 音频语音多模态 :cross-modal(abstract);分类 eess.AS
Comments Accepted at INTERSPEECH 2021
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments The Interspeech Conference, 2021 (INTERSPEECH 2021)
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.MM
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV
Comments 5 pages(including references), 5 figures, Accepted in Interspeech 2021
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS