Speech and the n-Back task as a lens into depression. How combining both may allow us to isolate different core symptoms of depression
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS
Comments Submitted to Interspeech 2022
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS
Comments Submitted to Interspeech 2022
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.AI
专题命中 音频语音多模态 :any-to-any(abstract);分类 eess.AS
Comments Submitted to INTERSPEECH 2022
专题命中 音频语音多模态 :cross-modal(abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments Camera-ready, CVPR 2022. Code: https://github.com/zjsong/SSPL
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CL
Comments Accepted in the 19th International Conference on Natural Language Processing (ICON-2021)
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments submitted to ICIP 2022
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments Accepted by Multimedia Tools and Applications (2022); supplementary materials are in the latex sources
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments Accepted by ACL 2022
专题命中 音频语音多模态 :cross-modal(abstract);分类 eess.AS
Comments Accepted at ICASSP 2022
专题命中 音频语音多模态 :cross-modal(abstract);分类 eess.AS
Comments Submitted to Transactions on Multimedia. arXiv admin note: substantial text overlap with arXiv:2105.02192
Journal ref IEEE Transactions on Multimedia 2022
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
Comments submitted to LREC 2022
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments Submitted to IEEE TMI
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments Accepted by TASLP
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.AI
Comments This is the preprint version. The final version is published in Robotics and Autonomous Systems, Volume 139, 2021, Page 103536, ISSN 0921-8890, https://doi.org/10.1016/j.robot.2020.103536
Journal ref Robotics and Autonomous Systems, vol 139, page 103536, year 2021
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.MM
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments 23 pages, 13 figures
Journal ref Published in Neural Computing and Applications. Vol. 33, issue 23, June 2021, pp. 16033-16055
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL
Comments 47 pages
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
Comments 5 pages, 3 figures. Submitted to ICASSP 2022
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments 21 pages, 15 figures
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments Accepted by IEEE/ACM Transactions on Audio, Speech, and Language Processing (TASLP); Demos available at https://zzhang68.github.io/mcmf-adl-mvdr/
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments 7 pages (2 columns), 5 tables, 7 figures, submitted to ACM Multimedia 2020
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments Submitted to ICASSP 2022
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Journal ref 2021 IEEE Virtual Reality and 3D User Interfaces (VR) (pp. 835-844)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
Comments 34 pages, 14 figures, 1 table
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI