A Review of Deep Learning Techniques for Speech Processing
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
Comments under review
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments This paper will be published in CVPRW 2023
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.MM
Comments IEEE Multimedia (Accepted)
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL
Comments Accepted at AAAI 2023 AI for Social Good
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments ICLR 2023. Code: https://github.com/ahaliassos/raven
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
Comments Preliminary video demo: https://youtu.be/gJbxG9QlcUU
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS
Comments Copyright 2023 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
Comments 9th AAAI Conference on Human Computation and Crowdsourcing (HCOMP 2021), Blue Sky Ideas track
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments 5 pages. Accepted at ICASSP2023
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments 10 pages, 7 figures, CVPR2023 accepted
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.AI
Comments accepted for publication in the International Journal of Social Robotics
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments Accepted by ICASSP2023
专题命中 音频语音多模态 :any-to-any(abstract);分类 eess.AS
Comments ICASSP 2023 (Accepted)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
专题命中 音频语音多模态 :any-to-any(abstract);分类 eess.AS
Comments Published as a conference paper at ICASSP 2023
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments Proceedings edited by Jorge Calvo-Zaragoza, Jan Hajič jr. and Alexander Pacha
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV
Comments arXiv admin note: substantial text overlap with arXiv:2108.06720
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
Comments New Gener. Comput. (2020)
Journal ref New Generation Computing, 2020, volume 38, 23--48
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.AI
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments Proceedings edited by Jorge Calvo-Zaragoza and Alexander Pacha
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments Proceedings edited by Jorge Calvo-Zaragoza and Alexander Pacha
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.AI
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments CVPR 2022
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.AI
专题命中 音频语音多模态 :any-to-any(abstract);分类 eess.AS
Comments Accepted to IEEE Journal of Selected Topics in Signal Processing. arXiv admin note: substantial text overlap with arXiv:2110.06280