Audio-Visual Target Speaker Enhancement on Multi-Talker Environment using Event-Driven Cameras
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
Comments Accepted at ISCAS 2021
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
Comments Accepted at ISCAS 2021
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
Comments accepted by ICASSP 2021
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
Comments Accepted at ICASSP 2021
专题命中 音频语音多模态 :audio-visual(title);multi-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments 8 pages
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
Comments Submitted to IEEE/ACM Transactions on Audio, Speech, and Language Processing
Journal ref IEEE/ACM Transactions on Audio, Speech and Language Processing, 28, 2020
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CV
Comments Code: https://github.com/v-iashin/CORSMAL Docker: https://hub.docker.com/r/iashin/corsmal
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.MM
Comments 5 pages
Journal ref 15th Sound and Music Computing Conference (SMC2018)
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 eess.AS
Comments 8 pages, 2 figures
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments To appear at Advances in Neural Information Processing Systems (NeurIPS), 2020
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL
Comments To appear in Interspeech,2020
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL
Comments Accepted to NLP Beyond Text workshop, EMNLP 2020
专题命中 音频语音多模态 :audio-visual(title);multi-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :multimodal(title);multi-modal(abstract);分类 cs.CV
Comments 8 pages, 4 figures
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL
Comments Accepted to Findings of EMNLP 2020
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.AI
Comments The paper content has one major problem in a section that is needs more attention and some work, and is agreed by all authors. The change is necessary in terms of correctness and completeness of the paper. Hence, requesting for the withdrawal to allow for the changes
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL
Comments Published at LREC's Workshop on Legal and Ethical Issues in Human Language Technologies 2020
Journal ref LREC Workshop on Legal and Ethical Issues in Human Language Technologies (2020) 15-20
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV
Comments 8 pages, 6 figures, 2 tables, accepted at 2020 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2020)
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments Accepted in ICASSP 2019
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV
Comments The 24th International Conference on Image Processing, Computer Vision, & Pattern Recognition (IPCV'20: July 27-30, 2020, USA)
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL
Comments AAAI DSTC8 Workshop
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 eess.AS
Comments 5 pages, 1 figure. Submitted to INTERSPEECH2020
专题命中 音频语音多模态 :multimodal(title);audio-visual(abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments IJCAI-2020
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV
Comments Under Review on Transaction on Multimedia
专题命中 音频语音多模态 :multimodal(title,abstract);分类 eess.AS
Comments arXiv admin note: text overlap with arXiv:1811.09362 by other authors