Enhancing Speaker Diarization with Large Language Models: A Contextual Beam Search Approach
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS
Comments 4 pages 1 reference page, ICASSP format
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS
Comments 4 pages 1 reference page, ICASSP format
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Journal ref in IEEE Transactions on Pattern Analysis and Machine Intelligence, vol. 45, no. 9, pp. 10745-10759, 1 Sept. 2023
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments 2023 IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW)
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV
Comments TCSVT 2022
Journal ref IEEE Transactions on Circuits and Systems for Video Technology (Volume: 33, Issue: 3, March 2023)
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CL
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments Accepted by 19th International Conference on Advanced Data Mining and Applications. (ADMA 2023)
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments Under review
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV
Comments Accepted by ICCV 2023. Project page: https://fictionarry.github.io/ER-NeRF/
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.MM
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments Published as conference paper at the 35th Conference on Neural Information Processing Systems (NeurIPS 2021) Track on Datasets and Benchmarks
Journal ref 2021, Thirty-fifth Conference on Neural Information Processing Systems Datasets and Benchmarks Track
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
Comments Accepted by ICCV 2023
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments Technical Report
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CL
专题命中 音频语音多模态 :any-to-any(abstract);分类 eess.AS
Comments INTERSPEECH 2023, Oral
专题命中 音频语音多模态 :cross-modal(abstract);分类 eess.AS
Comments Submit to TASLP
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS
Comments 12 pages, 9 figures
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.AI
专题命中 音频语音多模态 :cross-modal(abstract);分类 eess.AS
Comments 5 pages, accepted at the International Conference on Acoustics, Speech, and Signal Processing (ICASSP) 2023
Journal ref ICASSP 2023 - 2023 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), Rhodes Island, Greece, 2023, pp. 1-5
专题命中 音频语音多模态 :cross-modal(abstract);分类 eess.AS
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
Comments under review
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments This paper will be published in CVPRW 2023
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.MM
Comments IEEE Multimedia (Accepted)
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL
Comments Accepted at AAAI 2023 AI for Social Good
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS