A New Perspective on Smiling and Laughter Detection: Intensity Levels Matter
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
Journal ref In 2022 10th International Conference on Affective Computing and Intelligent Interaction (ACII) (pp. 1-8). IEEE
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
Journal ref In 2022 10th International Conference on Affective Computing and Intelligent Interaction (ACII) (pp. 1-8). IEEE
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS
Comments ICASSP2024 accepted
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.MM
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments Accepted at the 2024 Joint International Conference on Computational Linguistics, Language Resources and Evaluation (LREC-COLING)
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments Accepted at ICLR 2024. Code, dataset, and models are available at https://github.com/YuanGongND/ltu. The interactive demo is at https://huggingface.co/spaces/yuangongfdu/ltu
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Journal ref A. Vazquez-Romero and A. Gallardo-Antolin Entropy 22, no. 6: 688 (2020)
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments 10 pages, in Spanish, Tecniacústica
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
Comments Australasian Conference on Robotics and Automation (ACRA). 2023
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.AI
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Journal ref 16th International Symposium on CMMR, Future University Hakodate, Japan; Asia University, Japan; Nihon University, Japan; Laboratoire PRISM, Marseille, France, Nov 2023, Tokyo, France
专题命中 音频语音多模态 :any-to-any(abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
专题命中 音频语音多模态 :any-to-any(abstract);分类 eess.AS
Comments AAAI 2024 Demo, Codes: https://phonemehallucinator.github.io/
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments Accepted at ICASSP 2024
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
Comments 10 pages, 8 figures, SENTIRE'23 (ICDM 2023)
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV
Comments Accepted to WACV 2024
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments Our code is available at https://github.com/talreiss/FACTOR
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments To be published in 37th Conference on Neural Information Processing Systems
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments accepted at Interspeech 2023
Journal ref Proceedings of Interspeech 2023
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments Accepted at ACMM 2023
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments Accepted in BMVC 2023, 10 pages paper, 7 pages supplementary, 7 Figures
专题命中 音频语音多模态 :any-to-any(abstract);分类 eess.AS
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV
Comments Accepted by ICCV2023
专题命中 音频语音多模态 :cross-modal(abstract);分类 eess.AS
Comments In Proceedings of the 24th Conference of the International Society for Music Information Retrieval (ISMIR 2023), Milan, Italy