AcousticFusion: Fusing Sound Source Localization to Visual SLAM in Dynamic Environments
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments Accepted by IROS-2021
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments Accepted by IROS-2021
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments 6 pages, 5 figures, planning to submit to IEEE TVCG Short papers at a future date
专题命中 音频语音多模态 :cross-modal(abstract);分类 eess.AS
Comments Accepted at INTERSPEECH 2021
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments The Interspeech Conference, 2021 (INTERSPEECH 2021)
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.MM
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV
Comments 5 pages(including references), 5 figures, Accepted in Interspeech 2021
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS
Comments First two authors contributed equally.Accepted by ICASSP 2021
Journal ref ICASSP,2021 pp. 3020-3024
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments Accepted to IROS 2019
Journal ref 2019 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments 18 pages. main paper: 8 pages; reference: 2 pages; supplementary material: 8 pages
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV
Comments Accepted at CVPR 2021
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments Published as an ECCV2020 paper
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS
专题命中 音频语音多模态 :cross-modal(abstract);分类 eess.AS
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments 5 pages, 2 figures, conference paper
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Comments Accepted to ICASSP 2021, 5 pages, 2 figures; Demos are available at https://zzhang68.github.io/adlmvdr/
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
Comments Accepted to AAAI 2021
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CV
Comments ICASSP 2020
专题命中 音频语音多模态 :any-to-any(abstract);分类 eess.AS
Comments Submitted to IEEE/ACM Transactions on Audio, Speech, and Language Processing
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
Journal ref Proceedings of the International Conference on New Interfaces for Musical Expression (2011) pp. 142-143
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Journal ref 2020 Second International Conference on Transdisciplinary AI (TransAI), pages 25-33
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
Comments Data set available on https://zenodo.org/record/4282267. Presented at GLU (Grounded Language Understanding) Satellite Workshop of Interspeech 2017
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
专题命中 音频语音多模态 :cross-modal(abstract);分类 cs.CL
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS