On Negative Sampling for Audio-Visual Contrastive Learning from Movies
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments arXiv admin note: substantial text overlap with arXiv:2106.08513
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments arXiv admin note: substantial text overlap with arXiv:2106.08513
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.MM
Comments 7 pages, 4 figures, accepted at IJCAI 2022
专题命中 音频语音多模态 :audio-visual(title);multimodal(abstract);分类 eess.AS
Comments Accepted to ICASSP 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments Accepted at WACV 2022. arXiv admin note: substantial text overlap with arXiv:2106.01689
专题命中 音频语音多模态 :multimodal(title,abstract);分类 eess.AS
Comments tinyML Research Symposium 2022
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL
Comments Submitted to Nature Scientific Data
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CV
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL
Comments 116 pages; Cross-posted to PsyArxiv; To request data access, go to https://betterup-data-requests.herokuapp.com/
专题命中 音频语音多模态 :any-to-any(title,abstract);分类 eess.AS
Comments Published at ICASSP 2022
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.MM
Comments 29 pages. arXiv admin note: substantial text overlap with arXiv:2105.11087
Journal ref ACM Transactions on Multimedia Computing, Communications, and Applications 2022
专题命中 音频语音多模态 :multimodal(title,abstract);分类 eess.AS
Comments arXiv admin note: substantial text overlap with arXiv:2108.02510
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV
Journal ref 27th International Conference on Intelligent User Interfaces (IUI '22), March 22--25, 2022, Helsinki, Finland
专题命中 音频语音多模态 :multimodal(title,abstract);分类 eess.AS
Comments 5 pages, 4 figures, and 3 tables
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
专题命中 音频语音多模态 :cross-modal(title);multimodal(abstract);分类 eess.AS
Comments Accepted for publication at IEEE ICASSP 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CV
Comments Oral Presentation at NeurIPS 21 Datasets and Benchmarks Track. Project page: http://www.threedworld.org
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments Accepted by AAAI 2022
Journal ref AAAI 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
Comments Accepted publication in Proceedings of 3DA 2021 International Conference on Immersive and 3D Audio
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV
Comments Published at IEEE Transactions on Pattern Analysis and Machine Intelligence journal
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV
Comments Published at Pattern Analysis and Applications journal
专题命中 音频语音多模态 :multimodal(title,abstract);分类 eess.AS
Comments Ph.D. dissertation. Thesis supervisor: Geoffroy Peeters. Jury:Laurent Girin, Gaël Richard, Rachel Bittner, Elena Cabrio, Bruno Gas, Perfecto Herrera Boyer, Antoine Liutkus
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments Submitted to IJCV
专题命中 音频语音多模态 :any-to-any(title,abstract);分类 eess.AS
Comments 5 pages, 2 figures
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments 7 pages, 2 figures, 4 tables. A draft for a paper accepted to ASRU workshop
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.AI
Comments The 2021 Conference on Empirical Methods in Natural Language Processing