Visually-aware Acoustic Event Detection using Heterogeneous Graphs
专题命中 视频多模态 :multimodal(abstract);分类 cs.MM、eess.AS
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 视频多模态 :multimodal(abstract);分类 cs.MM、eess.AS
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments 4 pages, 3 figures, technical report for track3 of CVPR 2022 LOVEU challenge
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.MM
Comments 4 pages, 2 figures
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.CL
Comments Updated vIoU results compared to the CVPR'22 camera-ready version; 17 pages; 8 figures
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.MM
Comments Accepted by CVPR 2022
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.MM
Comments accepted by IJCAI-22, Codes are available at https://github.com/shuoyang129/EAMAT
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments Accepted by IJCAI 2022. arXiv admin note: text overlap with arXiv:2109.04735
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.CL
Comments Submitted to IEEE TMM; Code is available at https://github.com/ZiyueWu59/CCA
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
专题命中 视频多模态 :audio-visual(abstract);分类 cs.CV、cs.AI
Comments To appear in the Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2022. This version updates the baseline result numbers for the Hands and Objects benchmark (appendix)
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments 7 pages (main), 10 pages (appendix) and to be appeared in AAAI2022
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.MM
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments Accepted by TPAMI in Dec 2021; extension of NeurIPS2020 Blind Video Temporal Consistency via Deep Video Prior. arXiv admin note: substantial text overlap with arXiv:2010.11838
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments 30 pages (Accepted in ACM Computing Surveys December 2021)
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.MM
Comments AAAI 2022 Camera Ready Version
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.CL
Comments Accepted by EMNLP-21
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、eess.AS
Comments ISMIR 2021 Late Breaking/Demo
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.CL
Comments 13 pages, 6 figures, 11 tables
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.MM
Comments Accepted by TOMM
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.CL
Comments Appears in: British Machine Vision Conference 2021 (BMVC 2021)
专题命中 视频多模态 :multimodal(abstract);分类 cs.CL、cs.MM
Comments JT and LS contributed equally to this work
专题命中 视频多模态 :audio-visual(abstract);分类 cs.CV、eess.AS
Comments 8 pages, 6 figures
Journal ref Proceedings of the International Conference on Pattern Recognition (ICPR2020)
专题命中 视频多模态 :image-text(abstract);分类 cs.CV、cs.CL
Comments 3 pages, 1 figure, 2 tables. Technical report
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
专题命中 视频多模态 :multimodal(abstract);分类 cs.CL、cs.AI
Comments Contains main article and supplementaries
Journal ref Neurips 2021
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.CL
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.MM
Comments To be presented at EMNLP 2021 findings
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.CL
Comments Accepted as a long paper in the main conference of EMNLP 2021
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments Accepted at EMNLP 2021
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments Accepted to EPIC@ICCV 2021