VLCDoC: Vision-Language Contrastive Pre-Training Model for Cross-Modal Document Classification
专题命中 图文多模态 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CV
Comments Accepted at PR
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CV
Comments Accepted at PR
专题命中 图文多模态 :multi-modal(title,abstract);multimodal(abstract);分类 cs.CL
Comments Accepted to ACL 2023 Main Conference
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
Comments Accepted at CVPR-2023. Codes/models available at https://github.com/TalalWasim/Vita-CLIP
专题命中 图文多模态 :multi-modal(title,abstract);multimodal(abstract);分类 cs.CV
Comments Accepted at CVPR2023
专题命中 图文多模态 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments Accepted by CVPR 2023
专题命中 图文多模态 :multimodal(title,abstract);vision-language-audio(abstract);分类 cs.CV
Comments Accepted by AAAI2023
专题命中 图文多模态 :image-text(title,abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by ICLR 2023
专题命中 图文多模态 :multi-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments AAAI 2023 (Oral presentation paper). Updated version
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(title,abstract);cross-modal(abstract);分类 cs.AI
Comments Accpted by IJCAI'2022 survey track
专题命中 图文多模态 :image-text(title,abstract);cross-modal(abstract);分类 cs.CV
Comments arXiv admin note: text overlap with arXiv:2201.11307
Journal ref WACV2023
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multi-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments Accepted at ECCV 2022
专题命中 图文多模态 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments 9 pages, 7 figures
专题命中 图文多模态 :multimodal(title,abstract);multi-modal(abstract);分类 cs.CV
Comments 14 pages, 4 figures
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CL
Comments 9 pages, 8 figures including appendix figure, 2 tables. Published in Findings of ACL workshop, CONSTRAINT 2022 (Long paper). The manuscript is slightly revised after the camera ready version
专题命中 图文多模态 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments Accepted to CVPR 2022
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
Comments Accepted at the IEEE International Symposium on Biomedical Imaging (ISBI) 2022 as an oral presentation
专题命中 图文多模态 :cross-modal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted by 2021 ACMMM Open Source Software Competition. Source code: https://github.com/YehLi/xmodaler
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CL
Comments 10 pages, 4 figures
专题命中 图文多模态 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments 12 pages, 1 figure, 7 tables
专题命中 图文多模态 :image-text(title,abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by IJCAI 2021
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments This paper is accepted by ACM International Conference on Multimedia Retrieval (ICMR), 2021
专题命中 图文多模态 :image-text(title,abstract);multi-modal(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments accepted by AAAI-2020. arXiv admin note: text overlap with arXiv:1909.11740 by other authors
专题命中 图文多模态 :cross-modal(title,abstract);image-text(abstract);分类 cs.MM
专题命中 图文多模态 :image-text(title,abstract);cross-modal(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(title,abstract);multimodal(abstract);分类 cs.CL
Comments 7 pages
Journal ref 2019 Annual Conference of the North American Chapter of the Association for Computational Linguistics