Leveraging per Image-Token Consistency for Vision-Language Pre-training
专题命中 图文多模态 :cross-modal(abstract);分类 cs.CV
Comments Accepted by CVPR 2023
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :cross-modal(abstract);分类 cs.CV
Comments Accepted by CVPR 2023
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments 15 pages, 5 figures
专题命中 图文多模态 :multi-modal(abstract);分类 cs.AI
Comments Preprint submitted to Information Fusion
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments Published at Transactions on Machine Learning Research
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments Accepted at BMVC 2023
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV
Comments 11 pages, 5 figures, 8 tables
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments 15pages, 10figures, ICCV2023
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments ICCV2023. Code: https://github.com/showlab/datacentric.vlp
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments ICCV 2023 Oral
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments ACM MM 2023
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments Accepted by ICCV 2023
专题命中 图文多模态 :cross-modal(abstract);分类 cs.CV
Comments to be appeared in ICCV2023
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments Accepted by ICCV 2023
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments submit to TPAMI
专题命中 图文多模态 :image-text(abstract);分类 cs.MM
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments MICCAI-2023
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV
Comments 16 pages, 9 figures
专题命中 图文多模态 :cross-modal(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments This article has been accepted by MICCAI 2023,but has not been fully edited. Content may change prior to final publication
专题命中 图文多模态 :image-text(abstract);分类 cs.CL
Comments Accepted to ACL 2023 as short paper
专题命中 图文多模态 :cross-modal(abstract);分类 cs.CV
Comments MICCAI 2023
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments Tech Report. Code is available at https://github.com/UCSC-VLAA/CLIPA
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments Dataset link: https://huggingface.co/datasets/tiange/Cap3D
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV