VLT: Vision-Language Transformer and Query Generation for Referring Segmentation
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV
Comments TPAMI
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV
Comments TPAMI
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV
Comments Published at IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CL
专题命中 图文多模态 :cross-modal(abstract);分类 cs.CV
专题命中 图文多模态 :cross-modal(abstract);分类 cs.CV
Comments Accepted by ECCV2022
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments Accepted by ECCV2022 for oral presentation
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments BMVC2022
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV
Comments The paper is accepted by the 33rd British Machine Vision Conference (BMVC 2022)
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV
Comments Published at NeurIPS 2022; Blog: https://ml-jku.github.io/cloob; GitHub: https://github.com/ml-jku/cloob
专题命中 图文多模态 :cross-modal(abstract);分类 cs.CV
Comments Accepted to ECCV 2022 (revise acknowledgement)
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments Accepted to NeurIPS 2022
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments Accepted at NeurIPS 2022; First two authors contributed equally; Includes Supplementary Material
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments Accepted at NeurIPS 2022
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments Code: https://github.com/Johnathan-Xie/ZSD-YOLO
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV
Comments 5 pages, 2 figures, report of PIC 4th Challenge Accepted by PIC'22 workshop
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments ECCV 2022
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments Accepted by the 30th ACM International Conference on Multimedia (ACM MM 2022)
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments preprint
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments 12 pages, 5 figures
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments ECCV 2022 camera-ready version
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(abstract);分类 cs.CL
Comments Published in Journal of Artificial Intelligence Research (JAIR)
Journal ref Journal of Artificial Intelligence Research (JAIR), 2022, vol. 74, pp. 1201-1223
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV
Comments 18 pages, 7 figures
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV
Comments arXiv admin note: text overlap with arXiv:2104.08541
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV
Comments Under Submission