Text-Region Matching for Multi-Label Image Recognition with Missing Labels
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted to ACM International Conference on Multimedia (ACM MM) 2024
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted to ACM International Conference on Multimedia (ACM MM) 2024
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 cs.AI
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted in MICCAI-24
专题命中 跨模态检索 :cross-modal(abstract);image-text(abstract);分类 cs.CV
Comments The author has withdrawn this paper due to a critical definitional error in concept learning for global/local-interaction learning during training. This error led to an alignment issue with the definition of the text-video retrieval task, causing an unfair comparison with state-of-the-art (SOTA) methods. Consequently, this hindered the accurate evaluation of the paper's contributions
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
Comments Second Place of WSDM2023 Toloka Visual Question Answering Challenge
专题命中 跨模态检索 :multimodal(abstract);image-text(abstract);分类 cs.CV
专题命中 跨模态检索 :multimodal(abstract);multi-modal(abstract);分类 cs.CV
Comments 27 pages, 7 figures, 9 tables
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV
Comments 10 pages,4 figures
专题命中 跨模态检索 :multimodal(abstract);multi-modal(abstract);分类 cs.AI
Comments ICLR 2024 Spotlight Paper
专题命中 跨模态检索 :multi-modal(abstract);image-text(abstract);分类 cs.CV
专题命中 跨模态检索 :cross-modal(abstract);image-text(abstract);分类 cs.CV
专题命中 跨模态检索 :multimodal(abstract);multi-modal(abstract);分类 cs.CV
Comments Accepted to NeurIPS 2023. Webpage: https://cs-people.bu.edu/array/research/cola/
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
Comments NeurIPS 2023 Camera Ready
专题命中 跨模态检索 :multimodal(abstract);分类 cs.CV、cs.CL、cs.AI
Comments NeurIPS 2023. Code available at: https://github.com/pliang279/FactorCL
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
专题命中 跨模态检索 :multimodal(abstract);multi-modal(abstract);分类 cs.CV
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 eess.AS
Journal ref Proceedings of the 14th ACM Multimedia Systems Conference (MMSys '23), June 7-10, 2023, Vancouver, BC, Canada
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV
Comments This article has been accepted for publication in the IEEE International Joint Conference on Biometrics (IJCB), 2023
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 cs.CL
专题命中 跨模态检索 :multimodal(abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 跨模态检索 :multimodal(abstract);multi-modal(abstract);分类 cs.CV
专题命中 跨模态检索 :multimodal(abstract);image-text(abstract);分类 cs.CV
Comments CVPR 2023. Code and pretrained models are available at https://github.com/google-research/big_vision/blob/main/big_vision/configs/proj/clippo/README.md
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by IEEE Transactions on Pattern Analysis and Machine Intelligence
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 cs.CL
Comments 7 pages
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
Comments Published in EMNLP 2022
专题命中 跨模态检索 :cross-modal(abstract);image-text(abstract);分类 cs.CV
Comments 19 pages, 13 tables, 6 figures, Oral at NeuRIPS 2022
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted at IEEE/CVF Winter Conference on Applications of Computer Vision (WACV) 2023
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.MM
Comments Submitted to APPLIED SCIENCES
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV
专题命中 跨模态检索 :cross-modal(abstract);image-text(abstract);分类 cs.CV
Comments Accepted by SIGIR 2022