CustomContrast: A Multilevel Contrastive Perspective For Subject-Driven Text-to-Image Customization
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV、cs.MM
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV、cs.MM
专题命中 跨模态检索 :multi-modal(abstract);omni-modal(abstract);分类 cs.CL、cs.AI
Comments 35 pages
专题命中 跨模态检索 :multimodal(abstract);MLLM(abstract);分类 cs.CV、cs.CL
Comments 16 pages, 14 figures
专题命中 跨模态检索 :multimodal(abstract);MLLM(abstract);分类 cs.CL、cs.AI
专题命中 跨模态检索 :multimodal(abstract);image-text(abstract);分类 cs.CV、cs.AI
Comments Paper accepted at WACV 2025 in round 1
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV、cs.AI
Comments to be published in BMVC 2024 Proceedings
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV、cs.AI
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 cs.AI、cs.MM
Comments 10 pages, 7 figures
专题命中 跨模态检索 :cross-modal(abstract);image-text(abstract);分类 cs.CV、cs.AI
Comments To appear at SIGIR 2024. arXiv admin note: text overlap with arXiv:2309.02169
专题命中 跨模态检索 :cross-modal(abstract);image-text(abstract);分类 cs.CV、cs.AI
Comments The architecture of our model changes, hence methodolgy and experiments changes a lot, We have significantly revised the original manuscript of the paper, so a withdraw of our original script is needed
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CL、cs.AI
Comments 50 pages, 3 figures, 3 tables
专题命中 跨模态检索 :multimodal(abstract);multi-modal(abstract);分类 cs.CV、cs.AI
Comments 10 pages, 6 figures
专题命中 跨模态检索 :cross-modal(abstract);image-text(abstract);分类 cs.CV、cs.AI
Comments Accepted by ICCV2023
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV、cs.MM
Comments Accepted at CVPR 2023
专题命中 跨模态检索 :cross-modal(abstract);image-text(abstract);分类 cs.CV、cs.CL
专题命中 跨模态检索 :multimodal(abstract);image-text(abstract);分类 cs.CV、cs.CL
Comments EMNLP 2022
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV、cs.AI
Comments Accepted for presentation at International Conference on Multimedia Retrieval (ICMR '22)
专题命中 跨模态检索 :multimodal(abstract);image-text(abstract);分类 cs.CV、cs.CL
Comments Accepted by ICLRW2022
专题命中 跨模态检索 :multi-modal(abstract);image-text(abstract);分类 cs.CV、cs.CL
专题命中 跨模态检索 :multi-modal(abstract);image-text(abstract);分类 cs.CV、cs.AI
Comments Surgan Jandial, Pinkesh Badjatiya, Pranit Chawla, and Ayush Chopra contributed equally to this work. Work accepted at WACV 2022
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV、cs.MM
专题命中 跨模态检索 :multi-modal(abstract);image-text(abstract);分类 cs.CV、cs.CL
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV、cs.CL
Comments 11 pages, 7 figures and 6 tables. Accepted by SIGIR 2021
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV、cs.MM
Comments Accepted to CVPR 2021
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV、cs.CL
Comments to appear at EMNLP 2020
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV、cs.CL
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);分类 cs.CV、cs.MM
Comments 8 pages
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV、cs.CL
Comments Accepted as spotlight presentation at British Machine Vision Conference (BMVC) 2018. Code: https://github.com/fartashf/vsepp
专题命中 跨模态检索 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV、cs.CL
Comments Accepted to CVPR2018
CMRAG:基于共模的视觉文档检索与问答
机构 * Baidu Inc(百度公司) ; The University of Hong Kong(香港大学) ; Beihang University(北京航空航天大学) ; Peking University(北京大学)
专题命中 跨模态检索 :multimodal(abstract,comments);cross-modal(abstract);分类 cs.CL
AI总结 CMRAG通过统一编码模型和共模信息检索方法,提升多模态视觉文档问答系统的性能。
Comments Published at ICLR 2026 Workshop on Multimodal Intelligence