RapGuard: Safeguarding Multimodal Large Language Models via Rationale-aware Defensive Prompting
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CL
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CL
专题命中 图文多模态 :multi-modal(title,abstract);MLLM(abstract);分类 cs.CV
Comments 5 pages, Accepted by ICASSP2025, full paper
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments 16 pages, 10 figures, accepted by AAAI 25
专题命中 图文多模态 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(title,abstract);multi-modal(abstract);分类 cs.CV
Comments Code, models and demo available at https://github.com/mbzuai-oryx/UniMed-CLIP
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
Comments The code and models will be available at https://github.com/OpenGVLab/V2PE
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments ECCV 2024 Workshop on Green Foundation Models
专题命中 图文多模态 :multi-modal(title,abstract);MLLM(abstract);分类 cs.CV
Comments 13 pages; with PosterGen as extension; IEEE template
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CL
Comments This thesis, awarded a distinction by the Department of Computer Science at University College London, was successfully defended by the author in September 2024 in partial fulfillment of the requirements for an MSc in Emerging Digital Technologies
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments NeurIPS 2024
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CL
Comments 15 pages, 7 figures
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
Journal ref IEEE Trans. Geosci. Remote Sens., vol. 62, pp. 1-13, 2024
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
Comments 11 pages, 6 figures, technical report
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments 10 pages
专题命中 图文多模态 :multi-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments 11 pages, 2 figures
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments This is a survey paper on recent state of the art VL models that can be used for memes classification. it has 15 pages and 2 figures
Journal ref SCA 2020
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);multi-modal(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments 28 pages, 11 figures, under review
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments Github: https://github.com/JiuTian-VL/MoME
专题命中 图文多模态 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted for Publication in IEEE Transactions on Circuits and Systems for Video Technology (TCSVT)
专题命中 图文多模态 :image-text(title,abstract);multi-modal(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(title,abstract);multimodal(abstract);分类 cs.CV
Comments 13 pages, 3 figures
专题命中 图文多模态 :image-text(title,abstract);cross-modal(abstract);分类 cs.CV
Comments 22pages, 5 Figures, 6 tables, the extension of CMSEI in WACV23, and submitted to ACM TIST. arXiv admin note: text overlap with arXiv:2210.08908
专题命中 图文多模态 :multimodal(title,abstract);multimodal foundation model(abstract);分类 cs.CV