Investigating and Mitigating the Multimodal Hallucination Snowballing in Large Vision-Language Models
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted to ACL 2024 Main Conference. 21 pages, 20 figures
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted to ACL 2024 Main Conference. 21 pages, 20 figures
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI、eess.AS
Comments Accepted into KDD 2024 workshop on Ethical AI
专题命中 图文多模态 :multimodal(title);image-text(abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 图文多模态 :cross-modal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments 12 pages, 10 figures
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Dataset and models are available at https://github.com/jihaonew/MM-Instruct
专题命中 图文多模态 :multi-modal(title,abstract);image-text(abstract)
Comments Accepted by ECML-PKDD 2024
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted at ACL (Main) 2024
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments 7 pages, 3 figures, Clinical NLP 2024 workshop proceedings in Shared Task
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted to CVPR2024. Project page: https://vip-llava.github.io/
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments 26 pages, 14 figures The data and code for this project are accessible at https://github.com/agiresearch/battleagent
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted by ICLR2024
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments 5 figures
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments CVPR 2024
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 图文多模态 :multimodal(title);multi-modal(abstract);分类 cs.CV、cs.CL、cs.AI
Comments GitHub: https://github.com/danielabd/Apollo-Cap
专题命中 图文多模态 :multimodal(title);image-text(abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments 15 pages, 9 figures, to be published In Proceedings of International Conference of Computer Vision(ICCV), 2023
专题命中 图文多模态 :multi-modal(title,abstract);multimodal(abstract)
Comments Accepted to NeurIPS 2022
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments https://socraticmodels.github.io/
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.MM
Comments Accepted by ACL 2022 (long paper)
专题命中 图文多模态 :multimodal(title,abstract);multi-modal(abstract)
Comments Oral at SVRHM Workshop (NeurIPS 2021)
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 图文多模态 :multi-modal(title);multimodal(abstract);分类 cs.CV、cs.CL、cs.AI
Comments EMNLP 2020
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 图文多模态 :multi-modal(title);cross-modal(abstract);分类 cs.CV、cs.CL、eess.AS
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV、cs.CL、cs.MM
Comments 9 pages, 3 figures
专题命中 图文多模态 :cross-modal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments CVPR 2019 Oral
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract)