WorldVQA: Measuring Atomic World Knowledge in Multimodal Large Language Models
WorldVQA:评估多模态大语言模型的原子视觉世界知识
机构 * Moonshot AI
专题命中 视觉定位与Grounding :multimodal large language model(title,abstract);grounding(abstract);分类 cs.CV、cs.LG
AI总结 WorldVQA通过评估多模态大语言模型的原子视觉知识,建立衡量其事实性和百科全书广度的基准测试。