Towards Human Cognition: Visual Context Guides Syntactic Priming in Fusion-Encoded Models
机构 * University of Florida(佛罗里达大学)
专题命中 其他VLM :multimodal large language model(abstract)
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
机构 * University of Florida(佛罗里达大学)
专题命中 其他VLM :multimodal large language model(abstract)