A Structured Framework for Evaluating and Enhancing Interpretive Capabilities of Multimodal LLMs in Culturally Situated Tasks
一种评估和增强多模态大语言模型在文化情境任务中解释能力的结构框架
机构 * DJCAD, University of Dundee, United Kingdom(邓迪大学DJCAD部门) ; ARG-tech, SSEN, University of Dundee, United Kingdom(邓迪大学) ; School of Computer Science, University of Birmingham, United Kingdom(伯明翰大学计算机科学学院)
AI总结 本研究提出了一种结构框架,用于评估和增强多模态大语言模型在文化情境任务中生成中国绘画批评的能力,通过量化评价特征和人设引导提示,揭示了VLMs在艺术批评领域的表现与局限。
Comments EMNLP 2025 submission, 10 pages, 6 figures, 5 tables
Journal ref Findings of the Association for Computational Linguistics: EMNLP 2025, pages 1945-1971, Suzhou, China