Belief Without Behavior: Measuring the Translation of Theory of Mind into Coordinated Social Action in Vision-Language Models
无行为的信念:测量视觉-语言模型中心智理论到协同社会行动的转化
机构 * CIAMS, Université Paris-Saclay(巴黎萨克雷大学 CIAMS) ; CQSB, Sorbonne Université(索邦大学 CQSB)
专题命中 GUI与屏幕智能体 :vision-language model(title);VLM(abstract,abstract_cn);分类 cs.AI
AI总结 该研究提出基准MOSAIC评估视觉-语言模型的心智理论到协同社会行动的转化,发现多数模型存在瓶颈,而带显式ToM模块的PCM-LLM表现优异,证实显式信念-行动耦合的作用。