MHGraphBench: Knowledge Graph-Grounded Benchmarking of Mental Health Knowledge in Large Language Models
MHGraphBench: 用于评估大语言模型中心理健康知识的图知识基准
机构 * Vanderbilt University(范德比大学) ; Vanderbilt University Medical Center(范德比大学医学院) ; Virginia Tech(弗吉尼亚理工学院)
专题命中 安全评测 :safety(abstract);分类 cs.CL
AI总结 本文提出MHGraphBench基准,评估大语言模型在心理健康实体识别、关系判断及双跳推理能力,发现模型在实体类型识别和小关系类型判断上表现优异,但在关系预测和双跳推理上仍有不足,且输出格式可靠性对性能有显著影响。
Comments Accepted to GEM 2026, ACL 2026 Workshop; 9 pages main text plus references and appendices