TrustMH-Bench: A Comprehensive Benchmark for Evaluating the Trustworthiness of Large Language Models in Mental Health
TrustMH-Bench: 一个用于评估大语言模型在心理健康领域可信度的综合基准
机构 * Renmin University of China, China(中国人民大学) ; Beijing University of Posts and Telecommunications, China(北京邮电大学) ; Hefei University of Technology, China(合肥工业大学)
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI
AI总结 TrustMH-Bench提出了一种综合基准,用于评估大语言模型在心理健康领域的可信度,揭示了现有模型在关键维度上的不足。