Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions
在回答和解释具有挑战性的医疗问题上评估大型语言模型
机构 * Rice University(里士满大学) ; Johns Hopkins University(约翰霍普金斯大学)
AI总结 本文提出两个新数据集用于评估大型语言模型在回答和解释具有挑战性的医疗问题上的能力,并通过实验展示了这些数据集的难度及模型表现。
Comments NAACL 2025