Human-Level and Beyond: Benchmarking Large Language Models Against Clinical Pharmacists in Prescription Review
人类水平与超越:在处方审查中对大型语言模型与临床药师进行基准测试
机构 * SUN YAT-SEN MEMORIAL HOSPITAL(中山纪念医院) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; University of Washington(华盛顿大学)
专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL
AI总结 RxBench通过系统评估大型语言模型在处方审查中的表现,揭示其能力与局限,并推动更可靠的临床工具开发。