MedErrBench: A Fine-Grained Multilingual Benchmark for Medical Error Detection and Correction with Clinical Expert Annotations
MedErrBench: 一种细粒度多语言基准,用于医疗错误检测与修正,带有临床专家注释
机构 * New York University Abu Dhabi(纽约大学阿布扎赫尔分校) ; New York University(纽约大学) ; University of Birmingham(伯明翰大学) ; Cleveland Clinic Abu Dhabi(克利夫兰医学中心阿布扎赫尔分校)
AI总结 MedErrBench是一个多语言医疗错误检测与修正基准,通过临床专家注释评估各类语言模型性能,揭示非英语环境中的性能差距,推动多语言临床NLP发展。