MedFailBench: A Clinician-Built Open-Source Benchmark for Medical AI Safety Boundary Inspection
MedFailBench:用于医学人工智能安全边界检查的临床医生构建的开源基准测试
机构 * Kutahya Emet Dr. Fazil Dogan State Hospital(屈塔希亚埃梅特法齐尔·多安州立医院)
专题命中 医学数据与评测 :medical AI(title,abstract)
AI总结 MedFailBench提出不同问题,构建合成基准测试和失败图谱,通过严重程度和安全门类型标记医学人工智能错误,当前版本含44个合成病例等内容,以特定许可形式发布并带有DOI。
Comments 6 pages; synthetic benchmark reviewed by a clinician; no patient data