MedPriv-Bench: Benchmarking the Privacy-Utility Trade-off of Large Language Models in Medical Open-End Question Answering
MedPriv-Bench:医疗开放问答中大语言模型隐私-效用权衡的基准测试
专题命中 隐私与版权 :alignment(abstract);safety(abstract);分类 cs.CL
AI总结 MedPriv-Bench首次提出医疗开放问答中评估隐私保护与临床效用的基准,通过多代理人机协同流程生成敏感医疗情境,利用预训练RoBERTa-NLI模型量化数据泄露,揭示大语言模型在隐私与效用间的普遍权衡。
Comments 17 pages, 5 figures