Making Clinical Language Models Auditable: Concept-Guided Fine-Tuning for Robust Prediction
使临床语言模型可审计:概念引导的鲁棒预测微调
机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
AI总结 本研究提出基于SAE的可审计临床文本分类框架CAST,通过提取并抑制病历人工制品特征,在MIMIC-IV死亡率预测任务上提升了基线性能并保留与强LLM相当的效果,同时提供可审计的特征级轨迹。