COMPASS: A Framework for Evaluating Organization-Specific Policy Alignment in LLMs
COMPASS:一个评估大语言模型在组织特定政策对齐性的框架
机构 * AIM Intelligence(AIM智能科技) ; BMW Group(宝马集团) ; Yonsei University(延世大学) ; POSTECH ; Seoul National University(首尔国立大学)
专题命中 安全训练 :alignment(title,abstract);safety(abstract);AI safety(abstract);分类 cs.AI、cs.CY
AI总结 COMPASS框架通过评估大语言模型在组织特定政策下的对齐性,揭示了模型在合规性与对抗性鲁棒性上的显著差异,为组织AI安全提供了关键评估工具。