B-cos LM: Efficiently Transforming Pre-trained Language Models for Improved Explainability
B-cos LM:高效地将预训练语言模型转换以提高可解释性
机构 * Saarland University(萨尔兰大学) ; Max Planck Institute for Informatics(马克斯·普朗克信息研究所) ; Saarland Informatics Campus(萨尔兰计算机科学校区)
专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI
AI总结 本文提出B-cos LM,通过结合B-cos转换和任务微调,提高预训练语言模型的可解释性与效率。
Comments TMLR 12/2025