A Mechanistic Understanding of Pronoun Fidelity in LLMs
对大型语言模型中代词忠实性的机制理解
机构 * Saarland University(萨尔大学) ; Heidelberg Institute for Theoretical Studies(海德堡理论研究所)
专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
AI总结 通过因果分析发现,代词忠实性由组实体绑定、近因偏差和刻板印象偏差三种因果子空间共同作用,解释了91-99.5%的行为。