Multi-component Causal Tracing in Large Language Models
大型语言模型中的多组件因果追踪
机构 * Rensselaer Polytechnic Institute(拉特拉姆技术学院) ; IBM Research(IBM研究院)
AI总结 本文提出一个统一框架,通过软干预和度量转换高效识别对目标性能指标最关键的多组件子集,优于现有基线方法。
Comments Accepted to ACL 2026 main conference
大厂专区
大型语言模型中的多组件因果追踪
机构 * Rensselaer Polytechnic Institute(拉特拉姆技术学院) ; IBM Research(IBM研究院)
AI总结 本文提出一个统一框架,通过软干预和度量转换高效识别对目标性能指标最关键的多组件子集,优于现有基线方法。
Comments Accepted to ACL 2026 main conference