Sparse Feature Coactivation Reveals Causal Semantic Modules in Large Language Models
稀疏特征共激活揭示大语言模型中的因果语义模块
机构 * Georgia Institute of Technology(佐治亚理工学院) ; Brown University(布朗大学) ; University of Michigan(密歇根大学)
专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI
AI总结 通过稀疏自编码器特征的共激活,研究发现大语言模型中存在语义连贯且上下文一致的网络组件,揭示了模型的模块化结构及高效操控方法。
Comments ACL 2026