Neurons Speak in Ranges: Breaking Free from Discrete Neuronal Attribution
神经元以范围说话:摆脱离散神经元归因
机构 * University of Kentucky(肯塔基大学) ; Dalhousie University(达尔豪斯大学)
AI总结 研究发现大语言模型中神经元具有多义性,提出NeuronLens框架通过范围归因提升模型可解释性和可控性。
Journal ref Transactions on Machine Learning Research, ISSN 2835-8856, 2026. https://openreview.net/forum?id=AukyIhfBuW