Sparse Autoencoders Learn Monosemantic Features in Vision-Language Models
稀疏自编码器在视觉-语言模型中学习单义特征
机构 * Technical University of Munich(慕尼黑技术大学) ; Helmholtz Munich(亥姆霍兹慕尼黑) ; Munich Center for Machine Learning(慕尼黑机器学习中心) ; Munich Data Science Institute(慕尼黑数据科学研究所) ; University of Tübingen(图宾根大学) ; University of Copenhagen(哥本哈根大学)
专题命中 VLM训练与架构 :vision-language model(title,abstract);VLM(abstract);LLaVA(abstract);分类 cs.CV、cs.AI、cs.LG
AI总结 本研究通过稀疏自编码器提升视觉-语言模型中神经元的单义性,展示其在增强模型可解释性和可控性方面的有效性。
Comments Accepted at NeurIPS 2025