Interpretability Transfer from Language to Vision via Sparse Autoencoders
通过稀疏自编码器实现从语言到视觉的可解释性迁移
机构 * University of Bath, UK(巴斯大学) ; Lambda, Inc.(Lambda公司) ; Samsung AI Centre Cambridge(三星AI研究中心)
专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);language model(abstract)
AI总结 提出VISTA框架,通过约束视觉投影器将视觉token映射到LLM的文本SAE空间,实现无需专用视觉SAE的视觉可解释性,并在对象移除和替换任务上分别提升35%和47%。
Journal ref ICML 2026