arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

NeurIPS

Conference on Neural Information Processing Systems · 会议 · Machine Learning

2026-08-10 至 2026-08-10 共收录 1
2511.09432 2026-08-10 cs.LG 版本更新

Equivariant Sparse Autoencoders: Mechanistic Interpretability of Neural Networks on Symmetric Data

等变稀疏自编码器:对称数据上神经网络的机制可解释性

Ege Erdogan, Ana Lucic

机构 * University of Amsterdam(阿姆斯特丹大学)

AI总结 该研究针对稀疏自编码器在对称数据上的不可识别问题,提出等变稀疏自编码器,可避免缺陷并发现更有用的下游任务特征,表明重构质量与特征实用性在对称下可能负相关。

Comments NeurIPS 2025 Mechanistic Interpretability and UniReps workshops

详情

展开后加载摘要…

URL PDF HTML 收藏