Training-Free Hashing-Based Attention via Binary Principal Components
基于二元主成分的无训练哈希注意力机制
AI总结 针对长上下文LLMs自注意力的解码效率瓶颈,提出无训练的BinaryPC方法,通过数据二元主成分构建哈希码,在保持精度的同时将解码吞吐量提升3.56倍。
Comments ICML 2026
期刊&会议
International Conference on Machine Learning · 会议 · Machine Learning
基于二元主成分的无训练哈希注意力机制
AI总结 针对长上下文LLMs自注意力的解码效率瓶颈,提出无训练的BinaryPC方法,通过数据二元主成分构建哈希码,在保持精度的同时将解码吞吐量提升3.56倍。
Comments ICML 2026