FLAT-LLM: Fine-grained Low-rank Activation Space Transformation for Large Language Model Compression
FLAT-LLM: 细粒度低秩激活空间变换用于大语言模型压缩
机构 * University of California, Santa Barbara(加州大学圣芭芭拉分校) ; Intel Corporation(英特尔公司)
专题命中 效率与部署 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL
AI总结 FLAT-LLM通过细粒度低秩激活空间变换实现大语言模型的高效结构压缩,无需训练即可完成权重压缩和校准,提升推理效率与性能。