ProjQ: Project-and-Quantize for Adapter-Aware LLM Compression
ProjQ:面向适配器感知的大语言模型压缩的投影与量化
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)
AI总结 提出ProjQ框架,通过正交子空间投影将量化噪声约束到低秩流形,利用交替算法将主导误差卸载给适配器,实现更优的量化误差补偿和下游任务微调。
Comments Acceppted paper in ICML 2026