Making Large Language Models Efficient Dense Retrievers
使大语言模型成为高效密集检索器
机构 * University of Amsterdam(阿姆斯特丹大学) ; University of Maryland, College Park(马里兰大学 College Park 分校) ; Johns Hopkins University, HLTCOE(约翰霍普金斯大学 HLTCOE)
AI总结 EffiR通过粗到细的MLP压缩策略和检索特定微调,使大语言模型在保持性能的同时显著减少模型大小和推理成本。