Exploring Fine-Tuning for In-Context Retrieval and Efficient KV-Caching in Long-Context Language Models
探索针对长上下文语言模型的微调以实现上下文检索和高效的KV缓存
机构 * Sapienza University of Rome(罗马萨皮恩扎大学) ; Amazon AGI(亚马逊人工智能研究院)
AI总结 本文研究了长上下文语言模型在微调策略下的性能提升及KV缓存压缩下的鲁棒性,展示了领域内和跨领域任务中的不同表现。
Comments European Chapter of the Association for Computational Linguistics EACL 2026