ProRank: Prompt Warmup via Reinforcement Learning for Small Language Models Reranking
ProRank:通过强化学习进行小语言模型的提示预热以实现文档重排序
机构 * Mixedbread AI ; The Hong Kong Polytechnic University(香港理工大学)
AI总结 本文提出ProRank方法,通过强化学习提升小语言模型对任务提示的理解,结合细粒度分数学习增强表示能力,实验证明其在文档重排序任务中优于现有模型,尤其在BEIR基准上表现突出。
Comments Accepted by ACL2026 Findings