RefineBench: Evaluating Refinement Capability of Language Models via Checklists
RefineBench: 通过检查表评估语言模型的细化能力
机构 * KAIST(韩国科学技术院) ; Carnegie Mellon University(卡内基梅隆大学) ; NVIDIA(英伟达) ; Independent Researcher(独立研究者)
AI总结 RefineBench通过检查表评估语言模型的细化能力,发现指导细化能显著提升响应质量,而自我细化则需进一步突破。
Comments Project website: https://passing2961.github.io/refinebench-page/