More Yap Less Meaning: Uncovering Self-Improvement Behavior in SLMs
更多废话,更少意义:揭示小语言模型中的自我改进行为
机构 * American University of Armenia(亚美尼亚美国大学) ; NVIDIA(英伟达)
专题命中 指令微调 :SLM(abstract,abstract_cn);language model(abstract);small language model(abstract);分类 cs.CL、cs.AI
AI总结 本研究通过构建充分性测试,发现小语言模型在自我纠正中仅获得4.4%的准确率提升,且较长的提示反而与错误答案正相关,表明其推理能力有限。
Comments GEM Workshop at ACL 2026