When More Thinking Hurts: Overthinking in LLM Test-Time Compute Scaling
更多思考反而有害:在LLM测试时间计算扩展中的过度思考
机构 * Nanjing University(南京大学) ; Baidu(百度) ; Nanjing University of Finance & Economics(南京财经大学)
AI总结 研究探讨了在LLM测试时间计算扩展中,增加推理token的边际效用随计算预算增加而下降的现象,发现模型存在过度思考问题,且最优思考长度因问题难度而异。
Comments 11 pages, 7 figures