Can Large Language Models Develop Strategic Reasoning? Post-training Insights from Learning Chess
机构 * KAIST AI(韩国科学技术院人工智能研究所) ; KRAFTON(KRAFTON公司) ; UC Berkeley(伯克利大学)
专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);post-training(title);LLM(abstract)
Comments Accepted into Test-time Scaling and Reasoning Models (SCALR) workshop at COLM 2025. 28 pages