Sample Smart, Not Hard: Correctness-First Decoding for Better Reasoning in LLMs
机构 * ETH Zurich(苏黎世联邦理工学院) ; Max Planck Institute for Intelligent Systems(智能系统马克斯·普朗克研究所)
专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL、cs.LG
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
机构 * ETH Zurich(苏黎世联邦理工学院) ; Max Planck Institute for Intelligent Systems(智能系统马克斯·普朗克研究所)
专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL、cs.LG
机构 * Radha Gulhane(独立研究者) ; Sathish Reddy Indurthi(独立研究者)
专题命中 数学推理 :reasoning(abstract);math reasoning(abstract);分类 cs.CL、cs.AI
专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG
Comments MIT URTC 2025 Technical Paper (Oral), 5 pages, 1 figure
机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) ; School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) ; MiLM Plus, Xiaomi Inc(小米公司MiLM Plus)
专题命中 数学推理 :reasoning(abstract);分类 cs.CL
机构 * George Mason University(乔治·马歇尔大学)
专题命中 数学推理 :planning(abstract);分类 cs.CL
Comments Accepted by AAAI 2025 workshop