m1: Unleash the Potential of Test-Time Scaling for Medical Reasoning with Large Language Models
m1:通过大语言模型的测试时缩放释放医疗推理的潜力
机构 * UC Santa Cruz(加州大学圣克ruz分校) ; Amazon Research(亚马逊研究院)
专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL、cs.AI
AI总结 本文提出m1方法,通过测试时缩放提升医疗推理能力,发现最佳推理预算和医学知识不足是关键瓶颈。
Comments 17 pages; 7 figures; Data, code, and models: https://github.com/UCSC-VLAA/m1 ; Accepted by ML4H'25