OR-R1: Automating Modeling and Solving of Operations Research Optimization Problem via Test-Time Reinforcement Learning
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI
Comments 9 pages, 5 figures, AAAI 2026
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI
Comments 9 pages, 5 figures, AAAI 2026