Towards Reasoning for PDE Foundation Models: A Reward-Model-Driven Inference-Time-Scaling Algorithm
面向PDE基础模型的推理:一种基于奖励模型的推理时扩展算法
机构 * Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室)
专题命中 测试时计算 :reasoning(title,abstract);分类 cs.LG
AI总结 本文提出了一种基于奖励模型的推理时扩展算法,用于提升PDE基础模型在分布外情况下的预测准确性,减少对训练样本和模型规模的依赖。