SciText2Eq: Assessing LLMs for Explainable Equation Generation for Scientific Creativity
SciText2Eq: 评估大语言模型在科学创造力中的可解释方程生成
机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) ; Wageningen University & Research(瓦赫宁根大学及研究中心)
专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 研究大语言模型从科学文本生成数学方程的能力,构建AI论文数据集,提出可解释方程生成流程,并设计结合自动指标、LLM评估和人工判断的评估协议,发现LLM在语义准确性上表现不足。
Comments Accepted by findings of ACL 2026