Evaluating Text Creativity across Diverse Domains: A Dataset and Large Language Model Evaluator
在不同领域评估文本创造力:一个数据集和大语言模型评估器
机构 * Renmin University of China(中国人民大学) ; Beijing Normal University(北京师范大学) ; Kuaishou Technology(快手科技)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
AI总结 本文提出了一种基于CreataSet数据集的CrEval评估器,通过结合人类和合成数据提升大语言模型的创造力评估效果。
Comments Accepted by ICLR 2026