PreAct-Bench: Benchmarking Predictive Monitoring in LLMs
PreAct-Bench:大语言模型中的预测性监控基准
机构 * King’s College London(伦敦国王学院) ; National University of Singapore(新加坡国立大学) ; Southern University of Science and Technology(南方科技大学) ; Thomson Reuters Foundational Research(汤姆森路透基础研究) ; Imperial College London(伦敦帝国学院) ; The Alan Turing Institute(艾伦·图灵研究所)
专题命中 推理评测 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 提出预测性监控任务,在动作执行前判断是否会导致不道德行为,并构建PreActBench基准,评估多种模型发现该任务具有挑战性。