TriggerBench: Investigating Prospective Memory for Large Language Models
TriggerBench: 探究大型语言模型的前瞻记忆
机构 * The Chinese University of Hong Kong(香港中文大学) ; Microsoft Research Asia(微软亚洲研究院)
专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.CL
AI总结 提出TriggerBench基准,系统评估LLM的前瞻记忆能力,发现其存在精度-召回权衡、注意力脆弱性,且比回溯记忆更难,可作为推理能力的指标。