arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Cambridge(剑桥大学)

2026-01-12 至 2026-01-12 共收录 1
2511.16035 2026-01-12 cs.CL cs.AI

Liars' Bench: Evaluating Lie Detectors for Language Models

说谎的检验台:评估语言模型的说谎检测器

Kieron Kretschmar, Walter Laurito, Sharan Maiya, Samuel Marks

机构 * Cadenza Labs(Cadenza实验室) FZI(弗劳恩霍夫研究所) University of Cambridge(剑桥大学)

AI总结 本文提出LIARS' BENCH,通过多个数据集和模型生成72,863个谎言和诚实响应,评估三种谎言检测技术,揭示现有方法在识别特定类型谎言上的局限性。

Comments *Kieron Kretschmar and Walter Laurito contributed equally to this work. 10 pages, 2 figures; plus appendix. Code at https://github.com/Cadenza-Labs/liars-bench and datasets at https://huggingface.co/datasets/Cadenza-Labs/liars-bench Subjects: Computation and Language (cs.CL); Artificial Intelligence (cs.AI)

详情

展开后加载摘要…

URL PDF HTML 收藏