arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

North American Chapter of the Association for Computational Linguistics · 会议 · Natural Language Processing

2026-04-17 至 2026-04-17 共收录 1
2503.08159 2026-04-17 cs.CL

Mimicking How Humans Interpret Out-of-Context Sentences Through Controlled Toxicity Decoding

模仿人类如何解读无上下文句子通过受控毒性解码

Maria Mihaela Trusca, Liesbeth Allein

机构 * Department of Computer Science(计算机科学系)

AI总结 本文通过生成多样化的无上下文句子解读,模拟人类对不同毒性水平内容的感知,通过控制生成解读中的毒性来提高对人类写作解读的对齐性。

Comments Short paper; accepted at TrustNLP @ NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏