arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

National University of Singapore(新加坡国立大学)

2025-12-25 至 2025-12-25 共收录 2
2512.21236 2025-12-25 cs.CR cs.AI cs.SE

Casting a SPELL: Sentence Pairing Exploration for LLM Limitation-breaking

为LLM突破限制而探索句子配对:恶意代码生成的测试框架

Yifan Huang, Xiaojun Jia, Wenbo Guo, Yuqiang Sun, Yihao Huang, Chong Wang, Yang Liu

机构 * Nanyang Technological University(南洋理工大学) National University of Singapore(国立新加坡大学)

AI总结 SPELL框架通过智能句子配对探索LLM在恶意代码生成中的安全漏洞,有效提升对抗测试效果。

Comments Accepted to FSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11822 2025-12-25 cs.AI

Beyond Consensus: Mitigating the Agreeableness Bias in LLM Judge Evaluations

超越共识:在LLM评估中缓解顺从偏差

Suryaansh Jain, Umair Z. Ahmed, Shubham Sahai, Ben Leong

机构 * University of Massachusetts at Amherst(马萨诸塞大学阿默斯特分校) National University of Singapore(新加坡国立大学)

AI总结 本文提出了一种基于回归的框架,通过少量人工标注数据建模验证者偏差,有效缓解LLM评估中的顺从偏差问题,并在代码反馈任务中取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏