arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

作者

Jiawei Han

Data Mining

2026-03-05 至 2026-03-05 共收录 2
2502.01534 2026-03-05 cs.LG cs.AI cs.CL

Preference Leakage: A Contamination Problem in LLM-as-a-judge

偏好泄露:作为判断者的LLM中的污染问题

Dawei Li, Renliang Sun, Yue Huang, Ming Zhong, Bohan Jiang, Jiawei Han, Xiangliang Zhang, Wei Wang, Huan Liu

机构 * Arizona State University(亚利桑那州立大学) University of California, Los Angeles(加州大学洛杉矶分校) University of Notre Dame(诺丁汉大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 本文提出偏好泄露问题,揭示LLM作为判断者时因数据生成器与评估者相关性导致的偏见,并通过实验验证其普遍存在性和检测难度。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03296 2026-03-05 cs.CL cs.AI cs.IR

PlugMem: A Task-Agnostic Plugin Memory Module for LLM Agents

PlugMem: 一种通用插件记忆模块用于LLM代理

Ke Yang, Zixi Chen, Xuan He, Jize Jiang, Michel Galley, Chenglong Wang, Jianfeng Gao, Jiawei Han, ChengXiang Zhai

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Tsinghua University(清华大学) Microsoft Research(微软研究院)

AI总结 PlugMem是一种通用记忆模块,通过知识中心的记忆图结构提升LLM代理在复杂任务中的记忆检索与推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏