arXivDaily arXiv每日学术速递 周一至周五更新

作者

Dawn Song

AI / Security

2025-12-15 至 2025-12-15 共收录 2
2507.05578 2025-12-15 cs.LG cs.CL cs.CR

The Landscape of Memorization in LLMs: Mechanisms, Measurement, and Mitigation

LLM记忆景观:机制、测量与缓解

Alexander Xiong, Xuandong Zhao, Aneesh Pappu, Dawn Song

机构 * UC Berkeley(伯克利大学) Google DeepMind(谷歌DeepMind)

AI总结 本文研究了LLM记忆现象的机制、测量方法及缓解策略,探讨了影响记忆的因素和检测技术,并分析了其法律伦理影响及缓解措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18581 2025-12-15 cs.CL cs.AI cs.LG

Scalable Best-of-N Selection for Large Language Models via Self-Certainty

通过自我确定性实现大规模语言模型的可扩展最佳-N选择

Zhewei Kang, Xuandong Zhao, Dawn Song

机构 * UC Berkeley(伯克利大学)

AI总结 本文提出自我确定性方法,通过利用LLM输出的概率分布,高效提升大规模语言模型的推理能力,适用于多种推理任务和开放性生成场景。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏