arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

作者

Percy Liang

Natural Language Processing

至 收录 2
2602.06932 2026-08-05 cs.LG 版本更新

When RL Meets Adaptive Speculative Training: A Unified Training-Serving System

当强化学习遇见自适应推测训练:一个统一的训练-服务系统

Junxiong Wang, Fengxiang Bie, Jisen Li, Zhongzhu Zhou, Zelei Shao, Yubo Wang, Yinghui Liu, Qingyang Wu, Avner May, Sri Yanamandra, Ce Zhang, Tri Dao, Percy Liang, Ben Athiwaratkun, Shuaiwen Leon Song, Chenfeng Xu, Xiaoxia Wu

AI总结 本文提出Aurora系统,通过强化学习实时学习推测器,解决传统方法中部署延迟和领域漂移问题,实验显示在多个模型上实现显著加速。

URL PDF HTML 收藏
2603.24917 2026-08-03 cs.CL cs.LG 版本更新

Estimating near-verbatim extraction risk in language models with decoding-constrained beam search

通过解码约束束搜索估计语言模型中的近原文提取风险

A. Feder Cooper, Mark A. Lemley, Christopher De Sa, Lea Duesterwald, Allison Casasola, Jamie Hayes, Katherine Lee, Daniel E. Ho, Percy Liang

机构 * AVERI Stanford(斯坦福大学) Cornell(康奈尔大学) Google DeepMind(谷歌DeepMind)

AI总结 本文提出解码约束束搜索方法,以有效估计语言模型中的近原文提取风险,揭示更多可提取序列及模型规模对风险的影响。

Comments COLM 2026

URL PDF HTML 收藏