arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

作者

Michael I. Jordan

Machine Learning

2026-02-13 至 2026-02-13 共收录 2
2602.12180 2026-02-13 cs.LG cs.GT

How Sampling Shapes LLM Alignment: From One-Shot Optima to Iterative Dynamics

采样如何塑造大语言模型对齐:从单次最优到迭代动态

Yurong Chen, Yu He, Michael I. Jordan, Fan Yao

机构 * Inria(法国国家信息与自动化研究所) École Normale Supérieure(巴黎高等师范学校) PSL Research University(巴黎综合理工研究所) Northwestern University(西北大学) University of California, Berkeley(加州大学伯克利分校) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

AI总结 研究探讨了采样对大语言模型对齐的影响,发现适当采样可提升排序保证,而偏向采样可能导致集中问题,并分析了迭代动态中的稳定性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13732 2026-02-13 stat.ML cs.LG

Backward Conformal Prediction

反向符合预测

Etienne Gauthier, Francis Bach, Michael I. Jordan

机构 * INRIA-ENS-PSL Paris(法国国家信息与自动化研究所-巴黎综合理工学院-巴黎理工学院) UC Berkeley(加州大学伯克利分校)

AI总结 反向符合预测通过约束预测集大小行为并调整覆盖率水平,提供灵活的可计算覆盖率保证,适用于医疗诊断等大预测集不现实的应用场景。

Comments Code available at: https://github.com/GauthierE/backward-cp

详情

展开后加载摘要…

URL PDF HTML 收藏