arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

作者

Yejin Choi

Natural Language Processing

2026-03-04 至 2026-03-04 共收录 2
2510.06084 2026-03-04 cs.CL cs.AI

Spectrum Tuning: Post-Training for Distributional Coverage and In-Context Steerability

频谱调节:面向分布覆盖和上下文可引导性的后训练

Taylor Sorensen, Benjamin Newman, Jared Moore, Chan Park, Jillian Fisher, Niloofar Mireshghallah, Liwei Jiang, Yejin Choi

机构 * University of Washington(华盛顿大学) Stanford University(斯坦福大学) Microsoft Research(微软研究院) Carnegie Mellon University(卡内基梅隆大学)

AI总结 本文提出Spectrum Tuning方法,通过Spectrum Suite提升模型在多样化分布下的引导能力和输出空间覆盖性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14632 2026-03-04 cs.CL

Diverging Preferences: When do Annotators Disagree and do Models Know?

分歧偏好:标注者何时分歧以及模型是否知道?

Michael JQ Zhang, Zhilin Wang, Jena D. Hwang, Yi Dong, Olivier Delalleau, Yejin Choi, Eunsol Choi, Xiang Ren, Valentina Pyatkin

机构 * New York University(纽约大学) Allen Institute for Artificial Intelligence(人工智能研究院) NVIDIA(NVIDIA公司) University of Washington(华盛顿大学) University of Southern California(南加州大学)

AI总结 本文研究了标注者分歧的来源,发现任务不明确等因素导致大多数分歧,并提出方法以减轻其在LLM评估和训练中的影响。

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏