Aligning Large Language Model Behavior with Human Citation Preferences
使大型语言模型行为与人类引用偏好对齐
机构 * RIKEN AIP(日本研究所)
专题命中 后训练与偏好优化 :language model(title,abstract);large language model(title);LLM(abstract);preference optimization(abstract)
AI总结 本研究通过构建数据集分析LLM引用行为与人类偏好的一致性,发现模型在引用医学文本和数字句子上存在偏差,通过优化可提升对齐效果。
Comments Work In Progress