Is Preference Alignment Always the Best Option to Enhance LLM-Based Translation? An Empirical Analysis
基于偏好对齐是否总是提升基于大语言模型的翻译质量的最佳选项?一项实证分析
专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);SFT(abstract)
AI总结 本研究通过实证分析探讨了基于偏好的对齐在提升大语言模型翻译质量中的效果,发现CPO在高质量数据上表现优异,但可能在下游度量上存在不稳定性,同时基础模型生成翻译的表现与多个外部系统相当且更一致。