References Improve LLM Alignment in Non-Verifiable Domains
参考文献提高非可验证领域的LLM对齐
机构 * Yale University(耶鲁大学) ; Meta ; Scale AI ; Salesforce Research(Salesforce 研究) ; Nanyang Technological University(南洋理工大学)
AI总结 本研究提出参考引导的LLM评估器,通过增强LLM对齐的评估器和自我改进,显著提升了非可验证领域中LLM的性能。
Comments ICLR 2026 Camera Ready