Distributive Fairness in Large Language Models: Evaluating Alignment with Human Values
大语言模型中的分配公平性:评估与人类价值观的对齐
机构 * Penn State University(宾夕法尼亚州立大学)
专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
AI总结 本文研究了大语言模型在分配公平性方面的表现,发现其与人类价值观存在偏差,并探讨了提升对齐性的策略。
Comments Accepted at NeurIPS 2025