Poor Alignment and Steerability of Large Language Models: Evidence from College Admission Essays
大语言模型的对齐性和操控性不足:来自大学录取文书的证据
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
AI总结 本研究通过分析大学录取文书发现,大语言模型在对齐和操控性方面存在不足,提示信息未能有效改变模型输出的语言模式。
Comments 48 pages, 10 figures, 6 tables