Probing Outcome-Level Resemblance and Mechanism-Level Alignment in LLM Risk Decisions: Evidence from the St. Petersburg Game
探究大语言模型风险决策中的结果层面相似性与机制层面一致性:来自圣彼得堡博弈的证据
机构 * Fudan University(复旦大学) ; University of Rochester(罗切斯特大学)
专题命中 知识编辑与模型理解 :LLM(title,abstract);instruction tuning(abstract);prompting(abstract);分类 cs.CL
AI总结 通过圣彼得堡博弈实验,发现大语言模型在风险决策中表现出结果层面的类人行为,但机制层面与人类决策存在显著差异,提示行为对齐可能仅停留在表面。