The Shibboleth Effect: Auditing the Cross-Lingual Distributional Skew of Large Language Models
示播列效应:审计大型语言模型的跨语言分布偏斜
机构 * Kellogg Institute for International Studies, University of Notre Dame(凯洛格国际研究学院,圣约翰大学) ; Marmara University(马尔马拉大学)
专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);RLHF(abstract,abstract_cn)
AI总结 本研究通过多智能体地缘政治兵棋推演,发现前沿LLM在跨语言条件下存在行为偏斜,且该效应依赖于模型架构与训练机制,而非西方起源模型的普遍属性。
Comments 25 pages, 2 figures, 6 tables, Research Article