LLMs Can't Handle Peer Pressure: Crumbling under Multi-Agent Social Interactions
大语言模型难以应对同伴压力:在多智能体社交互动中崩溃
机构 * Singapore University of Technology and Design(新加坡科技设计大学) ; Nanyang Technological University(南洋理工大学) ; National University of Singapore(国立新加坡大学) ; Lambda Labs(Lambda实验室)
AI总结 研究探讨了大语言模型在多智能体社交互动中的表现,提出KAIROS基准用于评估模型在复杂社交动态中的决策能力,发现模型规模和训练方法对抵抗社交影响至关重要。