GUARDIAN: Safeguarding LLM Multi-Agent Collaborations with Temporal Graph Modeling
机构 * King’s College London(伦敦国王学院) ; Beijing Institute of Technology(北京理工大学) ; Tsinghua University(清华大学)
专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL、cs.AI
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
机构 * King’s College London(伦敦国王学院) ; Beijing Institute of Technology(北京理工大学) ; Tsinghua University(清华大学)
专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL、cs.AI
机构 * University of Southern California(南加州大学)
专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL
机构 * Hubei Provincial Key Laboratory of Artificial Intelligence and Smart Learning(湖北人工智能与智能学习省级重点实验室) ; National Language Resources Monitoring and Research Center for Network Media(网络媒体语言资源监测与研究国家中心) ; Central China Normal University(中央财经大学) ; Wuhan University of Technology(武汉理工大学)
专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL
Comments Accepted at EMNLP 2025 MainConference