Repair or Resample? Rethinking Failure Debugging in LLM Multi-Agent Systems
修复还是重采样?重新思考LLM多智能体系统中的故障调试
机构 * East China Normal University(华东师范大学) ; Nanyang Technological University(南洋理工大学) ; Singapore Management University(新加坡管理大学) ; Xi’an University of Architecture and Technology(西安建筑科技大学)
AI总结 本研究针对LLM多智能体系统的故障调试,提出SymTrace评估框架与SymFail数据集,发现现有无指导重运行方法不可靠,提出的症状驱动干预方法可显著提升故障修复率。