ProbeLLM: Automating Principled Diagnosis of LLM Failures
ProbeLLM:自动化的大语言模型故障原则性诊断
机构 * University of Notre Dame(诺丁汉大学) ; LMU Munich(慕尼黑大学) ; Massachusetts Institute of Technology(麻省理工学院) ; IBM Research(IBM研究院)
专题命中 评测与基准 :LLM(title,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 提出ProbeLLM框架,通过分层蒙特卡洛树搜索在全局探索与局部细化间分配预算,结合工具增强生成与验证,将故障发现从孤立案例提升为结构化故障模式,揭示更广泛、清晰、细粒度的故障景观。