Completing Missing Annotation: Multi-Agent Debate for Accurate and Scalable Relevant Assessment for IR Benchmarks
补全缺失注释:基于多智能体辩论的准确且可扩展的相关性评估框架用于信息检索基准测试
机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)
专题命中 RAG评测 :RAG(abstract);retriever(abstract);分类 cs.CL、cs.AI
AI总结 DREAM通过多智能体辩论框架提高IR基准测试的相关性评估准确性,减少人力参与,构建BRIDGE基准并揭示缺失相关片段,改进检索器比较。
Comments Accepted at ICLR 2026