SAGE: Benchmarking and Improving Retrieval for Deep Research Agents
SAGE:深度研究代理检索的基准测试与改进
机构 * NYU Shanghai(纽约大学上海校区) ; Yale University(耶鲁大学) ; Center for Data Science, New York University(纽约大学数据科学中心)
专题命中 规划推理 :reasoning(abstract);分类 cs.CL
AI总结 SAGE基准测试评估了深度研究代理的检索能力,发现BM25在推理密集型检索中表现优于大语言模型检索器,并提出基于语料库的测试时扩展框架提升检索性能。