How Much Reasoning Do Retrieval-Augmented Models Add beyond LLMs? A Benchmarking Framework for Multi-Hop Inference over Hybrid Knowledge
检索增强模型在大语言模型之上添加多少推理能力?一种用于混合知识多跳推理的基准评估框架
机构 * Massachusetts Institute of Technology(麻省理工学院) ; IBM Research(IBM研究院) ; University of Central Florida(中央佛罗里达大学)
专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
AI总结 HybridRAG-Bench通过混合知识和多跳推理评估框架,有效区分真实检索与参数回忆,为混合知识增强推理系统提供测试平台。