Benchmarking Large Language Models for Knowledge Graph Validation
对大型语言模型在知识图谱验证中的基准测试
专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.DB
AI总结 本文提出FactCheck基准,评估大型语言模型在知识图谱验证中的性能,发现其在稳定性、可靠性及多模型共识策略上的不足,强调了建立系统评估框架的重要性。
Comments Accepted paper by the 29th International Conference on Extending Database Technology (EDBT'26)