arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 983 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 图谱与结构化RAG 983 篇

2406.19271 2025-02-28 cs.CL cs.AI cs.IR 67%

AutoPureData: Automated Filtering of Undesirable Web Data to Update LLM Knowledge

Praneeth Vadlapati

专题命中 图谱与结构化RAG :RAG(abstract);分类 cs.IR、cs.CL、cs.AI

Comments Final version

Journal ref Journal of Mathematical & Computer Applications, 3 (2024) E121

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09771 2025-02-24 cs.SE 67%

Knowledge-Enhanced Program Repair for Data Science Code

Shuyin Ouyang, Jie M. Zhang, Zeyu Sun, Albert Merono Penuela

专题命中 图谱与结构化RAG :RAG(abstract);knowledge retrieval(abstract)

Journal ref ICSE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19727 2024-10-28 cs.AI cs.CL cs.IR cs.LG 67%

FISHNET: Financial Intelligence from Sub-querying, Harmonizing, Neural-Conditioning, Expert Swarms, and Task Planning

Nicole Cho, Nishan Srishankar, Lucas Cecchi, William Watson

专题命中 图谱与结构化RAG :RAG(abstract);分类 cs.IR、cs.CL、cs.AI

Comments Accepted at the 5th ACM International Conference on AI in Finance (ICAIF '24)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20455 2024-10-23 cs.SE 67%

DepsRAG: Towards Agentic Reasoning and Planning for Software Dependency Management

Mohannad Alhanahnah, Yazan Boshmaf

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14931 2024-10-22 cs.HC 67%

"Ghost of the past": identifying and resolving privacy leakage from LLM's memory through proactive user interaction

Shuning Zhang, Lyumanshan Ye, Xin Yi, Jingyu Tang, Bo Shui, Haobin Xing, Pengfei Liu, Hewu Li

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02779 2024-10-07 cs.IR cs.AI cs.CL cs.LG 67%

Learning variant product relationship and variation attributes from e-commerce website structures

Pedro Herrero-Vidal, You-Lin Chen, Cris Liu, Prithviraj Sen, Lichao Wang

专题命中 图谱与结构化RAG :RAG(abstract);分类 cs.IR、cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17580 2024-09-27 cs.IR cs.AI cs.DB 67%

Enhancing Structured-Data Retrieval with GraphRAG: Soccer Data Case Study

Zahra Sepasdar, Sushant Gautam, Cise Midoglu, Michael A. Riegler, Pål Halvorsen

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);分类 cs.IR、cs.AI、cs.DB

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06062 2024-09-11 eess.AS cs.SD 67%

Retrieval Augmented Correction of Named Entity Speech Recognition Errors

Ernest Pusateri, Anmol Walia, Anirudh Kashi, Bortik Bandyopadhyay, Nadia Hyder, Sayantan Mahinder, Raviteja Anantha, Daben Liu, Sashank Gondala

专题命中 图谱与结构化RAG :retrieval augmented generation(abstract);RAG(abstract)

Comments Submitted to ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07483 2024-01-17 q-fin.CP 67%

Graph database while computationally efficient filters out quickly the ESG integrated equities in investment management

Partha Sen, Sumana Sen

专题命中 图谱与结构化RAG :retrieval augmented generation(abstract);RAG(abstract)

Comments 10 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.07472 2022-11-01 cs.CL cs.AI cs.IR cs.LG 67%

Robust Candidate Generation for Entity Linking on Short Social Media Texts

Liam Hebert, Raheleh Makki, Shubhanshu Mishra, Hamidreza Saghir, Anusha Kamath, Yuval Merhav

专题命中 图谱与结构化RAG :dense retrieval(abstract);分类 cs.IR、cs.CL、cs.AI

Comments 7 pages, 2 figures. Accepted to Proceedings of the Eighth Workshop on Noisy User-generated Text (W-NUT 2022). URL: https://aclanthology.org/2022.wnut-1.8

Journal ref Proceedings of the Eighth Workshop on Noisy User-generated Text (W-NUT 2022). pages 83-89

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25489 2026-08-27 cs.LG cs.CL cs.IR 新提交 62%

A Storage-Retrieval Gap in Parametric Knowledge Graph Memory

参数化知识图谱记忆中的存储-检索差距

Martino M. L. Pulici, Cuong Xuan Chu, Evgeny Kharlamov, Volker Tresp

机构 * Bosch Center for Artificial Intelligence(博世人工智能中心) LMU Munich(慕尼黑大学) University of Oslo(奥斯陆大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);分类 cs.IR、cs.CL

AI总结 该研究提出将知识图谱编译为 LoRA 适配器库的参数化知识存储方案,发现其存在存储的知识无法通过语义相似性检索的差距,为参数化知识图谱记忆的应用提供了思路并指出核心开放问题。

Comments 12 pages, 2 figures, 7 tables, accepted at SKGi 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04144 2026-08-06 cs.IR cs.CL cs.LG 新提交 62%

Neighborhood-Aware Dual Biomedical Entity Linking

感知邻域的双生物医学实体链接

Yicheng Tao, Jie Liu

专题命中 图谱与结构化RAG :retriever(abstract);分类 cs.IR、cs.CL

AI总结 针对生物医学实体链接的挑战,提出三阶段框架PILOT,在五个基准上取得最优性能且推理高效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25959 2026-07-30 cs.CL cs.AI 版本更新 62%

Detecting Knowledge Inconsistencies Across Text, Tables, and Knowledge Graphs

跨文本、表格和知识图谱检测知识不一致性

Fanfu Wei, Thibault Ehrhart, Raphaël Troncy

机构 * EURECOM(欧洲电信学院)

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 研究跨文本、表格和知识图谱的知识不一致性检测问题,提出\textsc{Kontrast}框架,通过文本到SPARQL和语言模型推理比较并分类不一致性,实验表明跨模态不一致性常见且有价值,为知识审计提供工具并建立基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12393 2026-07-27 cs.CL cs.AI 版本更新 62%

MedKGent: A Large Language Model Agent Framework for Constructing Temporally Evolving Medical Knowledge Graph

MedKGent:用于构建随时间演变的医学知识图谱的大语言模型智能体框架

Duzhen Zhang, Zixiao Wang, Zhong-Zhi Li, Yahan Yu, Shuncheng Jia, Jiahua Dong, Haotian Xu, Xing Wu, Yingying Zhang, Tielin Zhang, Jie Yang, Xiuying Chen, Le Song

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德大学人工智能学院) University of Chinese Academy of Sciences(中国科学院大学) Kyoto University(京都大学) Tsinghua University(清华大学) East China Normal University(华东师范大学) Center for Excellence in Brain Science and Intelligence Technology(脑科学与智能技术卓越中心) Brigham and Women’s Hospital, Harvard Medical School(哈佛医学院布里特妇女医院) GenBio AI

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 研究针对医学文献增长带来的知识结构化挑战,引入MedKGent框架,利用PubMed摘要通过两个智能体每日增量构建医学知识图谱,经评估其三元组有效性高,能显著改进大语言模型在医学问答基准上的检索增强生成。

Comments Accepted by Npj Digital Medicine

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11683 2026-07-14 cs.CL cs.AI 新提交 62%

RAGU: A Multi-Step GraphRAG Engine with a Compact Domain-Adapted LLM

RAGU:一个具有紧凑域适应语言模型的多步图检索增强生成引擎

Mikhail Komarov, Ivan Bondarenko, Stanislav Shtuka, Oleg Sedukhin, Roman Shuvalov, Yana Dementyeva, Matvey Solovyov, Nikolay O. Nikitin

机构 * ITMO University(圣彼得堡国立信息技术机械与光学大学) Novosibirsk State University(新西伯利亚国立大学) Far Eastern Federal University(远东联邦大学)

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 研究针对现有GraphRAG系统问题,提出RAGU引擎,通过分离提取与合并多步处理知识图。核心方法包括两阶段提取等。贡献在于训练的Meno-Lite-0.1模型表现出色,在多方面超越其他模型,且RAGU安装简单、运行要求低并开源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11491 2026-06-30 cs.CL cs.AI 62%

Ontology-Guided Reverse Thinking Makes Large Language Models Stronger on Knowledge Graph Question Answering

本体引导的反向思维使大语言模型在知识图谱问答中更强

Runxuan Liu, Bei Luo, Jiaqi Li, Baoxin Wang, Ming Liu, Dayong Wu, Shijin Wang, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Beijing University of Posts and Telecommunications(北京邮电大学) Joint Laboratory of HIT and iFLYTEK(哈工大与科大讯飞联合实验室) University of Science and Technology of China(中国科学技术大学) Pengcheng Laboratory(鹏城实验室)

专题命中 图谱与结构化RAG :knowledge retrieval(abstract);分类 cs.CL、cs.AI

AI总结 本文提出Ontology-Guided Reverse Thinking框架,通过反向推理构建路径,提升大语言模型在知识图谱问答中的表现,实验表明其在WebQSP和CWQ数据集上达到最佳性能。

Comments We now public our source codes

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17937 2026-05-26 cs.CL cs.AI 62%

BacktestBench: Benchmarking Large Language Models for Automated Quantitative Strategy Backtesting

BacktestBench:面向自动化量化策略回测的大语言模型基准测试

Zhensheng Wang, Wenmian Yang, Qingtai Wu, Lequan Ma, Yiquan Zhang, Weijia Jia

机构 * Beijing Normal University(北京师范大学) Elmleaf Ltd.(Elmleaf公司)

专题命中 图谱与结构化RAG :retriever(abstract);分类 cs.CL、cs.AI

AI总结 提出首个大规模自动化量化回测基准BacktestBench,包含18,246个问答对,并设计多智能体基线AutoBacktest,通过协调摘要器、检索器和编码器实现自然语言策略到可重复回测的转换。

Comments This paper has been accepted by KDD 2026 (Datasets and Benchmarks Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22843 2026-05-25 cs.CL cs.IR 62%

Knowledge Distillation for Low-Resource Open-source Text-to-SQL Model

面向低资源开源文本到SQL模型的知识蒸馏

Tianhao Qiu, Xiaojun Chen

机构 * Shenzhen University(深圳大学)

专题命中 图谱与结构化RAG :knowledge retrieval(abstract);分类 cs.IR、cs.CL

AI总结 针对低资源场景下文本到SQL任务中标注数据稀缺和领域知识缺失的问题,提出知识感知框架,通过构建任务特定知识库并注入训练和推理过程,提升开源和闭源大语言模型的性能。

Comments 17ages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18199 2026-05-19 cs.IR cs.AI 62%

PIPER: Content-Based Table Search via profiling and LLM-Generated Pseudoqueries

PIPER: 通过 profiling 和 LLM 生成的伪查询实现基于内容的表格搜索

Riccardo Terrenzi, Matteo Falconi, Serkan Ayvaz, Pierluigi Plebani

机构 * Centre for Industrial Software, University of Southern Denmark(丹麦南部大学工业软件中心) Department of Electronics, Information and Bioengineering, Politecnico di Milano(米兰理工学院电子、信息与生物工程系)

专题命中 图谱与结构化RAG :dense retrieval(abstract);分类 cs.IR、cs.AI

AI总结 针对数据湖、数据空间和开放数据门户中表格数据集快速增长的问题,PIPER 提出了一种基于内容的表格搜索方法,利用表格 profile 和 LLM 生成的伪查询进行密集检索,优于传统元数据方法和 TableQA 检索方法,展示了 LLM 基于内容建模在表格数据集搜索中的价值。

Comments 15 pages, 3 figures, accepted at DEXA'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17942 2026-05-11 cs.AI cs.DB 62%

LLM-Based SQL Generation: Prompting, Self-Refinement, and Adaptive Weighted Majority Voting

基于大型语言模型的SQL生成:提示、自我完善与自适应加权多数投票

Yu-Jie Yang, Hung-Fu Chang, Po-An Chen

机构 * Institute of Information Management(信息管理研究所) National Yang Ming Chiao Tung University(阳明交通大学) R. B. Annis School of Engineering(R. B. Annis工程学院) University of Indianapolis(印第安纳大学)

专题命中 图谱与结构化RAG :knowledge retrieval(abstract);分类 cs.AI、cs.DB

AI总结 本文提出SSEV管道,通过自我完善与加权多数投票提升SQL生成准确性,在多个基准测试中取得良好成绩,并进一步提出ReCAPAgent-SQL框架以应对企业数据库复杂性,提升实际应用效果。

Comments 29 pages, 22 figures

Journal ref 2026 International Conference on Information Management

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09069 2026-04-13 cs.CL cs.AI cs.LG 62%

NyayaMind- A Framework for Transparent Legal Reasoning and Judgment Prediction in the Indian Legal System

NyayaMind:一个用于印度法律体系中透明法律推理和判决预测的框架

Parjanya Aditya Shukla, Shubham Kumar Nigam, Debtanu Datta, Balaramamahanthi Deepak Patnaik, Noel Shallum, Pradeep Reddy Vanga, Saptarshi Ghosh, Arnab Bhattacharya

机构 * IIT Kanpur, India(印度理工学院坎普尔分校) IIT Kharagpur, India(印度理工学院克勒格布尔分校) Symbiosis Law School Pune, India(印度共生法学院浦那分校) Dattam Labs, India(印度Dattam实验室) University of Birmingham, Dubai, United Arab Emirates(英国伯明翰大学迪拜校区)

专题命中 图谱与结构化RAG :RAG(abstract);分类 cs.CL、cs.AI

AI总结 NyayaMind通过整合检索、推理和验证机制,提升印度司法系统中判决预测与解释的透明度和准确性,为可信的人工智能辅助法律决策提供新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05866 2026-04-08 cs.IR cs.CL cs.DL 62%

Beyond Paper-to-Paper: Structured Profiling and Rubric Scoring for Paper-Reviewer Matching

超越论文-论文:基于结构化资料和评分标准的论文-审稿人匹配

Yicheng Pan, Zhiyuan Ning, Ludi Wang, Yi Du

专题命中 图谱与结构化RAG :hybrid retrieval(abstract);分类 cs.IR、cs.CL

AI总结 本文提出P2R框架,通过结构化资料和评分标准提升论文与审稿人匹配效率,实验表明其优于现有方法。

Comments Accepted by IJCNN-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02276 2026-04-03 cs.AI cs.CL cs.LG 62%

De Jure: Iterative LLM Self-Refinement for Structured Extraction of Regulatory Rules

De Jure:基于迭代LLM自优化的结构化监管规则提取

Keerat Guliani, Deepkamal Gill, David Landsman, Nima Eshraghi, Krishna Kumar, Lovedeep Gondara

机构 * The Vanguard Group, Inc.(先锋集团)

专题命中 图谱与结构化RAG :RAG(abstract);分类 cs.CL、cs.AI

AI总结 De Jure通过四个阶段自动提取结构化监管规则,无需人工标注或领域知识,提升监管文本处理的效率和可追溯性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27141 2026-04-02 cs.DB cs.IR 62%

Compass: General Filtered Search across Vector and Structured Data

Compass:跨向量和结构化数据的通用过滤搜索

Chunxiao Ye, Xiao Yan, Eric Lo

专题命中 图谱与结构化RAG :vector search(abstract);分类 cs.IR、cs.DB

AI总结 Compass提出一种统一框架,实现向量与结构化数据的通用过滤搜索,无需新索引设计,通过协调候选生成和谓词评估,支持任意逻辑运算并优于现有框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21035 2026-04-01 cs.AI cs.CL 62%

CLAUSE: Agentic Neuro-Symbolic Knowledge Graph Reasoning via Dynamic Learnable Context Engineering

CLAUSE: 通过动态可学习上下文工程实现基于代理的神经符号知识图谱推理

Yang Zhao, Chengxiao Dai, Wei Zhuo, Yue Xiu, Dusit Niyato

机构 * Independent Researcher(独立研究员) School of Computer Science, The University of Sydney, Australia(悉尼大学计算机科学学院) College of Computing & Data Science, Nanyang Technological University, Singapore(南洋理工大学计算与数据科学学院)

专题命中 图谱与结构化RAG :RAG(abstract);分类 cs.CL、cs.AI

AI总结 CLAUSE通过动态可学习上下文工程实现神经符号知识图谱推理,优化多跳问答的准确率、延迟和成本,减少子图增长和端到端延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13366 2026-03-27 cs.CL cs.AI cs.LG 62%

CodeRefine: A Pipeline for Enhancing LLM-Generated Code Implementations of Research Papers

CodeRefine: 一种提升研究论文中大语言模型生成代码实现的管道

Ekaterina Trofimova, Emil Sataev, Abhijit Singh Jowhari

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 CodeRefine通过多步骤方法将论文方法转化为功能代码,利用预定义本体构建知识图谱,并通过回顾性检索增强生成方法提升代码准确性,有效解决理论研究与实践实现之间的桥梁问题。

Comments The results mentioned in the paper are non-reproducible. We have rechecked the metrics, and they do not match with the ones that have been provided in the paper. Therefore, we accept that this article is neither suitable nor up to the mark for the scientific community and must be with-drawn. We fully understand the consequences, and would like to wishfully retract this article

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21814 2026-03-20 cs.AI cs.CL 62%

Prompt Architecture Determines Reasoning Quality: A Variable Isolation Study on the Car Wash Problem

提示架构决定推理质量:关于汽车洗问题的变量隔离研究

Heejin Jo

机构 * Independent Researcher(独立研究者)

专题命中 图谱与结构化RAG :RAG(abstract);分类 cs.CL、cs.AI

AI总结 本文通过变量隔离研究,探讨了提示架构层在汽车洗问题推理中的作用,发现STAR框架可将准确率提升至85%,结合用户资料和RAG上下文后达到100%。

Comments 9 pages, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16002 2026-03-18 cs.CL cs.AI cs.LG 62%

RadAnnotate: Large Language Models for Efficient and Reliable Radiology Report Annotation

RadAnnotate:用于高效可靠放射科报告标注的大型语言模型

Saisha Pradeep Shetty, Roger Eric Goldman, Vladimir Filkov

机构 * Department of Computer Science, University of California, Davis, CA, USA(加州大学戴维斯分校计算机科学系) Department of Radiology, University of California, Davis, CA, USA(加州大学戴维斯分校放射学系)

专题命中 图谱与结构化RAG :RAG(abstract);分类 cs.CL、cs.AI

AI总结 本文提出RadAnnotate框架,通过检索增强合成报告和基于置信度的选择性自动化,减少放射科报告标注的人力成本,提升标注效率和可靠性。

Comments 10 pages, 3 figures. Accepted at AMIA Amplify Informatics Summit 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10900 2026-03-13 cs.IR cs.AI 62%

Tuning-Free LLM Can Build A Strong Recommender Under Sparse Connectivity And Knowledge Gap Via Extracting Intent

无需调优的LLM可通过提取意图在稀疏连接和知识缺口下构建强大的推荐系统

Wenqing Zheng, Noah Fatsi, Daniel Barcklow, Dmitri Kalaev, Steven Yao, Owen Reinert, C. Bayan Bruss, Daniele Rosa

机构 * Capital One

专题命中 图谱与结构化RAG :RAG(abstract);分类 cs.IR、cs.AI

AI总结 本文提出IKGR,一种基于LLM的意图知识图推荐系统,通过提取意图构建意图中心知识图,缓解稀疏性和冷启动问题,实现高效推荐。

Comments Accepted in Learning on Graphs (LoG) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06290 2026-03-09 cs.AI cs.CL 62%

The EpisTwin: A Knowledge Graph-Grounded Neuro-Symbolic Architecture for Personal AI

EpisTwin:一种基于知识图谱的神经符号架构用于个人AI

Giovanni Servedio, Potito Aghilar, Alessio Mattiace, Gianni Carmosino, Francesco Musicco, Gabriele Conte, Vito Walter Anelli, Tommaso Di Noia, Francesco Maria Donini

机构 * Politecnico di Bari(巴里理工大学) Università degli Studi della Tuscia(图斯卡大学)

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 EpisTwin通过构建个人知识图谱,结合多模态语言模型和代理协调器,实现对用户数据的语义理解和复杂推理,提升个人AI的可信度和整体认知能力。

详情

展开后加载摘要…

URL PDF HTML 收藏