arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-08-27 至 2026-08-27 共收录 23 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 7 篇

2608.25466 2026-08-27 cs.NE cs.AI 新提交 92%

Homo-RAG: Homology-Guided Retrieval-Augmented Generation for Cross-Species Gene Function Prediction

Homo-RAG:基于同源性引导检索增强生成的跨物种基因功能预测

Azrin Sultana

专题命中 检索器与排序 :RAG(title,title_cn);retrieval-augmented generation(title);分类 cs.AI

AI总结 本研究提出Homo-RAG框架,整合同源性引导多跳检索与证据感知排序,实现跨物种基因功能预测,在150个查询及7200份文档的评估中表现优异,为未充分研究生物的基因功能注释提供了实用方案。

Comments 29 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25486 2026-08-27 cs.AI cs.CL 新提交 91%

PonsRAG: A Pons-Inspired RAG Bridging Cognitive Islands for Coordinated Long Narrative Reasoning

PonsRAG:受脑桥启发的RAG,用于连接认知孤岛以实现协调的长文本推理

Rongchen Zhao, Yu Chen, Juyuan Wang, Zhouting Mo, Jianxing Yu, Wenqing Chen, Jingping Liu

机构 * School of Future Technology, South China University of Technology(华南理工大学未来技术学院) TikTok Inc(字节跳动公司) School of Artificial Intelligence, Sun Yat-sen University(中山大学人工智能学院) School of Software Engineering, Sun Yat-sen University(中山大学软件工程学院)

专题命中 检索器与排序 :RAG(title,title_cn);retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 针对现有RAG方法的认知孤岛化与跨层证据脱节问题,提出受脑桥启发的PonsRAG框架,通过三层索引与协调推理组件,在四项长文本叙事基准上实现多项选择任务平均准确率11.56%的相对提升。

Comments Accepted to EMNLP 2026 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24977 2026-08-27 cs.CR cs.CL cs.LG 新提交 91%

Retrieved But Not Reliable: A Survey on Attacks, and Defenses in Retrieval-Augmented Generation

可检索但不可靠:检索增强生成中的攻击与防御研究综述

Minh Tran, Cuong Dang, Tuc Nguyen, Khanh-Tung Tran, Minh Huynh Nguyen, Trinh Chau, Kien Le, Do Xuan Long, Jiahao Zhang, Hoang D. Nguyen, Thanh Le, Suhang Wang

专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);RAG(summary_cn,abstract);retriever(abstract);分类 cs.CL

AI总结 本综述针对检索增强生成(RAG)的安全与鲁棒性问题,形式化其各阶段威胁模型,分类攻击目标并梳理各阶段防御及评估方法,为该领域提供统一研究框架。

Comments 24 pages, 6 figures. Accepted to Findings of the Association for Computational Linguistics: EMNLP 2026. Peer-reviewed through ACL Rolling Review (ARR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25487 2026-08-27 cs.CL cs.IR 新提交 90%

ReliableRAG: Combating Misinformation in Retrieval-Augmented Generation via Reliability-Guided Reasoning Chains

ReliableRAG:通过可靠性引导推理链对抗检索增强生成中的错误信息

Jinpu Jiang, Xuan Wu, Wenhao Song, Bo Yang, You Zhou, Hongwei Ge, Heow Pueh Lee, Yanchun Liang, Chunguo Wu

机构 * College of Software, Jilin University(吉林大学软件学院) College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院) Key Laboratory of Symbolic Computation and Knowledge Engineering of Ministry of Education, College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院 教育部符号计算与知识工程重点实验室) College of Computer Science and Technology, Dalian University of Technology(大连理工大学计算机科学与技术学院) National University of Singapore(新加坡国立大学) School of Computer Science, Zhuhai College of Science and Technology(珠海科技学院计算机学院)

专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);RAG(summary_cn,abstract);分类 cs.IR、cs.CL

AI总结 ReliableRAG是首个通过细粒度评估三元组缓解多跳问答中欺骗性错误信息的可靠性驱动框架,可提升RAG系统的事实可靠性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25392 2026-08-27 cond-mat.mtrl-sci 新提交 82%

Interpretable physics-informed retrieval-augmented generation language model for end-to-end inorganic crystal synthesis planning

用于端到端无机晶体合成规划的可解释物理信息增强检索生成语言模型

Wei-Jian Jiang, Ye-Nan Sha, Hui Guo, Jie Chen, Yu-Cai Liang, Ke Zhou, Qi-Long Gao, Dong-Lin Han, Xin-Gao Gong, Wan-Jian Yin

专题命中 检索器与排序 :retrieval-augmented generation(title,abstract)

AI总结 本研究开发可解释PIRAG-LM模型,构建含13820种晶体的SSKB,合成方法预测准确率达91.4%,指导合成5种新化合物,为材料发现与实验搭建桥梁。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25521 2026-08-27 cs.IR 新提交 79%

Query Expansion Is More Than Generation: Improving Dense Retrieval through Better Integration

查询扩展不止是生成:通过更好的集成改进密集检索

Siyuan Sun, Mihai Surdeanu

专题命中 检索器与排序 :dense retrieval(title);retriever(abstract);分类 cs.IR

AI总结 该研究针对LLM生成查询扩展导致密集检索器性能下降的问题,提出无需训练的AnchorQE方法,通过编码原始查询与扩展内容并插值,在多个数据集上提升检索效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25100 2026-08-27 cs.AI cs.LG 新提交 57%

Towards Reliable, Generalizable, and Specific In-Context Knowledge Editing via Multi-Objective Reinforcement Learning

面向可靠、可泛化且特定的上下文内知识编辑:多目标强化学习方法

Xuzhong Wang, Maiqi Jiang, Tejal Nair, Girija Bhusal, Yanfu Zhang, Haipeng Chen

机构 * College of William and Mary(威廉玛丽学院) Tribhuvan University(特里布文大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

AI总结 针对现有上下文内知识编辑方法难以平衡可靠、泛化、特定目标的问题,提出多目标强化学习算法MO-IKE,在Llama-3.2上多项指标较以往方法显著提升。

Comments Our work proposes a multi-objective reinforcement learning algorithm that optimizes prompt construction for reliable, generalizable, and specific in-context knowledge-editing

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 向量检索 1 篇

2608.25735 2026-08-27 cs.CR cs.AI cs.IR cs.LG 新提交 88%

Pointing the Way, Hiding the Destination: Practical Private Dense Retrieval at Scale

指明路径,隐藏目的地:大规模实用私有密集检索

Peichun Hua, Danyang Chen, Junan Zhang, Haifeng Sun, Jingyu Wang, Diwen Xue, Mingyu Li, Yunming Xiao

专题命中 向量检索 :dense retrieval(title,abstract);RAG(abstract,abstract_cn);retrieval-augmented generation(abstract);分类 cs.IR、cs.AI

AI总结 该研究针对私有密集检索的成本与质量平衡问题,将深度哈希用作私有过滤器,结合加密重排序等技术,在保证检索准确性的同时降低了延迟,满足差分隐私要求,实现了大规模实用的私有密集检索。

Comments 30 pages, 9 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 知识库问答 3 篇

2608.25717 2026-08-27 cs.CL cs.AI 新提交 91%

When RAG Fails to Equalize: Geo-bias in Factual Question Answering over Public Companies

当检索增强生成(RAG)无法实现均衡:上市公司事实问答中的地理偏差

Abhinav Havaldar, Enrico Santus

机构 * Bloomberg(彭博公司)

专题命中 知识库问答 :RAG(title,title_cn);retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 该研究针对上市公司事实问答场景,构建含约2000家公司的基准,评估六个LLM在四种条件下的表现,发现RAG无法消除地理偏差,更大模型也无法消除结构性影响,挑战了RAG作为通用纠正手段的观点。

Comments 10 pages, COLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25123 2026-08-27 cs.CL cs.AI 新提交 90%

SelfGraphRAG: Bridging the Supervision Gap in Graph-Based RAG with Synthetic QA Generation

SelfGraphRAG:通过合成问答对弥合基于图的检索增强生成(RAG)中的监督缺口

Ben Lagnese, Manas Gaur

机构 * University of Maryland, Baltimore County (UMBC)(马里兰大学巴尔的摩县分校)

专题命中 知识库问答 :RAG(title,title_cn);retrieval-augmented generation(abstract);retriever(abstract);分类 cs.CL、cs.AI

AI总结 SelfGraphRAG框架通过从知识图谱结构生成问答对训练查询条件图检索器,解决新建图谱缺乏标注数据的问题,在多跳问答等任务中提升了检索与推理性能。

Comments 16 pages, 2 figures. Based on M.S. thesis work. Thesis available at this https URL (https://www.proquest.com/docview/3350071346). Under review. Code available upon request from manas@umbc.edu

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25655 2026-08-27 cs.CL cs.AI 新提交 73%

Reconstructing the Right Episode: Evaluating Interleaved Conversational Memory Beyond Long Context

重构正确的会话片段:超越长上下文的交错式对话记忆评估

Zhexi Feng, Ruiyi Zhang, Yongbo Yang, Pengtao Xie

机构 * University of California San Diego(加利福尼亚大学圣迭戈分校)

专题命中 知识库问答 :RAG(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 针对混合主题长对话的记忆难题,研究人员构建了SCALE-QA基准,并提出TSIM方法,在三类LLM后端上均比最强基线提升5.6-17.6个准确率点,实现最优表现。

Comments 19 pages, 6 figures, 30 tables. Accepted to the Main Conference of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长文档RAG 1 篇

2608.25115 2026-08-27 cs.CL cs.IR 新提交 91%

Less can be More: Relieving RAG Bottlenecks via Evidence Frontloading and Pressure-Adaptive Budgeting

少即是多:通过证据前置和压力自适应预算缓解RAG瓶颈

Weibin Cai, Reza Zafarani

机构 * Syracuse University(雪城大学)

专题命中 长文档RAG :RAG(title,title_cn);retrieval-augmented generation(abstract);分类 cs.IR、cs.CL

AI总结 该研究针对RAG系统瓶颈转移问题,提出无训练框架PACE,结合证据前置与压力自适应预算,在多跳问答数据集及模拟中提升了证据召回率并降低了重排序密集型负载的延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 图谱与结构化RAG 5 篇

2608.24921 2026-08-27 cs.AI 新提交 91%

post-graph-rag: A PostgreSQL-Native Graph RAG Engine

post-graph-rag:一款原生PostgreSQL图检索增强生成引擎

Chandan Rajah

专题命中 图谱与结构化RAG :RAG(title,title_cn);retrieval-augmented generation(abstract);分类 cs.AI

AI总结 post-graph-rag是一款开源PostgreSQL原生图RAG引擎,解决现有图RAG的基础设施、图质量、时间累积问题,在三语料库对比中构建更优图且支持时间演化特性

Comments 22 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25960 2026-08-27 cs.AI 新提交 90%

LivingRAG: Augmenting Graph RAG with Experience

LivingRAG:用经验增强图检索增强生成(Graph RAG)

Yuzhuo Cui, Zongye Zhang, Qingjie Liu

机构 * Beihang University(北京航空航天大学) Hangzhou Innovation Institute, Beihang University(北京航空航天大学杭州创新研究院)

专题命中 图谱与结构化RAG :RAG(title,title_cn);分类 cs.AI

AI总结 本研究提出具备可复用推理经验的LivingRAG框架,通过在Graph RAG中添加可写入经验存储,提升多跳问答准确率并减少完成令牌使用量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25986 2026-08-27 cs.AI 新提交 89%

Multi-Granularity Context-Enhanced RAG over Multimodal Knowledge Graphs

面向多模态知识图谱的多粒度上下文增强检索增强生成

Zongyu Wu, Yilong Wang, Xiaochen Wang, Minhua Lin, Zhichao Xu, Fenglong Ma, Xiang Zhang, Suhang Wang

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) University of Utah(犹他大学)

专题命中 图谱与结构化RAG :RAG(title,summary_cn);retrieval-augmented generation(abstract);分类 cs.AI

AI总结 针对现有多模态知识图谱RAG方法的语义鸿沟问题,本文提出CEMMKG框架,通过多粒度局部与全局上下文增强,有效提升了多模态GraphRAG的性能与适用性。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24902 2026-08-27 cs.HC cs.AI 新提交 77%

Beyond the Chatbot: Co-Learning and Co-Teaching through a Dual-Persona Generative-AI Assistant

超越聊天机器人:通过双角色生成式AI助手实现共学与共教

Chaido Mizeli, Marina Delianidi, Konstantinos Diamantaras

专题命中 图谱与结构化RAG :RAG(abstract,abstract_cn);retrieval augmented generation(abstract);分类 cs.AI

AI总结 该研究开发一款适配希腊教育领域的双角色生成式AI助手,可切换教学/学习角色,支持师生共学共教,构建了连接技术与课程的教学生成助手框架。

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25489 2026-08-27 cs.LG cs.CL cs.IR 新提交 62%

A Storage-Retrieval Gap in Parametric Knowledge Graph Memory

参数化知识图谱记忆中的存储-检索差距

Martino M. L. Pulici, Cuong Xuan Chu, Evgeny Kharlamov, Volker Tresp

机构 * Bosch Center for Artificial Intelligence(博世人工智能中心) LMU Munich(慕尼黑大学) University of Oslo(奥斯陆大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);分类 cs.IR、cs.CL

AI总结 该研究提出将知识图谱编译为 LoRA 适配器库的参数化知识存储方案,发现其存在存储的知识无法通过语义相似性检索的差距,为参数化知识图谱记忆的应用提供了思路并指出核心开放问题。

Comments 12 pages, 2 figures, 7 tables, accepted at SKGi 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 多模态RAG 2 篇

2608.26091 2026-08-27 cs.IR cs.CL cs.CV 新提交 91%

PlanSightRAG: A Visual-First Multimodal RAG for Automating Question Answering and Compliance Checking for Civil Standard Plans

PlanSightRAG:面向民用标准图纸的自动化问答与合规检查的视觉优先多模态检索增强生成模型

Nabaraj Subedi, Shuvo Dip Datta, Ahmed Abdelaty, Shivanand Venkanna Sheshappanavar

专题命中 多模态RAG :RAG(title,summary_cn);retriever(abstract,abstract_cn);retrieval-augmented generation(abstract);分类 cs.IR、cs.CL

AI总结 针对民用标准图纸的OCR自动化方法会丢失关键几何信息,本文提出视觉优先多模态RAG框架PlanSightRAG,整合多向量检索与智能体架构,构建基准数据集并验证其在检索、合规检查任务上的性能,还实现了自主视觉规则 grounding。

Comments 32 pages, 9 figures, 25 tables. Preprint submitted to Automation in Construction

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25780 2026-08-27 cs.IR 新提交 57%

PUMA: Post-Hoc Sparsification of Universal Multimodal Embeddings for Efficient Retrieval

PUMA:用于高效检索的通用多模态嵌入的事后稀疏化

Matteo Attimonelli, Alessandro De Bellis, Franco Maria Nardini, Claudio Pomo, Cosimo Rulli, Rossano Venturini, Tommaso Di Noia

专题命中 多模态RAG :dense retrieval(abstract);分类 cs.IR

AI总结 针对通用多模态嵌入的高存储与推理成本问题,提出无需微调主干网络的PUMA稀疏自编码器方案,在五个基准上验证其可实现8-16倍存储压缩与最高25倍检索加速,且多数数据集性能与密集检索相当或更优。

详情

展开后加载摘要…

URL PDF HTML 收藏

7. RAG评测 4 篇

2608.24888 2026-08-27 cs.AI 新提交 81%

SIMGUIDE: Procedurally Grounded Multi-Context Representations for Personalized Agent Planning

SIMGUIDE:用于个性化智能体规划的过程式基础多上下文表示

Chirag Shah

机构 * University of Washington(华盛顿大学)

专题命中 RAG评测 :RAG(summary_cn,abstract);分类 cs.AI

AI总结 本研究针对个性化AI智能体无法适配用户多场景优先级的问题,提出SIMGUIDE方法,构建SIMBENCH基准验证,发现过程式基础的Sims优于RAG,且表示格式是关键设计变量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24976 2026-08-27 cs.DL 新提交 75%

A Comparative Evaluation of Digitization Pipelines for Historiographical Sources

史学资料数字化处理管道的对比评估

Marina Gómez Rey, Patricia Callejo, Mario Muñoz-Organero, Carlos Alario-Hoyos

专题命中 RAG评测 :RAG(abstract,abstract_cn);retrieval-augmented generation(abstract)

AI总结 本研究对比评估了13种PDF转文本提取管道,发现Marker直接提取性能最优,LLM后校正无系统性改进,端到端解析是异构历史藏品的可靠方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25618 2026-08-27 cs.CL 新提交 70%

AWM: Answerable Working Memory for Long-Document VQA Agents

AWM:面向长文档VLM智能体的可回答工作记忆

Dongzhuoran Zhou, Yuqicheng Zhu, Yule Liu, Zhen Yang, Rui Lu, Yuxiao Dong, Jie Tang, Evgeny Kharlamov

机构 * University of Oslo(奥斯陆大学) Bosch Center for AI(博世人工智能中心) University of Stuttgart(斯图加特大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Tsinghua University(清华大学)

专题命中 RAG评测 :RAG(abstract,abstract_cn);分类 cs.CL

AI总结 针对长文档VQA智能体的记忆质量盲区,提出AWM方法,通过融入仅记忆可回答性的GRPO奖励机制,提升了最终答案准确率并降低记忆缺失正确的比例。

Comments EMNLP 2026 Findings. 16 pages, 4 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25952 2026-08-27 cs.CY cs.MA 新提交 67%

Spatial-Knowledge-Graph-Grounded LLM Agents for Neighborhood Livability Evaluation

基于空间知识图谱的大语言模型智能体用于社区宜居性评估

Haiyan Hao

专题命中 RAG评测 :RAG(abstract,abstract_cn)

AI总结 该研究提出结合空间知识图谱与大语言模型智能体的框架,通过生成修订家庭日程等评估社区宜居性,发现设施可用性不代表便利可达,为关联空间机会与居民体验提供可审计方法。

Comments 31 pages, 4 figures, prototype framework

详情

展开后加载摘要…

URL PDF HTML 收藏