arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-08-31 至 2026-08-31 共收录 12 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 8 篇

2608.27809 2026-08-31 cs.IR 新提交 92%

LINE Conversation History Retrieval for Personal Memory RAG: Evaluating Search Representations and Hybrid Retrieval

用于个人记忆检索增强生成(RAG)的LINE对话历史检索:评估搜索表示与混合检索

Akito Hattori

专题命中 检索器与排序 :RAG(title,title_cn);hybrid retrieval(title,abstract);retrieval-augmented generation(abstract);retriever(abstract)

AI总结 本研究针对一名用户的LINE对话历史开展检索增强生成的初始案例,构建三种搜索表示并对比多种检索方法,发现特定混合检索配置在100个评估问题上的检索性能最优,但研究存在单用户单标注等局限性。

Comments 16 pages, 6 figures, 10 tables. Exploratory single-user case study

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28572 2026-08-31 cs.IR 新提交 87%

PULSAR: Pooled Unified Late-Interaction Search and Retrieval for Enterprise Visual Document RAG

PULSAR:面向企业视觉文档RAG的池化统一后期交互搜索与检索

Benjamin Constable, Anup Roy, Vishal Sharma, Rishabh Upadhyay, Robin Mills, Aidan Millar

专题命中 检索器与排序 :RAG(title,title_cn);分类 cs.IR

AI总结 针对企业视觉文档RAG的检索难题,提出PULSAR系统,采用池化两阶段后期交互索引,在延迟、QPS、成本等指标上显著优于OCR基线,已在生产环境大规模应用。

Comments Accepted at EMNLP 2026 (Industry Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28389 2026-08-31 cs.CR cs.CL 新提交 84%

CamoDocs: A Poisoning Attack Against Retrieval-Augmented Language Models Using Camouflaged Documents

CamoDocs:针对检索增强语言模型的伪装文档中毒攻击

Jaewon Jung, Haizhong Zheng, Hongsun Jang, Jaeyong Song, Beidi Chen, Jinho Lee

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本研究提出CamoDocs伪装文档中毒攻击,将对抗性文档伪装在良性内容中,在多种RAG防御、LLM及专有模型上实现高攻击成功率,同时避免易被检测的查询重叠痕迹。

Comments Accepted to EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28155 2026-08-31 cs.CL 新提交 81%

FinExam-10K: When Retrieval Helps Financial Reasoning?

FinExam-10K:检索如何助力金融推理?

Yan Lin, Jingyu Sun, Zhongliang Guo, Qing Li, Zhuohan Xie, Yuxia Wang

机构 * Newcastle University(纽卡斯尔大学) University of Manchester(曼彻斯特大学) University of Melbourne(墨尔本大学) University of Aberdeen(阿伯丁大学) University of Groningen(格罗宁根大学) MBZUAI(穆罕默德·本·扎耶德人工智能大学) INSAIT Sofia University “St. Kliment Ohridski”(索非亚大学“圣·克利门特·奥赫里德斯基”)

专题命中 检索器与排序 :RAG(summary_cn,abstract);分类 cs.CL

AI总结 本研究推出覆盖CFA与FRM全体系的最大金融推理基准FinExam-10K,测试17个模型后发现FunctionGraph-RAG经门控调用可小幅提升留存题准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27470 2026-08-31 cs.CL cs.AI cs.DB 新提交 67%

Select, Don't Train: The Benefits of Modular Entity Disambiguation with LLM-Based Selection

选择,而非训练:基于大语言模型(LLM)选择的模块化实体消歧的优势

Fina Polat, Daniel Daza, Pengyu Zhang, Klim Zaporojets, Paul Groth

机构 * University of Amsterdam(阿姆斯特丹大学) Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) Aarhus University(奥胡斯大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL、cs.AI、cs.DB

AI总结 该研究提出将实体消歧的检索与选择解耦,基于LLM选择器对比不同检索策略,发现无需训练的BM25搭配LLM选择器在ZELDA基准上达到先进性能,还支持检测到检索失败时弃权,提升了实体消歧效果。

Comments Accepted at the 25th International Semantic Web Conference (ISWC 2026), Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27945 2026-08-31 cs.AI 新提交 57%

Cross-Session Decomposition Attacks: Scaling Risk and Intent-Aligned Retrieval Defense

跨会话分解攻击:规模风险与意图对齐检索防御

Disen Liao, Yihan Wang, Freda Shi, Yaoliang Yu

机构 * University of Waterloo(滑铁卢大学) Vector Institute(向量研究所)

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

AI总结 该研究聚焦跨会话分解攻击的规模风险,提出IntentAlign-MiniLM防御方法,实验显示更大的Qwen3、Gemma3系列模型在该攻击下有害能力提升更显著,所提防御效果优于更大嵌入模型。

Comments 30 pages, 3 figures, EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27925 2026-08-31 cs.CL 新提交 57%

Entity-Memory Graph Retrieval Improves Evidence Coverage in Long-Conversation Question Answering

实体记忆图检索提升长对话问答中的证据覆盖率

Shumao Sun

机构 * Tsinghua University(清华大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL

AI总结 该研究提出实体记忆图检索方法,在10个LoCoMo对话的1986个问题上,使top-k=25的证据召回率提升约4.74个百分点,实现检索覆盖增益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27912 2026-08-31 cs.IR 新提交 57%

ITER: Interaction-Aware Retrieval for Agentic Search

ITER:面向智能体搜索的交互感知检索

Haodong Chen, Shuai Wang, Yu Yin, Shengyao Zhuang, Guido Zuccon, Teerapong Leelanupab

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 本文提出交互感知稠密检索器ITER,利用智能体轨迹学习信号训练,在六种智能体骨干上优于LRAT,跨智能体鲁棒性强于AgentIR,在两个基准上获显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 长文档RAG 2 篇

2608.28160 2026-08-31 cs.AR cs.AI cs.HC 新提交 81%

Gen-TAS: A Generative AI-Aided Hardware-Software Task Allocation Framework for FPGA-GPP Heterogeneous Systems

Gen-TAS:面向FPGA-GPP异构系统的生成式AI辅助软硬件任务分配框架

Mary Kong, Yuqin Zhao, Semih Vazgecen, Cristian Sestito, Themis Prodromakis

专题命中 长文档RAG :RAG(summary_cn,abstract);分类 cs.AI

AI总结 Gen-TAS是一种知识增强LLM框架,结合任务图分析与RAG技术,为FPGA-GPP异构系统生成用户特定的可解释任务分配策略,在CNN、SDR工作负载实验中实现稳定的需求驱动分配,延迟导向场景下获显著加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27924 2026-08-31 cs.CL 新提交 81%

What Makes Agent Memory Useful for Reliable Unanswerable Question Handling?

是什么让智能体记忆对可靠的无答案问题处理有用?

Chuanyuan Tan, Junjie Yu, Yuxin Wang, Yining Zheng, Xipeng Qiu, Wenliang Chen

机构 * School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院) Suzhou City University(苏州城市学院) Shanghai Key Lab of Intelligent Information Processing(上海智能信息处理重点实验室) College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学技术与人工智能学院) Shanghai Innovation Institute(上海创新研究院)

专题命中 长文档RAG :RAG(summary_cn,abstract);分类 cs.CL

AI总结 该研究在agentic RAG框架下,评估不同记忆方法对UAQ处理的作用,发现记忆提升UAQ性能具选择性,程序与规则类记忆结合互补信号效果最优,可靠UAQ记忆依赖保留可迁移行为指导。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. RAG评测 2 篇

2608.27661 2026-08-31 cs.CL cs.AI 新提交 91%

Knowing Before Answering: Decoding Language Models for Reliable RAG

先知后答:为可靠检索增强生成(RAG)解码语言模型

Syed Mahbubul Huq, Christopher Child, Tillman Weyde, Pranava Madhyastha

机构 * City St George’s, University of London(伦敦城市圣乔治大学) The Alan Turing Institute(阿兰·图灵研究所)

专题命中 RAG评测 :RAG(title,title_cn);retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 本研究针对RAG中检索信息不足或冲突的问题,构建标注数据集,利用语言模型的隐藏激活等特征训练线性分类器,实现可靠的RAG分类,性能优于基线及专用RAG模型。

Comments Accepted at the Third Conference on Language Modeling (COLM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27471 2026-08-31 cs.AI cs.CL 新提交 89%

Retrieving Relations, Detecting Fallacies: A RAG Approach to Political Debate Analysis

检索关系,检测谬误:一种用于政治辩论分析的RAG方法

Deborah Dore, Greta Damo, Elena Cabrio, Serena Villata

机构 * CNRS(法国国家科学研究中心) INRIA(法国国家信息与自动化研究所) I3S(信息、信号与系统实验室)

专题命中 RAG评测 :RAG(title,title_cn);分类 cs.CL、cs.AI

AI总结 该研究针对政治辩论中谬误自动检测的需求,提出引导式RAG方法,利用论证关系动态检索外部知识,在ElecDeb60to20基准上使谬误检测与分类性能显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏