arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-08-26 至 2026-08-26 共收录 16 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 9 篇

2608.23965 2026-08-26 cs.CR cs.AI cs.IR cs.LG 新提交 89%

RAGSentinel: Certifiable Geometric Consensus for Robust Retrieval-Augmented Generation

RAGSentinel:用于鲁棒检索增强生成的可验证几何共识

Yueyang Quan, Anjun Gao, Yufei Xia, Minghong Fang, Zhuqing Liu

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(title,abstract);分类 cs.IR、cs.AI

AI总结 研究针对RAG系统的中毒攻击漏洞,提出无训练无标签的RAGSentinel防御方法,通过几何共识过滤中毒文档,实验显示其能低攻高保准且抗自适应攻击。

Comments To appear in EMNLP 2026 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24214 2026-08-26 cs.AI 新提交 89%

MetaRAG: Belief-Action Aligned Policy Optimization for Agentic RAG

MetaRAG:面向智能体检索增强生成的信念-行动对齐策略优化

Qiuyi Qi, Tian Liang, Jiamu Wang, Jinjian Zhang, Wei Zhou, Pengcheng Zhu, Linjian Mo, Ming Kong, Jie Liu, Qiang Zhu

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) City University of Hong Kong(香港城市大学)

专题命中 检索器与排序 :RAG(title,summary_cn);retrieval-augmented generation(abstract);分类 cs.AI

AI总结 MetaRAG是面向智能体RAG的信念-行动对齐策略优化框架,通过优先验证的行动生成与内部信念探测,提升了智能体RAG的准确率-效率权衡,收益可迁移至多种场景与模型。

Comments EMNLP 2026 MainConference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23908 2026-08-26 cs.AI 新提交 87%

Retrieval-augmented generation vs. deterministic tax computation in multi-agent financial advisory: A 2x2 factorial experiment

多智能体金融咨询中检索增强生成与确定性税费计算的对比:一项2×2析因实验

Aryan Brar, Justin Du, Avery Lor, Kylie Seto, Eric Taylor

机构 * Royal Bank of Canada(加拿大皇家银行) RBC Borealis

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(title);分类 cs.AI

AI总结 通过2×2析因实验发现,为多智能体金融咨询系统配备RAG与定制税费引擎,仅税费引擎会显著降低税费节省,仅RAG时表现最优,说明LLM内化金融知识或已足够,无需额外工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23992 2026-08-26 cs.IR cs.AI 新提交 73%

Hybrid Semantic Tool Discovery for Enterprise MCP Gateway: Architecture and Implementation

企业MCP网关的混合语义工具发现:架构与实现

Olympia Saha, Amy Wang, Srinivasan Manoharan

专题命中 检索器与排序 :vector search(abstract);hybrid retrieval(abstract);分类 cs.IR、cs.AI

AI总结 针对企业MCP网关的上下文饱和与工具发现难题,提出SCOUT方案,通过混合检索的MCP元工具实现优化,在PayPal生产环境中大幅降低工具令牌消耗与推理成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24060 2026-08-26 cs.IR cs.CL cs.DB 新提交 67%

SQLite is Enough. Lexical, Semantic, and Hybrid Search with scrydb

SQLite 就足够了:使用 scrydb 的词汇、语义及混合搜索

Timo Breuer

专题命中 检索器与排序 :vector search(abstract);分类 cs.IR、cs.CL、cs.DB

AI总结 本研究推出 Python 库 scrydb,基于 SQLite 的 FTS5 和 sqlite-vec 扩展实现词汇、语义及混合搜索,经 IR 基准数据集验证,可为信息检索或智能体搜索下游任务提供轻量高效的解决方案。

Comments Software available at this https URL (https://github.com/breuert/scrydb)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24764 2026-08-26 cs.AI 新提交 57%

Evidence Blindness in Direct Corpus Interaction: Persistent Navigation with AtlasNav

直接语料库交互中的证据失明:基于AtlasNav的持久导航

Hongyu Guo, Zhiyu Zheng, Zhao Cao

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 针对直接语料库交互中存在的证据失明问题,提出AtlasNav框架,通过一次性构建语料库图谱实现自适应导航,在BrowseComp-Plus等数据集上提升了准确率并降低了推理成本。

Comments 27 pages, 7 figures. Code, data, and trajectories will be released

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24089 2026-08-26 cs.IR 新提交 57%

CodeHID: Learning an Addressable Hierarchical Code Index for Generative Code Retrieval

CodeHID:学习用于生成式代码检索的可寻址分层代码索引

Zhen Li, Yuhong Chen, Wenhao Xu, Xiaodong Li, Hui Li

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 CodeHID是一种生成式代码检索框架,通过伪邻居引导的文档ID学习与双阶段文档ID生成引导构建分层索引,在CoSQA和ProCQA基准上大幅优于现有检索方法

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24042 2026-08-26 cs.RO cs.AI cs.LG 新提交 57%

Hierarchical Skill Retrieval for Data-Efficient Adaptation of Vision-Language-Action Models

用于视觉-语言-动作模型数据高效适配的分层技能检索

Haoran Hao, Shahram Najam Syed, Jeff Schneider, Jeffrey Ichnowski

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.AI

AI总结 针对视觉-语言-动作模型在有限演示下适配性能下降的问题,提出分层技能检索框架,结合子任务语言检索与行为特征重排序,在LIBERO基准及真实机器人任务上提升平均成功率10.3%和21.3%。

Comments Project Page: this https URL (https://hoar012.github.io/HSR-Project)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24039 2026-08-26 cs.RO cs.AI 新提交 57%

Design-to-Plan: A Large Language Model-Based Multi-Agent Framework for Manufacturing Process Planning from 3D CAD Models and 2D Engineering Drawings

Design-to-Plan:基于大语言模型的多智能体框架,用于从3D CAD模型和2D工程图生成制造工艺规划

Muhammad Tayyab Khan, Lequn Chen, Wenhe Feng, Seung Ki Moon

机构 * Singapore Institute of Manufacturing Technology (SIMTech), Agency for Science, Technology and Research (A*STAR)(新加坡制造技术研究院(新加坡科学、技术与研究局)) Advanced Remanufacturing and Technology Centre (ARTC), Agency for Science, Technology and Research (A*STAR)(先进再制造与技术中心(新加坡科学、技术与研究局)) School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与宇航工程学院)

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI

AI总结 该研究提出Design-to-Plan多智能体框架,结合LLM与确定性模块,实现从3D CAD及2D图纸到制造工艺规划的端到端自动化,经300个基准案例验证,性能优异且令牌用量显著降低。

Comments Submitted to Elsevier Journal

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 向量检索 1 篇

2608.23862 2026-08-26 cs.IR 新提交 79%

AdaWidth: Query-Adaptive Embedding Width for Dense Retrieval

AdaWidth:面向密集检索的查询自适应嵌入宽度

Shubing Yang, Dongfang Zhao

专题命中 向量检索 :dense retrieval(title,abstract);分类 cs.IR

AI总结 AdaWidth通过正交前缀适配器和轻量级路由器,使密集检索的查询自适应评估维度数,在6项任务和5个冻结编码器上,以更少维度达到当前最先进方法的NDCG@10性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 知识库问答 1 篇

2608.24310 2026-08-26 cs.AI 新提交 57%

OPDSearch+: On-Policy Distillation with RL Refinement for Search-Augmented Reasoning

OPDSearch+:用于搜索增强推理的带RL优化的在线策略蒸馏

Qinglin Ye, Zhiyuan Gu, Jingjie Xia, Yiheng Zhang, Kaiyan Zhao, Shunchao Zheng, Yuhang Mu, Wenchao Du, Yiming Wang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Macau(澳门大学) Wuhan University(武汉大学) Georgia Institute of Technology(佐治亚理工学院) Northwestern Polytechnical University(西北工业大学) University of Hong Kong(香港大学)

专题命中 知识库问答 :retriever(abstract);分类 cs.AI

AI总结 OPDSearch+是无需教师微调的搜索增强推理蒸馏范式,利用冻结的现成指令模型分两阶段优化3B模型,在7个QA基准上优于所有3B RL基线,HotpotQA和2WikiMultihopQA分别提升13.1%、8.5%。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图谱与结构化RAG 2 篇

2608.23811 2026-08-26 cs.AI 新提交 77%

Generating Biomedical Fact-Checking Reports with RL-Enhanced Agentic Search

用强化学习增强的智能体搜索生成生物医学事实核查报告

Jiongxiao Wang, Dingli Ma, Chaoqun Ni

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) University of Washington(华盛顿大学)

专题命中 图谱与结构化RAG :RAG(abstract,abstract_cn);retrieval-augmented generation(abstract);分类 cs.AI

AI总结 该研究提出BioCheck Agent智能体结合EG-GRPO强化学习方法,生成生物医学事实核查报告,在SciFact数据集上提升了标签预测准确率、证据质量并降低了幻觉率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23918 2026-08-26 cs.AI cs.MA cs.PL 新提交 70%

MARS: Multi-Specialist LLM Relay System for Competitive Programming

MARS:用于竞赛编程的多专家大语言模型中继系统

Andrei Mikhailov, Mikhail Burtsev, Alsu Sagirova

机构 * MIRAI London Institute for Mathematical Sciences(伦敦数学科学研究院) AXXX

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract_cn);分类 cs.AI

AI总结 MARS是用于竞赛编程的多专家LLM中继框架,通过检索选择算法领域专家组成流水线,在CodeContests测试集上以更低成本和方差达到0.624±0.006的通过率,缩小了与CodeSIM的差距。

Comments 13 pages, 8 figures, EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

5. RAG评测 3 篇

2608.24753 2026-08-26 cs.CL cs.AI 新提交 91%

The RAT: A Unified Bayesian Model for RAG Evaluation

RAT:一种用于RAG评估的统一贝叶斯模型

Pius von Däniken, Felix Matthias Saaro, Mark Cieliebak, Jan Deriu

机构 * Centre for Artificial Intelligence(人工智能中心) ZHAW School of Engineering(苏黎世应用科技大学工程学院)

专题命中 RAG评测 :RAG(title,title_cn);retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 针对RAG系统评估的不足,提出RAT统一贝叶斯框架,联合建模多维度指标,通过27种配置验证其能揭示系统差异,还分析了注释分配并扩展模型以结合人工与自动评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23601 2026-08-26 cs.AR cs.LG cs.MA 新提交 75%

StateTune: Transforming LLM-Assisted EDA Flow Tuning into a Stateful, Closed-Loop Process

StateTune:将大语言模型辅助的EDA流程调优转化为有状态的闭环过程

Kunlong Li, Shangshang Yao, Su Zheng, Lingli Wang

专题命中 RAG评测 :RAG(abstract,abstract_cn);retrieval-augmented generation(abstract)

AI总结 StateTune将LLM辅助的EDA调优改为有状态闭环过程,以持久优化记忆为核心,结合EHVI引导的提升策略,在六个基准模块上性能优于多个基线,验证了设计有效性。

Comments Accepted to the 2026 IEEE/ACM International Conference on Computer-Aided Design (ICCAD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23568 2026-08-26 cs.AI 新提交 70%

RENDER: Controlling Reader-Facing Evidence in LLM Memory Evaluation

RENDER:控制LLM记忆评估中面向读者的证据

Yuan Si, Simeng Han, Daming Li, Jialu Zhang

机构 * University of Waterloo(滑铁卢大学) Stanford University(斯坦福大学)

专题命中 RAG评测 :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 RENDER是控制LLM记忆评估中面向读者证据的基准,实验显示其相关数据包比原始对话表现更优,效果可迁移,提示需关注评估中的读者面向人工制品。

详情

展开后加载摘要…

URL PDF HTML 收藏