arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-08-24 至 2026-08-24 共收录 12 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 5 篇

2509.20377 2026-08-24 cs.CL cs.AI 版本更新 93%

SKILL-RAG: Self-Knowledge Induced Learning and Filtering for Retrieval-Augmented Generation

SKILL-RAG:用于检索增强生成的自知识诱导学习与过滤方法

Tomoaki Isoda

机构 * Tomoaki Isoda(独立研究者)

专题命中 检索器与排序 :RAG(title,title_cn);retrieval-augmented generation(title,abstract);分类 cs.CL、cs.AI

AI总结 该研究针对RAG的幻觉问题,提出SKILL-RAG方法,通过强化学习框架引出模型自知识,过滤无关检索内容,在多个问答基准上提升生成质量并减少输入文档数量。

Comments The author has decided not to pursue further development or publication of this work. Since the current manuscript represents an incomplete research project and no revised version is planned, the author requests that the article be withdrawn

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06519 2026-08-24 cs.CL 版本更新 89%

MedRAGChecker: Claim-Level Verification for Biomedical Retrieval-Augmented Generation

MedRAGChecker: 用于生物医学检索增强生成的声明级验证

Yuelyu Ji, Min Gu Kwak, Hang Zhang, Xizhi Wu, Chenyu Li, Yanshan Wang

机构 * University of Pittsburgh(匹兹堡大学)

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(title,abstract);分类 cs.CL

AI总结 MedRAGChecker通过声明级验证和诊断框架,提高生物医学RAG生成答案的可靠性与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21951 2026-08-24 cs.IR cs.CR 版本更新 83%

SIREN (Luring LLMs onto the Rocks): PAIR-Driven Preference Manipulation in Web-RAG Recommenders

SIREN(诱使大语言模型陷入困境):网页增强型大语言模型推荐系统中基于配对驱动的偏好操纵

Evan Caville, Spencer Kayser, Siamak Layeghy, Billy Sung, Sara Dolnicar, Marius Portmann

专题命中 检索器与排序 :RAG(title,abstract);分类 cs.IR

AI总结 研究网页增强型大语言模型推荐系统中排序推荐的对抗操纵问题,提出SIREN方法,利用23种内容中毒技术迭代编辑检索到的网页,在两个Claude模型上实验,使选定实体多次达排名第1,验证了声明性排名等方式的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15698 2026-08-24 cs.CV cs.IR 版本更新 70%

ConceptFormer: Learning Adaptive Latent Concepts for Query-Document Alignment in Visual Document Retrieval

ConceptFormer:学习自适应潜在概念以实现视觉文档检索中的查询-文档对齐

Chunyi Peng, Zhipeng Xu, Yukun Yan, Zhenghao Liu, Shi Yu, Sen Mei, Yubo Sun, Yongheng Zhang, Jie Zhou, Yu Gu, Ge Yu, Maosong Sun

机构 * Northeastern University(东北大学) Tsinghua University(清华大学) Peking University(北京大学)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);retriever(abstract);分类 cs.IR

AI总结 针对视觉文档检索中现有监督信号的局限,本文提出ConceptFormer框架,以自适应潜在概念为中间表示衔接语义鸿沟,在基准测试中较最强基线实现了16.7%、22.1%的NDCG@10相对提升,性能优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16205 2026-08-24 cond-mat.mtrl-sci cs.AI physics.chem-ph 版本更新 70%

ChemGraph-XANES: An Agentic Framework for XANES Simulation and Curation

ChemGraph-XANES:用于XANES模拟与分析的代理框架

Vitor F. Grizzi, Thang Duc Pham, Luke N. Pretzie, Jiayi Xu, Murat Keceli, Cong Liu

机构 * Chemical Sciences and Engineering Division Argonne National Laboratory(阿贡国家实验室化学科学与工程部) Computational Science Division Argonne National Laboratory(阿贡国家实验室计算科学部)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 本文提出ChemGraph-XANES框架,结合自然语言任务描述与结构获取,实现XANES模拟与分析的自动化,支持高通量计算与机器学习应用。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 向量检索 2 篇

2607.09885 2026-08-24 cs.CL 版本更新 57%

Index SLM Technical Report

索引SLM技术报告

Tianjiao Li, Lusheng Zhang, Shien He, Xiaojing Liu, Tianxing Yan, Mengran Yu, Ziang Cui, Kai Zhao, Xipeng Wang, Yang Liu, Yuxin Li

机构 * Bilibili(哔哩哔哩)

专题命中 向量检索 :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 哔哩哔哩开发Index-1.9B系列小语言模型,包括基础模型等四个模型。预训练采用特定方法,Index-1.9B-Base在标准基准测试表现出色,还进行了多项控制研究,所有模型及评估代码已公开。

Comments 16 pages, 9 figures. v3: updated author list to add Xipeng Wang

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22180 2026-08-24 cs.DC cs.LG 版本更新 50%

FeLoG: Scalable and Efficient Distributed Graph Embedding with Feedback Loop Mechanism

FeLoG:具有反馈循环机制的可扩展高效分布式图嵌入

Peng Fang, Arijit Khan, Ziqiang Wu, Zhenli Li, Yibo Zhou, Fang Wang, Dan Feng

机构 * Huazhong University of Science and Technology(华中科技大学) Bowling Green State University(伯灵顿州立大学)

专题命中 向量检索 :retrieval-augmented generation(abstract)

AI总结 提出FeLoG系统,通过反馈耦合采样与训练、活动感知通信和轮次交错流水线,实现分布式图嵌入的加速和资源高效利用。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 长文档RAG 1 篇

2608.17950 2026-08-24 cs.CL 版本更新 84%

Do Large Language Models Play Six Degrees of Separation? Measuring Topological Compression in Long-Context Manifolds

大型语言模型是否遵循六度分隔理论?测量长上下文流形中的拓扑压缩

Md. Faiyaz Abdullah Sayeedi

机构 * BRAC University(BRAC大学)

专题命中 长文档RAG :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本研究通过分析LLM隐藏状态流形的几何结构,发现深度推理层的语义锚点遵循六度分隔理论,该拓扑特性可用于RAG的零样本幻觉检测,为评估事实可靠性提供了几何指标。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图谱与结构化RAG 2 篇

2508.12536 2026-08-24 cs.DB cs.DS cs.IR 版本更新 88%

jXBW: A Compressed Index Enabling Structure-Aware JSONL Retrieval for Structured RAG

jXBW: 面向结构化RAG中结构感知JSONL检索的压缩索引

Yasuo Tabei

专题命中 图谱与结构化RAG :RAG(title,title_cn);retrieval-augmented generation(abstract);分类 cs.IR、cs.DB

AI总结 提出jXBW压缩索引,通过合并树表示、基于扩展Burrows-Wheeler变换的简洁树索引和三阶段子结构搜索算法,实现查询依赖的复杂度,在百万级JSONL数据集上比最强基线快16倍至2800倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02450 2026-08-24 cs.CV 版本更新 50%

Reason-Then-Retrieve for CoVR-R with Structured Edit Prompts and Dense-Sparse Fusion

先推理后检索:面向CoVR-R的结构化编辑提示与密集-稀疏融合

Dongqing Liu, Mengshi Qi, Hongwei Ji

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 图谱与结构化RAG :dense retrieval(abstract)

AI总结 针对CoVR-R任务,提出一种零样本的“先推理后检索”流水线,利用Qwen3.5-27B生成结构化描述和密集嵌入,并结合TF-IDF稀疏分支进行融合排序,在验证集和测试集上取得了领先性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. RAG评测 2 篇

2608.11238 2026-08-24 cs.AI 版本更新 92%

Towards Query-Agnostic RAG Evaluation via Query Coverage and Claim Verifiability

面向查询不可知的RAG评估:基于查询覆盖率与声明可验证性

Jeonghwan Choi, Taewon Yun, Minjeong Ban, Gyeonghun Sun, Jae-Gil Lee, Hwanjun Song

专题命中 RAG评测 :RAG(title,title_cn);retrieval-augmented generation(abstract);retriever(abstract);分类 cs.AI

AI总结 本文提出Q-CARE框架,通过分解查询与答案实现RAG的细粒度评估,在8个数据集的基准测试中,其评估结果与人工判断的相关性优于现有4种RAG评估指标。

Comments Accepted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23740 2026-08-24 cs.CL 版本更新 57%

ZenGen: Social Mind for LLMs

Zing:大语言模型的社交智能

ZenGen Team, Ao Xiang, Bi Jingping, Chen Jiahui, Chen Lehan, Chen Yilin, Cheng Xueqi, Fan Yixing, Gan Kairong, Gao Haowen, Gao Jinhua, Gao Shuxuan, Gong Chang, Guo Jiafeng, Guo Ruijie, Han Zhouyu, He Guangfu, He Yichun, Jiang Shuo, Jing Shaoling, Jing Ya, Lei Chenhao, Lei Yan, Li Anqi, Li Chengao, Li Haoyu, Li Shitian, Liang Xinjian, Liu Zhaoge, Lyu Xingyu, Nie Zhuwei, Pang Liang, Quan Zeping, Shan Shiguang, Shen Huawei, Tang Xinran, Tian Feng, Wang Qian, Wang Ruiping, Wang Xiaohong, Xia Zaiyu, Xiao Yi, Xu Jiayuan, Xu Kehan, Xu Qianqian, Xu Tianyu, Xu Yongjun, Yang Haoming, Yang Jun, Yao Di, Yu Xiaoming, Zhang Futong, Zhang Jie, Zhang Shixuan, Zhang Yuxuan, Zhao Xinyu, Zhao Zhuoran, Zhong Yunfei, Zhu Shengyu

专题命中 RAG评测 :RAG(abstract);分类 cs.CL

AI总结 研究大语言模型社交智能,提出Zijing框架,含测量基准SoMBench、训练方法Zing及推理架构Actio,通过实验证明社交智能大语言模型在评估、内化和落地方面需协同发展。

详情

展开后加载摘要…

URL PDF HTML 收藏