arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2025-12-04 至 2025-12-04 共收录 10 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 4 篇

2512.03413 2025-12-04 cs.IR cs.AI 84%

BookRAG: A Hierarchical Structure-aware Index-based Approach for Retrieval-Augmented Generation on Complex Documents

BookRAG: 一种面向复杂文档的基于层次结构的索引方法用于检索增强生成

Shu Wang, Yingli Zhou, Yixiang Fang

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);RAG(abstract);分类 cs.IR、cs.AI

AI总结 BookRAG通过构建层次化索引结构,提升复杂文档在问答任务中的检索与生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18303 2025-12-04 cs.LG cond-mat.mes-hall cond-mat.mtrl-sci 78%

Hierarchical Deep Research with Local-Web RAG: Toward Automated System-Level Materials Discovery

分层深度研究与本地Web RAG:迈向自动化系统级材料发现

Rui Ding, Rodrigo Pires Ferreira, Yuxin Chen, Junhong Chen

机构 * Pritzker School of Molecular Engineering, University of Chicago(芝加哥大学普利兹克分子工程学院) Chemical Sciences and Engineering Division, Argonne National Laboratory(阿贡国家实验室化学科学与工程 division) Department of Computer Science, University of Chicago(芝加哥大学计算机科学系)

专题命中 检索器与排序 :RAG(title);retrieval-augmented generation(abstract)

AI总结 本文提出一种分层深度研究代理,通过本地Web RAG和DToR机制,实现低成本高质的自动化系统级材料发现。

Comments A preliminary version appeared in The AI for Accelerated Materials Discovery (AI4Mat) Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03724 2025-12-04 cs.CL 70%

MemOS: A Memory OS for AI System

MemOS:人工智能系统中的内存操作系统

Zhiyu Li, Chenyang Xi, Chunyu Li, Ding Chen, Boyu Chen, Shichao Song, Simin Niu, Hanyu Wang, Jiawei Yang, Chen Tang, Qingchen Yu, Jihao Zhao, Yezhaohui Wang, Peng Liu, Zehao Lin, Pengyuan Wang, Jiahao Huo, Tianyi Chen, Kai Chen, Kehang Li, Zhen Tao, Huayi Lai, Hao Wu, Bo Tang, Zhengren Wang, Zhaoxin Fan, Ningyu Zhang, Linfeng Zhang, Junchi Yan, Mingchuan Yang, Tong Xu, Wei Xu, Huajun Chen, Haofen Wang, Hongkang Yang, Wentao Zhang, Zhi-Qin John Xu, Siheng Chen, Feiyu Xiong

机构 * MemTensor (Shanghai) Technology Co., Ltd.(MemTensor(上海)科技有限公司) Institute for Advanced Algorithms Research, Shanghai(上海先进算法研究所) Research Institute of China Telecom(中国电信研究院) Tongji University(同济大学) Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学) Peking University(北京大学) Renmin University of China(中国人民大学) Beihang University(北航) Shanghai Jiao Tong University(上海交通大学)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

AI总结 MemOS是一种面向人工智能系统的内存操作系统,通过统一管理不同类型的内存资源,提升长上下文推理和持续个性化的能力。

Comments 36 pages, 10 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00882 2025-12-04 cs.CV cs.AI 57%

Look, Recite, Then Answer: Enhancing VLM Performance via Self-Generated Knowledge Hints

看、复述、然后回答:通过自动生成的知识提示提升VLM性能

Xisheng Feng

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI

AI总结 通过自动生成的知识提示提升VLM性能,采用模块化设计减少幻觉,实现精准农业中杂草识别准确率的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 向量检索 1 篇

2512.03389 2025-12-04 cs.DB 57%

Continuous Prompts: LLM-Augmented Pipeline Processing over Unstructured Streams

连续提示:基于大语言模型的流处理管道处理

Shu Chen, Deepti Raghavan, Uğur Çetintemel

专题命中 向量检索 :RAG(abstract);分类 cs.DB

AI总结 本文提出连续提示框架,通过引入大语言模型的持续推理能力,实现对无结构流的持久语义处理,并通过动态优化提升效率与精度的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 知识库问答 1 篇

2512.03100 2025-12-04 cs.CR cs.AI 70%

Ensemble Privacy Defense for Knowledge-Intensive LLMs against Membership Inference Attacks

知识密集型大语言模型的集成隐私防御:对抗成员推断攻击

Haowei Fu, Bo Ni, Han Xu, Kunpeng Liu, Dan Lin, Tyler Derr

机构 * Vanderbilt University(范德比大学) University of Arizona(亚利桑那大学) Clemson University(克莱姆森大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 本文提出集成隐私防御框架EPD,通过聚合知识注入LLM、基础LLM和专用判断模型的输出,有效降低成员推断攻击的成功率,提升知识密集型大语言模型的隐私安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图谱与结构化RAG 2 篇

2508.08785 2025-12-04 cs.CL 79%

Privacy-protected Retrieval-Augmented Generation for Knowledge Graph Question Answering

隐私保护的检索增强生成用于知识图谱问答

Yunfeng Ning, Mayi Xu, Jintao Wen, Qiankun Pi, Yuanyuan Zhu, Ming Zhong, Jiawei Jiang, Tieyun Qian

专题命中 图谱与结构化RAG :retrieval-augmented generation(title);RAG(abstract);分类 cs.CL

AI总结 本文提出ARoG框架,通过关系中心和结构导向的抽象策略,解决隐私保护下的知识图谱问答中的检索与隐私问题。

Comments Accepted by AAAI 2026, camera ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03501 2025-12-04 cs.CY 50%

SocraticAI: Transforming LLMs into Guided CS Tutors Through Scaffolded Interaction

SocraticAI: 通过支架式交互将LLMs转化为指导性计算机科学导师

Karthik Sunil, Aalok Thakkar

专题命中 图谱与结构化RAG :RAG(abstract)

AI总结 SocraticAI通过结构化约束将LLMs整合到计算机科学教育中,培养学生战略性的人工智能交互能力。

Comments Presented in the Best Practices Track of COMPUTE 2025 (arXiv:2512.02349)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 多模态RAG 1 篇

2512.03276 2025-12-04 cs.LG 71%

Too Late to Recall: Explaining the Two-Hop Problem in Multimodal Knowledge Retrieval

太迟回忆:多模态知识检索中双跳问题的解释

Constantin Venhoff, Ashkan Khakzar, Sonia Joseph, Philip Torr, Neel Nanda

机构 * University of Oxford(牛津大学) McGill University(麦吉尔大学) Meta MATS

专题命中 多模态RAG :knowledge retrieval(title)

AI总结 本文研究了多模态知识检索中双跳问题的影响,发现VLMs在处理视觉输入时过晚解决实体表示导致事实回忆性能下降,并提出通过修补和提示方法恢复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. RAG评测 1 篇

2505.10792 2025-12-04 cs.CL 88%

Finetune-RAG: Fine-Tuning Language Models to Resist Hallucination in Retrieval-Augmented Generation

Finetune-RAG: 通过微调语言模型抵抗检索增强生成中的幻觉

Zhan Peng Lee, Andre Lin, Calvin Tan

机构 * Pints AI Labs(Pints AI 实验室)

专题命中 RAG评测 :retrieval-augmented generation(title,abstract);RAG(title,abstract);分类 cs.CL

AI总结 Finetune-RAG通过微调方法提升LLM事实准确性,提出首个RAG训练数据集和压力测试评估流程。

详情

展开后加载摘要…

URL PDF HTML 收藏