arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 391 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 长文档RAG 391 篇

2605.05811 2026-07-29 cs.AI 版本更新 57%

Sheet As Token: A Graph-Enhanced Representation for Multi-Sheet Spreadsheet Understanding

表格作为标记:一种增强图的多表表格理解表示

Yiming Lei, Yuhang Yao, Yujia Zhang, Yiqi Wang, Bo Guan, Depei Zhu, Chunhui Wang, Zhuonan Hao, Tianyu Shi

机构 * Effyic Technology Co., Ltd(Effyic技术有限公司) McGill University(麦吉尔大学)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 本文提出Sheet as Token框架,通过图增强方法将每个工作表视为统一语义单元,提升多表表格检索能力,实验表明图增强的跨表推理在有限计算下优于浅层图基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01744 2026-07-21 cs.CL 57%

Octopus v2: On-device language model for super agent

章鱼v2:用于超级代理的设备端语言模型

Wei Chen, Zhiyuan Li

机构 * Stanford University(斯坦福大学)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

AI总结 章鱼v2通过设备端20亿参数模型,在准确性和延迟上超越GPT-4,同时将上下文长度减少95%,提升边缘设备应用性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18781 2026-06-18 cs.CL 新提交 57%

Lost in a Single Vector: Improving Long-Document Retrieval with Chunk Evidence Aggregation

迷失在单一向量中:通过分块证据聚合改进长文档检索

Shanshan Lyu, Yiwei Wang, Yujun Cai, Jiafeng Guo, Shenghua Liu

机构 * Chongqing University(重庆大学) State Key Laboratory of AI Safety(人工智能安全国家重点实验室) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of California, Merced(加州大学默塞德分校) University of Queensland(昆士兰大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 长文档RAG :dense retrieval(abstract);分类 cs.CL

AI总结 针对长文档检索中单向量编码削弱关键片段证据的问题,提出无训练的分块证据聚合策略DICE,通过独立编码分块并聚合为单一向量,在保持标准接口的同时显著提升检索性能。

Comments Code is available at https://github.com/PunchlineAAAA/DICE

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28004 2026-05-28 cs.CL 57%

Beyond Chunk-Local Extraction: Cross-Chunk Graph Augmentation for GraphRAG

超越块级抽取:面向GraphRAG的跨块图增强

Jiaming Zhang, Yibo Zhao, Jing Yu, Jianxiang Yu, Xiang Li

机构 * School of Data Science and Engineering, East China Normal University(数据科学与工程学院,东华大学)

专题命中 长文档RAG :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 提出CrossAug方法,利用GNN引导的跨块图增强,在查询前离线补充GraphRAG索引中缺失的跨块关系,提升多跳和长文档问答性能。

Comments 15 pages, 5 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03270 2026-04-07 cs.CL 57%

Knowledge Packs: Zero-Token Knowledge Delivery via KV Cache Injection

知识包:通过KV缓存注入实现零token知识传递

Andrey Pustovit

机构 * Independent Researcher(独立研究员)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

AI总结 本文提出知识包,通过预计算的KV缓存实现零token成本的知识传递,实验显示在正确格式下,知识包在700个问题上无差异,比RAG节省95%token,同时支持RAG无法实现的行为引导。

Comments 12 pages, 3 figures, 8 tables. Code: https://github.com/cnails/kv-knowledge-packs

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19737 2026-03-27 cs.LG cs.AI cs.CY 57%

Predicting Human Mobility during Extreme Events via LLM-Enhanced Cross-City Learning

通过LLM增强的跨城市学习预测极端事件中的人类移动

Yinzhou Tang, Huandong Wang, Xiaochen Fan, Yong Li

机构 * Department of Electronic Engineering, Beijing National Research Center for Information Science and Technology (BNRist), Tsinghua University(清华大学电子工程系、北京信息科学与技术国家研究中心)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 本文提出X-MLM框架,利用LLM建模移动意图,跨城市转移极端事件对移动意图的影响知识,提升极端事件中的人类移动预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20218 2026-03-24 cs.CL cs.LG 57%

An experimental study of KV cache reuse strategies in chunk-level caching systems

基于块级缓存系统的KV缓存重用策略实验研究

Samuel Cestola, Tianxiang Xia, Zheng Weiyan, Zheng Pengfei, Diego Didona

专题命中 长文档RAG :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文通过实验探讨块级缓存系统中KV缓存重用策略的局限性与优化方法,提出一种融合现有技术的改进设计以提升准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20866 2026-03-19 cs.CR cs.AI 57%

AVIATOR: Towards AI-Agentic Vulnerability Injection Workflow for High-Fidelity, Large-Scale Code Security Dataset

AVIATOR:面向高保真、大规模代码安全数据集的AI代理漏洞注入流程

Amine Lbath, Massih-Reza Amini, Aurelien Delaitre, Vadim Okun

机构 * National Institute of Standards and Technology, Software and Systems Division(美国国家标准与技术研究院软件与系统 division) Université Grenoble Alpes, CNRS, LIG(格勒诺布尔阿尔卑斯大学,法国国家科学研究中心,LIG实验室)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 本文提出AVIATOR,首个AI代理漏洞注入框架,通过协调AI代理、工具分析和迭代自我纠正,生成高保真漏洞数据,提升漏洞检测模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15666 2026-03-18 cs.AI 57%

Compiled Memory: Not More Information, but More Precise Instructions for Language Agents

编译记忆:不是更多信息,而是为语言代理提供更精确的指令

James Rhodes, George Kang

机构 * AlphaBitCore, Inc.(AlphaBitCore公司)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 本文提出Atlas内存内核,通过编译积累的任务经验为语言代理生成指令结构,无需微调、RAG或人工干预,提升GPT-4o和Claude Sonnet~4.5在合同分析和多跳问答任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14229 2026-03-17 cs.AI cs.SE 57%

Agentic DAG-Orchestrated Planner Framework for Multi-Modal, Multi-Hop Question Answering in Hybrid Data Lakes

基于代理的DAG编排规划框架:用于混合数据湖中多模态、多跳问答系统

Kirushikesh D B, Manish Kesarwani, Nishtha Madaan, Sameep Mehta, Aldrin Dennis, Siddarth Ajay, Rakesh B R, Renu Rajagopal, Sudheesh Kairali

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 本文提出A.DOT规划框架,通过编译自然语言查询为DAG执行计划,实现多模态多跳问答,提升准确性和效率,并生成可追溯的证据链。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12963 2026-03-16 cs.CL 57%

Long-form RewardBench: Evaluating Reward Models for Long-form Generation

长文奖励基准:评估长文生成的奖励模型

Hui Huang, Yancheng He, Wei Liu, Muyun Yang, Jiaheng Liu, Kehai Chen, Bing Xu, Conghui Zhu, Hailong Cao, Tiejun Zhao

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

AI总结 本文提出Long-form RewardBench,首个专为长文生成设计的奖励模型评估平台,通过五个子任务评估20+主流模型,揭示分类与生成模型在长文奖励建模上的差异。

Comments Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09222 2026-03-11 cs.CL 57%

LooComp: Leverage Leave-One-Out Strategy to Encoder-only Transformer for Efficient Query-aware Context Compression

LooComp: 通过留一法策略提升仅编码器Transformer的查询感知上下文压缩效率

Thao Do, Dinh Phu Tran, An Vo, Seon Kwon Kim, Daeyoung Kim

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 长文档RAG :retrieval augmented generation(abstract);分类 cs.CL

AI总结 LooComp通过留一法策略提升仅编码器Transformer的查询感知上下文压缩效率,实现高效压缩与高吞吐量推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16974 2026-02-20 cs.IR 57%

Beyond Chunk-Then-Embed: A Comprehensive Taxonomy and Evaluation of Document Chunking Strategies for Information Retrieval

超越片段化后再嵌入:信息检索中文档片段化策略的全面分类与评估

Yongjie Zhou, Shuai Wang, Bevan Koopman, Guido Zuccon

专题命中 长文档RAG :dense retrieval(abstract);分类 cs.IR

AI总结 本文研究了文档片段化策略在信息检索中的分类与评估,发现任务依赖性和分段方法差异影响效果,提出统一框架并提供公开基准。

Comments Github link will be pushed later as it's anonymoused at the moment

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20659 2026-01-29 cs.CL cs.MA 57%

A Dialectic Pipeline for Improving LLM Robustness

辩证管道用于提升大语言模型鲁棒性

Sara Candussio

机构 * Università degli Studi di Trieste(特里埃斯特大学)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

AI总结 本文提出一种辩证管道,通过自我对话提升大语言模型的鲁棒性,有效减少幻觉并提高输出质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09631 2026-01-26 cs.CL 57%

LLMs Got Rhythm? Hybrid Phonological Filtering for Greek Poetry Rhyme Detection and Generation

LLMs Got Rhythm? 希腊诗歌押韵检测与生成的混合语音过滤

Stergios Chatzikyriakidis, Anastasia Natsina

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

AI总结 本文提出混合语音学算法与LLMs结合,解决希腊诗歌押韵检测与生成问题,通过验证循环提升性能至73.1%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16904 2026-01-19 cs.CR cs.CL 57%

How Good is Post-Hoc Watermarking With Language Model Rephrasing?

在语言模型重述中后置水印技术有多好?

Pierre Fernandez, Tom Sander, Hady Elsahar, Hongyan Chang, Tomáš Souček, Valeriu Lacatusu, Tuan Tran, Sylvestre-Alvise Rebuffi, Alexandre Mourachko

机构 * FAIR, Meta Superintelligence Labs(FAIR、Meta超智能实验室)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

AI总结 本文研究了语言模型重述中后置水印技术的效果,发现简单方法在某些情况下表现优异,但对可验证文本效果不佳。

Comments Code at https://github.com/facebookresearch/textseal

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10342 2026-01-16 cs.AI 57%

C-GRASP: Clinically-Grounded Reasoning for Affective Signal Processing

C-GRASP:基于临床的感知信号处理推理

Cheng Lin Cheng, Ting Chuan Lin, Chai Kai Chang

机构 * Department of Physics National Central University(物理系国立中央大学) Center for Education National Central University(教育中心国立中央大学)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 C-GRASP通过临床基础推理提升情感信号处理的准确性与临床一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09937 2026-01-16 cs.HC cs.IR 57%

From SERPs to Agents: A Platform for Comparative Studies of Information Interaction

从搜索结果页面到代理:一个用于信息交互比较研究的平台

Saber Zerhoudi, Michael Granitzer

专题命中 长文档RAG :RAG(abstract);分类 cs.IR

AI总结 UXLab是一个开源平台,用于比较信息交互系统,通过无代码实验设计支持多模态交互研究。

Journal ref Proceedings of the 2026 ACM SIGIR Conference on Human Information Interaction and Retrieval (CHIIR '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09760 2026-01-16 cs.SE cs.AI 57%

Investigating Tool-Memory Conflicts in Tool-Augmented LLMs

探究工具增强大语言模型中的工具-记忆冲突

Jiali Cheng, Rui Pan, Hadi Amiri

机构 * University of Massachusetts Lowell(马萨诸塞大学洛约拉分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 本文提出工具-记忆冲突的概念,发现现有LLMs在STEM任务中存在该问题,并评估了现有解决方法的不足。

Comments R2-FM Workshop @ ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16391 2025-12-19 cs.LG cs.AI cs.DC 57%

Kascade: A Practical Sparse Attention Method for Long-Context LLM Inference

Kascade:一种适用于长上下文LLM推理的实用稀疏注意力方法

Dhruv Deshmukh, Saurabh Goyal, Nipun Kwatra, Ramachandran Ramjee

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 Kascade是一种无需训练的稀疏注意力方法,通过锚定层计算Top-k索引并重用,实现长上下文LLM推理中的高效注意力处理。

Comments 11 pages, 8 figures, 3 tables and 1 algorithm

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19562 2025-12-05 quant-ph cs.AI 57%

PennyCoder: Efficient Domain-Specific LLMs for PennyLane-Based Quantum Code Generation

PennyCoder: 用于PennyLane量子代码生成的高效领域特定LLM

Abdul Basit, Minghao Shao, Muhammad Haider Asif, Nouhaila Innan, Muhammad Kashif, Alberto Marchisio, Muhammad Shafique

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 PennyCoder是一种针对PennyLane量子编程的高效领域特定LLM,通过本地部署和低秩适应技术提升量子代码生成的准确性和效率。

Comments 6 pages, 5 figures, 3 tables, paper accepted to QCE 2025

Journal ref 2025 IEEE International Conference on Quantum Computing and Engineering (QCE), Albuquerque, NM, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02749 2025-11-05 cs.AI 57%

Using Span Queries to Optimize for Cache and Attention Locality

Paul Castro, Nick Mitchell, Nathan Ordonez, Thomas Parnell, Mudhakar Srivatsa, Antoni Viros i Martin

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

Comments 12 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25816 2025-10-31 cs.CL cs.LG 57%

Beyond Long Context: When Semantics Matter More than Tokens

Tarun Kumar Chawdhury, Jon D. Duke

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 长文档RAG :retrieval augmented generation(abstract);分类 cs.CL

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14900 2025-10-17 cs.AI cs.CR 57%

Mapping Smarter, Not Harder: A Test-Time Reinforcement Learning Agent That Improves Without Labels or Model Updates

Wen-Kwang Tsao, Yao-Ching Yu, Chien-Ming Huang

机构 * AI Lab, TrendMicro(趋势科技人工智能实验室)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13828 2025-10-17 cs.CL 57%

From Explainability to Action: A Generative Operational Framework for Integrating XAI in Clinical Mental Health Screening

Ratna Kandala, Akshata Kishore Moharir, Divya Arvinda Nayak

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04488 2025-10-07 cs.AI cs.IT math.IT 57%

Multi-Agent Collaborative Intelligence: Dual-Dial Control for Reliable LLM Reasoning

Edward Y. Chang, Ethan Y. Chang

机构 * Stanford University(斯坦福大学) UIUC(伊利诺伊大学香槟分校)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

Comments 27 pages, 5 figures, 21 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20625 2025-09-30 cs.CL 57%

Long Context Scaling: Divide and Conquer via Multi-Agent Question-driven Collaboration

Sibo Xiao, Zixin Lin, Wenyang Gao, Hui Chen, Yue Zhang

机构 * College of Computer Science, Zhejiang University(浙江大学计算机学院) NLP Lab, Westlake University(西湖大学自然语言处理实验室)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21848 2025-09-29 cs.LG cs.AI 57%

Graph of Agents: Principled Long Context Modeling by Emergent Multi-Agent Collaboration

Taejong Joo, Shu Ishida, Ivan Sosnovik, Bryan Lim, Sahand Rezaei-Shoshtari, Adam Gaier, Robert Giaquinto

机构 * Department of Industrial Engineering & Management Sciences, Northwestern University(工业工程与管理科学系,西北大学) Autodesk Research(Autodesk研究)

专题命中 长文档RAG :retrieval-augmented generation(abstract);分类 cs.AI

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08903 2025-09-12 cs.CL 57%

Noise or Nuance: An Investigation Into Useful Information and Filtering For LLM Driven AKBC

Alex Clay, Ernesto Jiménez-Ruiz, Pranava Madhyastha

机构 * City St George's, University of London(伦敦城市圣乔治大学) The Alan Turing Institute, British Library(艾伦·图灵研究所,大英图书馆)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

Comments 8 pages, 1 figure, accepted to the ISWC 2025 LM-KBC Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17852 2025-07-25 cs.MA cs.AI 57%

Technical Implementation of Tippy: Multi-Agent Architecture and System Design for Drug Discovery Laboratory Automation

Yao Fehlis, Charles Crain, Aidan Jensen, Michael Watson, James Juhasz, Paul Mandel, Betty Liu, Shawn Mahon, Daren Wilson, Nick Lynch-Jonely, Ben Leedom, David Fuller

机构 * Artificial, Inc.(Artificial公司)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏