arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-09-01 至 2026-09-01 共收录 3 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 长文档RAG 3 篇

2512.16391 2026-09-01 cs.LG cs.AI cs.DC 版本更新 70%

Kascade: A Practical Sparse Attention Method for Long-Context LLM Inference

Kascade:一种适用于长上下文LLM推理的实用稀疏注意力方法

Dhruv Deshmukh, Saurabh Goyal, Nipun Kwatra, Ramachandran Ramjee

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 Kascade是一种无需训练的稀疏注意力方法,通过锚定层计算Top-k索引并重用,实现长上下文LLM推理中的高效注意力处理。

Comments 11 pages, 8 figures, 3 tables and 1 algorithm

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29899 2026-09-01 cs.CL cs.AI cs.IR 新提交 67%

REIGN: Refurbished Embeddings with Integrated Guidance Networks for Efficient Context-Length Scaling

REIGN:采用集成引导网络的翻新嵌入用于高效上下文长度扩展

Devrim Çavuşoğlu, Emre Akbaş

机构 * Middle East Technical University(中东科技大学) OBSS AI

专题命中 长文档RAG :dense retrieval(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 本研究提出REIGN模型,通过解耦处理与缓存嵌入降低训练成本,在多场景长文档检索中以更小参数规模达到与更大模型相当的性能

Comments Accepted to Findings of EMNLP 2026. URL: https://devrimcavusoglu.github.io/reign/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08747 2026-09-01 cs.CL cs.AI 版本更新 62%

To Retrieve or To Think? Cross-Boundary Context Evolution for Multi-hop Complex Reasoning

是检索还是思考?一种情境演化的代理方法

Rubing Chen, Jian Wang, Wenjie Li, Xiao-Yong Wei, Qing Li

机构 * Department of Computing, The Hong Kong Polytechnic University(计算系,香港理工大学)

专题命中 长文档RAG :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 本文提出Agentic Context Evolution (ACE)方法,通过代理动态决策在检索与推理间切换,提升知识密集型任务的生成效率与准确性。

Comments Accepted by EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏