arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 50 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 长文档RAG 50 篇

2607.24760 2026-07-29 cs.IR 新提交 77%

CHaystack: Benchmarking Chinese Document Retrieval and VQA

CHaystack:中文文档检索与视觉问答基准测试

Hanxi Li

专题命中 长文档RAG :RAG(abstract,abstract_cn);retrieval-augmented generation(abstract);分类 cs.IR

AI总结 本文介绍了CHaystack中文文档检索与视觉问答基准测试,涵盖四类文档。提出CDocRAG系统,用VLM相关性过滤器验证文档图像。评估开源模型发现Qwen系列在文本丰富文档表现佳,中文大规模DocumentVQA在文本编码方面有挑战,仍需改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19960 2026-06-19 cs.IR 新提交 77%

Stellar: Scalable Multimodal Document Retrieval for Natural Language Queries

Stellar:面向自然语言查询的可扩展多模态文档检索

Yuxiang Guo, Zhonghao Hu, Yuren Mao, Yuhang Liu, Congcong Ge, Xiaolu Zhang, Jun Zhou, Yunjun Gao

专题命中 长文档RAG :RAG(abstract,abstract_cn);retrieval-augmented generation(abstract);分类 cs.IR

AI总结 提出Stellar框架,通过磁盘存储令牌级文档嵌入并动态加载候选嵌入,结合词汇表示过滤和高效磁盘支持的后交互,在保持检索效果的同时将内存开销和查询延迟降低1-2个数量级。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08944 2026-06-09 cs.AR cs.PL 新提交 75%

LongRTL: Graph-Similarity-Guided LLM-driven Long Context RTL Optimization

LongRTL:基于图相似性的LLM驱动的长上下文RTL优化

Yuyang Ye, Che-Kuan Shen, Xiangfei Hu, Yuchen Liu, Shuo Yin, Xufeng Yao, Bei Yu, Tsung-Yi Ho

专题命中 长文档RAG :RAG(abstract,abstract_cn);retrieval-augmented generation(abstract)

AI总结 提出一种基于图相似性的LLM驱动RTL优化框架,通过分区、优化和重构三个智能体解决长上下文RTL代码的优化问题。

Comments 7 pages, 6 figures, 5 tables, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16096 2026-08-18 cs.IR cs.CL 新提交 73%

The Commercial Tax: Rent-vs-Own Blind Spots in Multi-Hop Retrieval Benchmarks

商业税负:多跳检索基准中的租用与自建盲区

Luis M. Sanchez, Kosrow Dehnad

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.IR、cs.CL

AI总结 该研究指出多跳检索基准存在商业部署许可与成本信息盲区,发现NVIDIA Nemotron-3-Embed-8B是首个与开源基准性能持平的商业许可嵌入模型,并量化了索引成本差异。

Comments 23 pages, 4 figures. Replication artifacts (harness, per-question recall vectors, cost model, bootstrap code): https://doi.org/10.5281/zenodo.21972866 ; embedding matrices: https://huggingface.co/datasets/toryx-ai/commercial-tax-musique-embeddings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13588 2026-08-17 cs.CL cs.AI 新提交 73%

IterCOMP: Reasoning-aware Adaptive Prompt Compression for Multi-hop Question Answering

IterCOMP:面向多跳问答的感知推理自适应提示压缩

JungMin Yun, YoungBin Kim

机构 * Chung-Ang University(中央大学)

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract_cn);分类 cs.CL、cs.AI

AI总结 本文针对多跳问答中现有提示压缩方法无法捕捉多跳推理步骤的问题,提出无训练框架IterCOMP,经实验验证其可提升问答指标并减少token预算。

Comments ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08732 2026-08-11 cs.CV cs.CL cs.IR 新提交 73%

AnchorFold: A Focus-Then-Fold Framework via Recursive Attention Propagation for Efficient Multi-Vector Visual Document Retrieval

AnchorFold:基于递归注意力传播的“先聚焦后折叠”高效多向量视觉文档检索框架

Haoyu Zuo, Yibo Yan, Xin Zou, Shuliang Liu, Yi Cao, Mingdong Ou, Xuming Hu

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.IR、cs.CL

AI总结 AnchorFold是无训练的文档侧索引压缩框架,通过递归注意力传播实现先聚焦后折叠,在多数据集多骨干下,强压缩时仍保持高检索性能,优于同类无训练基线。

Comments 24 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01557 2026-07-07 cs.CL cs.AI 新提交 73%

DiPS: Dialogue Policy Selection for High-Stakes Persuasion Agents

DiPS:高风险说服代理的对话策略选择

Tianyi Zhang, Mousumi Das, Abrar Anwar, Jesse Thomason, David Traum

机构 * University of Southern California(南加州大学)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 针对高风险场景中说服策略需个性化的问题,提出DiPS框架,基于Q-learning动态选择说服策略,在火灾疏散模拟和真实人机交互中提升成功率。

Comments Proceedings of the 27th Annual Meeting of the Special Interest Group on Discourse and Dialogue (SIGDIAL 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13730 2026-08-17 cs.SE cs.AI cs.LG 新提交 70%

Building AI-Intensive Software with AI: Early Results and a Cautionary Tale on Measuring Development Cost

用AI构建AI密集型软件:早期成果及关于测量开发成本的警示故事

Victor Barros de Miranda Neves, Kiev Santos da Gama, Vinicius Cardoso Garcia

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 本文通过六人学生团队用AI构建对话式入职助手的案例研究,修正了AI密集型软件开发成本测量的两个常见错误,得出修正后的成本比率约为9.9倍,并提出需建立更稳健的成本核算方法。

Comments 4 pages, 2 figures, Accepted for publication at the International Workshop on Intelligent Software Engineering (ISE 2026) @ CBSoft 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00003 2026-08-04 cs.AI 新提交 70%

AutoFOAM: The Self-Refining Autonomous OpenFOAM Agent

AutoFOAM:自优化自主OpenFOAM智能体

Arun Govind Neelan, A Seshaditya

机构 * SimuNetics Onnes Cryogenics Quasi AI

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 AutoFOAM是基于Qwen-coder 2.5-14B微调的自主LLM智能体,通过7阶段迭代循环及三种抗退化机制,可基于自然语言指令完成OpenFOAM模拟,助力CFD工作流程普及与快速原型开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22157 2026-07-27 cs.AI 新提交 70%

Learning on the Job: Continual Learning from Deployment Feedback for Frozen-Weights Agents

在职学习:从部署反馈中对冻结权重智能体进行持续学习

Valentin Tablan, Scott Taylor, Kristoffer Bernhem

机构 * The Memory Company(记忆公司)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 研究人工智能冻结权重智能体如何从部署反馈中持续学习,核心方法是将冻结模型与外部记忆配对,主要贡献是通过该方法在银行领域任务中提升成功率,解决多个基线未解决任务,且结果可跨模型,记忆可迁移,相关内容已发布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21604 2026-07-27 cs.AI 新提交 70%

AgentKVShift: Efficient KV Cache Reuse for Agentic Memory Systems

AgentKVShift:用于智能体记忆系统的高效KV缓存重用

Nilesh Prasad Pandey, Jason Kong, Lanxiang Hu, Quanling Zhao, Yujie Zhao, Onat Gungor, Hao Zhang, Tajana Rosing

机构 * University of California, San Diego(加利福尼亚大学圣地亚哥分校)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 研究针对内存增强语言模型智能体推理成本高的问题,提出无训练、探针引导的AgentKVShift方法,通过估计内存级偏移量校正重用令牌,在多语言模型和基准测试中表现出色,实现低重新计算量和预填充加速,还能与缓存量化正交组合提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07740 2026-07-13 cs.LG cs.AI 新提交 70%

Jet-Long: Efficient Long-Context Extension with Dynamic Bifocal RoPE

Jet-Long:使用动态双焦点旋转位置编码的高效长上下文扩展

Haozhan Tang, Zerui Wang, Yuxian Gu, Song Han, Han Cai

机构 * NVIDIA(英伟达)

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 研究针对现代语言模型长上下文应用中零样本上下文扩展问题,提出Jet-Long方法,通过动态双焦点RoPE及相关技术,在推理时开销小,在多种模型和基准测试中表现优异,还能推广到其他架构且超参数弹性强。

Comments added discussion of AdaGroPE and LaMPE (Findings of ACL 2026) with clarified contribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23108 2026-06-23 cs.AI 新提交 70%

TTFT-Aware Graph Chain-of-Thought:Distance-Indexed Neural A* for Low-Hallucination Multi-Hop Medical Reasoning

TTFT感知的图链式思维:用于低幻觉多跳医学推理的距离索引神经A*

Bechir Dardouri, Kaïs Zhioua, Yassine Msaddak

机构 * Tanit Healthcare Technologies, Tunisia(突尼斯塔尼特医疗技术公司)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 提出一种生产级GraphRAG框架,通过距离索引的神经A*算法在医学知识图谱中导航,结合PLL精确距离和AStarNet启发式,实现低延迟、低幻觉的多跳推理,并改善首令牌时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17637 2026-06-17 cs.AI 新提交 70%

Brick-DICL: Dynamic In-Context Learning for Automated Brick Schema Classification

Brick-DICL:用于自动化Brick模式分类的动态上下文学习

Yiyue Qian, Shinan Zhang, Huan Song, Negin Sokhandan, Hannah Marlowe, Diego Socolinsky

机构 * Amazon AWS Generative AI Innovation Center(亚马逊AWS生成式AI创新中心)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 提出Brick-DICL两阶段动态上下文学习框架,通过元数据检索和类别检索增强大语言模型领域知识,结合多模型过滤机制,实现楼宇管理系统点位的自动化Brick分类,显著提升准确率并减少人工验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08539 2026-06-09 cs.AI 新提交 70%

AgentTrust: A Self-Improving Trust Layer for AI-Agent Actions

AgentTrust: AI代理行为的自改进信任层

Chenglin Yang

机构 * Independent Researcher(独立研究员)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 提出AgentTrust v2,通过威胁类型分类(词汇/语义)和自学习机制,在代理行为中实现自改进信任决策,显著提升语义威胁检测准确率并降低误拦。

Comments 29 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12970 2026-08-14 cs.SE 新提交 67%

Requirements-Augmented Generation for Trustworthy Acceptance Testing of LLM-Based Software

面向基于大语言模型的软件的可信验收测试的需求增强生成技术

Fanyu Wang, Chetan Arora, Zhenping Xie, Yonghui Liu, Kla Tantithamthavorn, Aldeida Aleti, Siwei Jiang

专题命中 长文档RAG :RAG(abstract,abstract_cn)

AI总结 该研究针对基于大语言模型的软件的验收测试缺口,提出需求增强生成技术与置信度校准级联判定方法,经工业案例验证可提升预言机质量、准确率与成本效率,具备工业可行性。

Comments Accepted at ASE2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09186 2026-08-11 cs.CV 新提交 67%

RAGMesh with FaME-G2E: Long-Form Text-Driven 3D Face Generation and Editing

结合FaME-G2E的RAGMesh:长文本驱动的3D人脸生成与编辑

Hao Li, Ju Dai, Feng Zhou, Mengting Shi, Haofei Wang, Zhen Song, Wei Zhou, Lei Li, Junjun Pan

机构 * Beihang University(北京航空航天大学) Pengcheng Laboratory(鹏城实验室) Shanxi University of Finance and Economics(山西财经大学) North China University of Technology(北方工业大学) Cardiff University(卡迪夫大学) Beijing Institute of Technology(北京理工大学)

专题命中 长文档RAG :RAG(abstract,abstract_cn)

AI总结 该研究构建了含文本-网格等标注的FaME-G2E数据集,提出RAGMesh框架,含MSRF模块与AdaRAGS约束,在3D人脸生成编辑任务上性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05577 2026-07-08 cs.AI cs.CL cs.IR 新提交 67%

Narrative World Model: Narratology-Grounded Writer Memory for Long-Form Fiction

叙事世界模型:基于叙事学的长篇小说作者记忆

Mohammad Saifullah, Thomas Kornmaier, Taaha Kazi, Vasu Sharma, Aditya Sanjiv Kanade, Aanand Kumar Yadav

机构 * PocketFM(口袋FM)

专题命中 长文档RAG :hybrid retrieval(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 研究针对长篇小说作者记忆问题,提出叙事世界模型(NWM),结合叙事学时间状态图与查询条件混合检索,在多跳叙事学问答上显著优于基线,优势源于其独特表征,非提取方式。

Comments 23 pages, 4 figures; 9-page main text plus appendix. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11354 2026-06-11 cs.ET 新提交 67%

A Zero-Shot Multi-Agent Framework for Human-Building Interaction via Programmatic Reasoning

通过程序化推理实现人楼交互的零样本多智能体框架

Yuqi Wang, Gulai Shen, Ali Mehmani

专题命中 长文档RAG :RAG(abstract,abstract_cn)

AI总结 提出一种分层多智能体框架,利用语义路由和程序化推理解耦自然语言理解与建筑分析,通过“门卫”机制分解任务并生成可执行Python脚本,在200多栋商业建筑数据上验证了准确性和上下文响应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18781 2026-06-18 cs.CL 新提交 57%

Lost in a Single Vector: Improving Long-Document Retrieval with Chunk Evidence Aggregation

迷失在单一向量中:通过分块证据聚合改进长文档检索

Shanshan Lyu, Yiwei Wang, Yujun Cai, Jiafeng Guo, Shenghua Liu

机构 * Chongqing University(重庆大学) State Key Laboratory of AI Safety(人工智能安全国家重点实验室) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of California, Merced(加州大学默塞德分校) University of Queensland(昆士兰大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 长文档RAG :dense retrieval(abstract);分类 cs.CL

AI总结 针对长文档检索中单向量编码削弱关键片段证据的问题,提出无训练的分块证据聚合策略DICE,通过独立编码分块并聚合为单一向量,在保持标准接口的同时显著提升检索性能。

Comments Code is available at https://github.com/PunchlineAAAA/DICE

详情

展开后加载摘要…

URL PDF HTML 收藏