arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 8572 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 长文档RAG 391 篇

2603.09222 2026-03-11 cs.CL 57%

LooComp: Leverage Leave-One-Out Strategy to Encoder-only Transformer for Efficient Query-aware Context Compression

LooComp: 通过留一法策略提升仅编码器Transformer的查询感知上下文压缩效率

Thao Do, Dinh Phu Tran, An Vo, Seon Kwon Kim, Daeyoung Kim

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 长文档RAG :retrieval augmented generation(abstract);分类 cs.CL

AI总结 LooComp通过留一法策略提升仅编码器Transformer的查询感知上下文压缩效率,实现高效压缩与高吞吐量推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16974 2026-02-20 cs.IR 57%

Beyond Chunk-Then-Embed: A Comprehensive Taxonomy and Evaluation of Document Chunking Strategies for Information Retrieval

超越片段化后再嵌入:信息检索中文档片段化策略的全面分类与评估

Yongjie Zhou, Shuai Wang, Bevan Koopman, Guido Zuccon

专题命中 长文档RAG :dense retrieval(abstract);分类 cs.IR

AI总结 本文研究了文档片段化策略在信息检索中的分类与评估,发现任务依赖性和分段方法差异影响效果,提出统一框架并提供公开基准。

Comments Github link will be pushed later as it's anonymoused at the moment

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20659 2026-01-29 cs.CL cs.MA 57%

A Dialectic Pipeline for Improving LLM Robustness

辩证管道用于提升大语言模型鲁棒性

Sara Candussio

机构 * Università degli Studi di Trieste(特里埃斯特大学)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

AI总结 本文提出一种辩证管道,通过自我对话提升大语言模型的鲁棒性,有效减少幻觉并提高输出质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09631 2026-01-26 cs.CL 57%

LLMs Got Rhythm? Hybrid Phonological Filtering for Greek Poetry Rhyme Detection and Generation

LLMs Got Rhythm? 希腊诗歌押韵检测与生成的混合语音过滤

Stergios Chatzikyriakidis, Anastasia Natsina

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

AI总结 本文提出混合语音学算法与LLMs结合,解决希腊诗歌押韵检测与生成问题,通过验证循环提升性能至73.1%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16904 2026-01-19 cs.CR cs.CL 57%

How Good is Post-Hoc Watermarking With Language Model Rephrasing?

在语言模型重述中后置水印技术有多好?

Pierre Fernandez, Tom Sander, Hady Elsahar, Hongyan Chang, Tomáš Souček, Valeriu Lacatusu, Tuan Tran, Sylvestre-Alvise Rebuffi, Alexandre Mourachko

机构 * FAIR, Meta Superintelligence Labs(FAIR、Meta超智能实验室)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

AI总结 本文研究了语言模型重述中后置水印技术的效果,发现简单方法在某些情况下表现优异,但对可验证文本效果不佳。

Comments Code at https://github.com/facebookresearch/textseal

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10342 2026-01-16 cs.AI 57%

C-GRASP: Clinically-Grounded Reasoning for Affective Signal Processing

C-GRASP:基于临床的感知信号处理推理

Cheng Lin Cheng, Ting Chuan Lin, Chai Kai Chang

机构 * Department of Physics National Central University(物理系国立中央大学) Center for Education National Central University(教育中心国立中央大学)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 C-GRASP通过临床基础推理提升情感信号处理的准确性与临床一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09937 2026-01-16 cs.HC cs.IR 57%

From SERPs to Agents: A Platform for Comparative Studies of Information Interaction

从搜索结果页面到代理:一个用于信息交互比较研究的平台

Saber Zerhoudi, Michael Granitzer

专题命中 长文档RAG :RAG(abstract);分类 cs.IR

AI总结 UXLab是一个开源平台,用于比较信息交互系统,通过无代码实验设计支持多模态交互研究。

Journal ref Proceedings of the 2026 ACM SIGIR Conference on Human Information Interaction and Retrieval (CHIIR '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09760 2026-01-16 cs.SE cs.AI 57%

Investigating Tool-Memory Conflicts in Tool-Augmented LLMs

探究工具增强大语言模型中的工具-记忆冲突

Jiali Cheng, Rui Pan, Hadi Amiri

机构 * University of Massachusetts Lowell(马萨诸塞大学洛约拉分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 本文提出工具-记忆冲突的概念,发现现有LLMs在STEM任务中存在该问题,并评估了现有解决方法的不足。

Comments R2-FM Workshop @ ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16391 2025-12-19 cs.LG cs.AI cs.DC 57%

Kascade: A Practical Sparse Attention Method for Long-Context LLM Inference

Kascade:一种适用于长上下文LLM推理的实用稀疏注意力方法

Dhruv Deshmukh, Saurabh Goyal, Nipun Kwatra, Ramachandran Ramjee

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 Kascade是一种无需训练的稀疏注意力方法,通过锚定层计算Top-k索引并重用,实现长上下文LLM推理中的高效注意力处理。

Comments 11 pages, 8 figures, 3 tables and 1 algorithm

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19562 2025-12-05 quant-ph cs.AI 57%

PennyCoder: Efficient Domain-Specific LLMs for PennyLane-Based Quantum Code Generation

PennyCoder: 用于PennyLane量子代码生成的高效领域特定LLM

Abdul Basit, Minghao Shao, Muhammad Haider Asif, Nouhaila Innan, Muhammad Kashif, Alberto Marchisio, Muhammad Shafique

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 PennyCoder是一种针对PennyLane量子编程的高效领域特定LLM,通过本地部署和低秩适应技术提升量子代码生成的准确性和效率。

Comments 6 pages, 5 figures, 3 tables, paper accepted to QCE 2025

Journal ref 2025 IEEE International Conference on Quantum Computing and Engineering (QCE), Albuquerque, NM, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02749 2025-11-05 cs.AI 57%

Using Span Queries to Optimize for Cache and Attention Locality

Paul Castro, Nick Mitchell, Nathan Ordonez, Thomas Parnell, Mudhakar Srivatsa, Antoni Viros i Martin

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

Comments 12 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25816 2025-10-31 cs.CL cs.LG 57%

Beyond Long Context: When Semantics Matter More than Tokens

Tarun Kumar Chawdhury, Jon D. Duke

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 长文档RAG :retrieval augmented generation(abstract);分类 cs.CL

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14900 2025-10-17 cs.AI cs.CR 57%

Mapping Smarter, Not Harder: A Test-Time Reinforcement Learning Agent That Improves Without Labels or Model Updates

Wen-Kwang Tsao, Yao-Ching Yu, Chien-Ming Huang

机构 * AI Lab, TrendMicro(趋势科技人工智能实验室)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13828 2025-10-17 cs.CL 57%

From Explainability to Action: A Generative Operational Framework for Integrating XAI in Clinical Mental Health Screening

Ratna Kandala, Akshata Kishore Moharir, Divya Arvinda Nayak

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04488 2025-10-07 cs.AI cs.IT math.IT 57%

Multi-Agent Collaborative Intelligence: Dual-Dial Control for Reliable LLM Reasoning

Edward Y. Chang, Ethan Y. Chang

机构 * Stanford University(斯坦福大学) UIUC(伊利诺伊大学香槟分校)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

Comments 27 pages, 5 figures, 21 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20625 2025-09-30 cs.CL 57%

Long Context Scaling: Divide and Conquer via Multi-Agent Question-driven Collaboration

Sibo Xiao, Zixin Lin, Wenyang Gao, Hui Chen, Yue Zhang

机构 * College of Computer Science, Zhejiang University(浙江大学计算机学院) NLP Lab, Westlake University(西湖大学自然语言处理实验室)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21848 2025-09-29 cs.LG cs.AI 57%

Graph of Agents: Principled Long Context Modeling by Emergent Multi-Agent Collaboration

Taejong Joo, Shu Ishida, Ivan Sosnovik, Bryan Lim, Sahand Rezaei-Shoshtari, Adam Gaier, Robert Giaquinto

机构 * Department of Industrial Engineering & Management Sciences, Northwestern University(工业工程与管理科学系,西北大学) Autodesk Research(Autodesk研究)

专题命中 长文档RAG :retrieval-augmented generation(abstract);分类 cs.AI

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08903 2025-09-12 cs.CL 57%

Noise or Nuance: An Investigation Into Useful Information and Filtering For LLM Driven AKBC

Alex Clay, Ernesto Jiménez-Ruiz, Pranava Madhyastha

机构 * City St George's, University of London(伦敦城市圣乔治大学) The Alan Turing Institute, British Library(艾伦·图灵研究所,大英图书馆)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

Comments 8 pages, 1 figure, accepted to the ISWC 2025 LM-KBC Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17852 2025-07-25 cs.MA cs.AI 57%

Technical Implementation of Tippy: Multi-Agent Architecture and System Design for Drug Discovery Laboratory Automation

Yao Fehlis, Charles Crain, Aidan Jensen, Michael Watson, James Juhasz, Paul Mandel, Betty Liu, Shawn Mahon, Daren Wilson, Nick Lynch-Jonely, Ben Leedom, David Fuller

机构 * Artificial, Inc.(Artificial公司)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19466 2025-06-30 cs.AI 57%

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models

Cheng Li, Jiexiong Liu, Yixuan Chen, Qihang Zhou, KunLun Meta

机构 * KunLun Meta(昆仑元)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04202 2025-06-27 cs.CR cs.AI cs.LG 57%

TracLLM: A Generic Framework for Attributing Long Context LLMs

Yanting Wang, Wei Zou, Runpeng Geng, Jinyuan Jia

机构 * Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

Comments To appear in USENIX Security Symposium 2025. The code and data are at: https://github.com/Wang-Yanting/TracLLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02483 2025-06-04 cs.CL 57%

Enhancing Large Language Models with Neurosymbolic Reasoning for Multilingual Tasks

Sina Bagheri Nezhad, Ameeta Agrawal

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

Comments Accepted at 19th Conference on Neurosymbolic Learning and Reasoning (NeSy 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10382 2025-05-29 cs.RO cs.AI cs.MA cs.SY eess.SY math.OC 57%

Communication- and Computation-Efficient Distributed Submodular Optimization in Robot Mesh Networks

Zirui Xu, Sandilya Sai Garimella, Vasileios Tzoumas

机构 * Department of Aerospace Engineering, University of Michigan(密歇根大学航空航天工程系) Institute for Robotics and Intelligent Machines, Georgia Institute of Technology(佐治亚理工学院机器人与智能机器研究所) Department of Robotics, University of Michigan(密歇根大学机器人学系)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

Comments Accepted to IEEE Transactions on Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18092 2025-05-28 cs.CL 57%

QwenLong-CPRS: Towards $\infty$-LLMs with Dynamic Context Optimization

Weizhou Shen, Chenliang Li, Fanqi Wan, Shengyi Liao, Shaopeng Lai, Bo Zhang, Yingcheng Shi, Yuning Wu, Gang Fu, Zhansheng Li, Bin Yang, Ji Zhang, Fei Huang, Jingren Zhou, Ming Yan

机构 * Tongyi Lab, Alibaba Group(通义实验室,阿里集团)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14838 2025-05-28 cs.CL 57%

DynamicKV: Task-Aware Adaptive KV Cache Compression for Long Context LLMs

Xiabin Zhou, Wenbin Wang, Minyan Zeng, Jiaxian Guo, Xuebo Liu, Li Shen, Min Zhang, Liang Ding

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03771 2025-04-08 cs.AI 57%

Flow State: Humans Enabling AI Systems to Program Themselves

Helena Zhang, Jakobi Haskell, Yosef Frost

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

Comments 25 pages, 4 figures, 5 tables. Describes a minimalist framework for human-AI co-design of compound AI systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12066 2025-02-18 cs.AI cs.LG cs.SE 57%

CONSTRUCTA: Automating Commercial Construction Schedules in Fabrication Facilities with Large Language Models

Yifan Zhang, Xue Yang

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15847 2025-02-12 cs.CR cs.AI 57%

LLMmap: Fingerprinting For Large Language Models

Dario Pasquini, Evgenios M. Kornaropoulos, Giuseppe Ateniese

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

Comments Appearing in the proceedings of the 34th USENIX Security Symposium

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19272 2025-02-11 cs.CL 57%

Perception Compressor: A Training-Free Prompt Compression Framework in Long Context Scenarios

Jiwei Tang, Jin Xu, Tingwei Lu, Zhicheng Zhang, Yiming Zhao, Lin Hai, Hai-Tao Zheng

专题命中 长文档RAG :retriever(abstract);分类 cs.CL

Comments Accepted at NAACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05479 2025-01-13 cs.CL cs.LG 57%

Practical Design and Benchmarking of Generative AI Applications for Surgical Billing and Coding

John C. Rollman, Bruce Rogers, Hamed Zaribafzadeh, Daniel Buckland, Ursula Rogers, Jennifer Gagnon, Ozanan Meireles, Lindsay Jennings, Jim Bennett, Jennifer Nicholson, Nandan Lad, Linda Cendales, Andreas Seas, Alessandro Martinino, E. Shelley Hwang, Allan D. Kirk

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

Comments 21 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏