arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 4595 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 4595 篇

2603.04348 2026-03-25 cs.CV cs.AI 57%

RANGER: Sparsely-Gated Mixture-of-Experts with Adaptive Retrieval Re-ranking for Pathology Report Generation

RANGER: 用于病理报告生成的稀疏门控专家混合模型与自适应检索重排序

Yixin Chen, Ziyu Su, Hikmat Khan, Muhammad Khalid Khan Niazi

机构 * Department of Biomedical Engineering, The Ohio State University(生物医学工程系,俄亥俄州立大学) Department of Pathology, The Ohio State University(病理学系,俄亥俄州立大学)

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI

AI总结 RANGER通过稀疏门控专家混合模型和自适应检索重排序,提升病理报告生成的生成特化与语义对齐,实验表明在PathText-BRCA数据集上性能优于现有方法。

Journal ref Proceedings of the IEEE/CVF CVPR 2026 Workshops (CV4Clinical)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23013 2026-03-25 cs.CL 57%

Knowledge Access Beats Model Size: Memory Augmented Routing for Persistent AI Agents

知识访问胜过模型规模:基于对话记忆的持久AI代理路由

Xunzhuo Liu, Bowei He, Xue Liu, Andy Luo, Haichen Zhang, Huamin Chen

机构 * vLLM Semantic Router Project(vLLM语义路由器项目) MBZUAI McGill University(麦吉尔大学) Mila AMD Red Hat(红帽)

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.CL

AI总结 本文提出利用对话记忆提升AI代理效率,通过轻量模型结合检索信息,使小模型在用户特定查询中表现优于大模型,证明知识访问比模型规模更重要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22943 2026-03-25 cs.AI 57%

PersonalQ: Select, Quantize, and Serve Personalized Diffusion Models for Efficient Inference

PersonalQ: 选择、量化并服务个性化扩散模型以实现高效推理

Qirui Wang, Qi Guo, Yiding Sun, Junkai Yang, Dongxu Zhang, Shanmin Pang, Qing Guo

机构 * School of Software Engineering, Xi'an Jiaotong University(西安交通大学软件工程学院) Nankai University(南开大学)

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.AI

AI总结 PersonalQ通过触发令牌连接检查点选择与量化,提升意图对齐并优化压缩质量,实现高效个性化扩散模型服务。

Comments Accepted in ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20357 2026-03-24 cs.CR cs.AI 57%

Memory poisoning and secure multi-agent systems

记忆污染与安全多智能体系统

Vicenç Torra, Maria Bras-Amorós

机构 * Department of Computing Science, Ume University, Ume , Sweden(瑞典乌梅大学计算机科学系) Departament of Mathematics, Universitat Politècnica de Catalunya, Catalonia, Spain(西班牙加泰罗尼亚理工大学数学系)

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI

AI总结 本文探讨了多智能体系统中记忆污染攻击的风险,分析了不同记忆系统类型的安全性,并提出基于密码学的缓解策略,强调了智能体交互中的实际风险及安全设计的重要性。

Comments 15 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18196 2026-03-23 cs.CR cs.AI 57%

Retrieval-Augmented LLMs for Security Incident Analysis

增强检索的大型语言模型用于安全事件分析

Xavier Cadet, Aditya Vikram Singh, Harsh Mamania, Edward Koh, Alex Fitts, Dirk Van Bruggen, Simona Boboila, Peter Chin, Alina Oprea

机构 * Dartmouth College(达特茅斯学院) Northeastern University(东北大学)

专题命中 检索器与排序 :RAG(abstract);分类 cs.AI

AI总结 本文提出基于RAG的系统,通过针对性查询过滤和LLM语义推理分析安全事件,展示LLM在恶意软件和Active Directory攻击中的高召回率和精度,证明RAG架构在安全分析中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18005 2026-03-20 cs.IR 57%

Negative Sampling Techniques in Information Retrieval: A Survey

信息检索中的负采样技术:综述

Laurin Wischounig, Abdelrahman Abdallah, Adam Jatowt

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR

AI总结 本文综述了密集信息检索中负采样技术,探讨了随机、静态/动态挖掘及合成数据集等方法,并分析了效果、计算成本和实现难度之间的权衡。

Comments Accepted at findings EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21737 2026-03-19 cs.IR 57%

DPDisc: From Factoid Questions to Data Product Requests for Open-World Data Product Discovery over Tables and Text

DPDisc: 从事实性问题到数据产品请求的开放世界数据产品发现 over 表格和文本

Liangliang Zhang, Nandana Mihindukulasooriya, Niharika S. D'Souza, Sola Shirai, Sarthak Dash, Yao Ma, Horst Samulowitz

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.IR

AI总结 DPDisc 是首个针对混合表格-文本语料库的数据产品发现基准,通过自动化流程生成专业级请求并验证质量,包含13076个经过验证的实例,揭示了跨领域检索方法的性能差距。

Comments 15 pages, 4 figure, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17425 2026-03-19 cs.AI 57%

Proactive Knowledge Inquiry in Doctor-Patient Dialogue: Stateful Extraction, Belief Updating, and Path-Aware Action Planning

医生-患者对话中的主动知识探究:状态提取、信念更新与路径感知的动作规划

Zhenhai Pan, Yan Liu, Jia You

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.AI

AI总结 本文提出了一种基于部分可观测性的主动知识探究框架,通过状态提取、信念更新和路径感知动作规划,提升电子病历生成的覆盖性和准确性。

Comments 12 pages, 2 figures, 5 tables. Pilot concept demonstration under a controlled simulated setting

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11808 2026-03-18 cs.AI 57%

Automating Skill Acquisition through Large-Scale Mining of Open-Source Agentic Repositories: A Framework for Multi-Agent Procedural Knowledge Extraction

通过大规模开源代理仓库挖掘实现技能自动化获取:一种多代理过程知识提取框架

Shuzhen Bi, Mengsong Wu, Hao Hao, Keqian Li, Wentao Liu, Siyu Song, Hongbo Zhao, Aimin Zhou

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.AI

AI总结 本文提出一种多代理过程知识提取框架,通过挖掘开源仓库获取高质量代理技能,结合安全治理和评估指标实现可扩展的知识获取,提升知识转移效率40%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22819 2026-03-18 cs.AI cs.FL cs.LG 57%

Hilbert: Recursively Building Formal Proofs with Informal Reasoning

Hilbert:通过非正式推理递归构建形式证明

Sumanth Varambally, Thomas Voice, Yanchao Sun, Zhifeng Chen, Rose Yu, Ke Ye

机构 * UC San Diego(加州大学圣地亚哥分校) Apple(苹果公司)

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

AI总结 Hilbert结合非正式推理与形式验证,通过递归分解问题并利用反馈优化证明,显著提升在形式证明任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13644 2026-03-17 cs.AI 57%

StatePlane: A Cognitive State Plane for Long-Horizon AI Systems Under Bounded Context

StatePlane:一种适用于受限上下文的长期智能系统认知状态平面

Sasank Annapureddy, John Mulcahy, Anjaneya Prasad Thamatani

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 StatePlane通过认知状态管理实现长期智能,无需扩展上下文窗口或重新训练模型,适用于多会话任务。

Comments 5 pages, 1 figure, 3 tables, 1 algorithm

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13320 2026-03-17 cs.IR cs.LG 57%

Nepali Passport Question Answering: A Low-Resource Dataset for Public Service Applications

尼泊尔护照问答:一种低资源数据集用于公共服务应用

Funghang Limbu Begha, Praveen Acharya, Bal Krishna Bal

机构 * ILPRL Department of Computer Science \& Engineering Kathmandu University, Dhulikhel, Nepal School of Computing Dublin City University Dublin, Ireland

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.IR

AI总结 本文构建了一个尼泊尔语问答数据集,用于护照服务的FAQs,通过微调Transformer模型和BM25进行语义相似度检索,结果显示SBERT和多语言E5模型表现最佳。

Comments 7 pages, 3 figures, Accepted and presented at RegICON 2025 (Regional International Conference on Natural Language Processing): NLP for East India, North East India and Southeast Asia. accepted-papers" target="_blank" rel="noopener">https://www.regicon2025.in/accepted-papers

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20299 2026-03-13 cs.RO cs.AI cs.CV 57%

KnowVal: A Knowledge-Augmented and Value-Guided Autonomous Driving System

KnowVal: 一种知识增强且价值引导的自动驾驶系统

Zhongyu Xia, Wenhao Chen, Yongtao Wang, Ming-Hsuan Yang

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王学苑计算机技术研究所) University of California, Merced(加州大学默塞德分校)

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI

AI总结 KnowVal通过整合开放世界感知与知识检索,构建驾驶知识图谱并训练价值模型,实现价值对齐的自动驾驶系统,提升了规划性能并降低了碰撞率。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10578 2026-03-12 cs.CV cs.DB 57%

R4-CGQA: Retrieval-based Vision Language Models for Computer Graphics Image Quality Assessment

R4-CGQA: 基于检索的视觉语言模型用于计算机图形图像质量评估

Zhuangzi Li, Jian Jin, Shilv Cai, Weisi Lin

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.DB

AI总结 R4-CGQA通过构建包含3500张CG图像及其质量描述的数据集,提出双流检索框架提升视觉语言模型对计算机图形图像质量的评估能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10409 2026-03-12 cs.IR 57%

Differentiable Geometric Indexing for End-to-End Generative Retrieval

可微几何索引用于端到端生成检索

Xujing Wang, Yufeng Chen, Boxuan Zhang, Jie Zhao, Chao Wei, Cai Xu, Ziyu Guan, Wei Zhao, Weiru Zhang, Xiaoyi Zeng

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 本文提出可微几何索引,通过操作统一和各向同性几何优化,解决生成检索中的优化阻塞和几何冲突问题,提升长尾场景下的检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09332 2026-03-11 cs.SD cs.AI 57%

TimberAgent: Gram-Guided Retrieval for Executable Music Effect Control

TimberAgent:基于语法的可执行音乐效果控制检索

Shihao He, Yihan Xia, Fang Liu, Taotao Wang, Shengli Zhang

机构 * College of Electronics and Information Engineering, Shenzhen University(深圳大学电子与信息工程学院)

专题命中 检索器与排序 :RAG(abstract);分类 cs.AI

AI总结 TimberAgent通过纹理共振检索实现可编辑的音频效果控制,利用Gram矩阵构建音频表示,降低参数误差,提供更精确的效果控制方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09250 2026-03-11 cs.IR 57%

Evoking User Memory: Personalizing LLM via Recollection-Familiarity Adaptive Retrieval

唤起用户记忆:通过回忆-熟悉度适应检索个性化LLM

Yingyi Zhang, Junyi Li, Wenlin Zhang, Penyue Jia, Xianneng Li, Yichao Wang, Derong Xu, Yi Wen, Huifeng Guo, Yong Liu, Xiangyu Zhao

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 RF-Mem通过双路径记忆检索实现个性化LLM,结合回忆与熟悉度机制提升记忆检索效率和准确性。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04384 2026-03-10 cs.CL 57%

AgentIR: Reasoning-Aware Retrieval for Deep Research Agents

AgentIR: 为深度研究代理设计的推理感知检索

Zijian Chen, Xueguang Ma, Shengyao Zhuang, Jimmy Lin, Akari Asai, Victor Zhong

机构 * University of Waterloo(滑铁卢大学) University of Queensland(昆士兰大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL

AI总结 AgentIR通过结合推理轨迹与查询的联合嵌入和数据合成方法,提升深度研究代理的检索性能,实现68%的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07709 2026-03-10 cs.HC cs.AI 57%

YAQIN: Culturally Sensitive, Agentic AI for Mental Healthcare Support Among Muslim Women in the UK

YAQIN:面向英国穆斯林女性的文化敏感、代理型AI心理健康支持系统

Yasmin Zaraket, Céline Mougenot

机构 * Dyson School of Design Engineering, Imperial College London(帝京理工学院伦敦校区设计工程学院)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 YAQIN通过整合伊斯兰心理学和用户中心设计,为英国穆斯林女性提供文化敏感的AI心理健康支持,提升信任与治疗效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07271 2026-03-10 cs.IR 57%

AutoDataset: A Lightweight System for Continuous Dataset Discovery and Search

AutoDataset: 一个轻量级的连续数据集发现与搜索系统

Junzhe Yang, Xinghao Chen, Yunuo Liu, Zhijing Sun, Wenjin Guo, Xiaoyu Shen

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 AutoDataset通过自动化实时监控arXiv,实现数据集的快速发现与检索,显著提升数据集发现效率。

Comments 10 pages, 4 figures. Source code is available at https://github.com/EIT-NLP/AutoDataset. Screencast video: https://youtu.be/_QSxHKyIYns

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06588 2026-03-10 cs.LG cs.CL cs.PL 57%

vLLM Hook v0: A Plug-in for Programming Model Internals on vLLM

vLLM Hook v0: 一种用于编程vLLM内部模型的插件

Ching-Yun Ko, Pin-Yu Chen

机构 * IBM Research(IBM研究院)

专题命中 检索器与排序 :RAG(abstract);分类 cs.CL

AI总结 vLLM Hook v0 提供了一种插件,用于编程vLLM模型的内部状态,支持被动和主动编程,以增强模型的可编程性和功能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06397 2026-03-09 cs.IR cs.LG 57%

Efficient, Property-Aligned Fan-Out Retrieval via RL-Compiled Diffusion

通过强化学习编译扩散实现高效、属性对齐的扇出检索

Pengcheng Jiang, Judith Yue Li, Moonkyung Ryu, R. Lily Hu, Kun Su, Zhong Yi Wan, Liam Hebert, Hao Peng, Jiawei Han, Dima Kuzmin, Craig Boutilier

机构 * University of Illinois Urbana Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 R4T通过强化学习编译扩散模型,实现高效且属性对齐的扇出检索,提升检索质量并显著降低推理延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05781 2026-03-09 cs.CV cs.AI 57%

Visual Words Meet BM25: Sparse Auto-Encoder Visual Word Scoring for Image Retrieval

视觉词遇见BM25:稀疏自编码器视觉词评分用于图像检索

Donghoon Han, Eunhwan Park, Seunghyeon Seo

机构 * Moreh Seoul National University(首尔国立大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

AI总结 BM25-V通过稀疏自编码器提取的视觉词激活,结合BM25评分实现高效图像检索,提升召回率并降低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01509 2026-03-03 cs.CV cs.AI 57%

Retrieval, Refinement, and Ranking for Text-to-Video Generation via Prompt Optimization and Test-Time Scaling

通过提示优化和测试时扩展实现文本到视频生成的检索、细化与排序

Zillur Rahman, Alex Sheng, Cristian Meo

机构 * Algoverse AI

专题命中 检索器与排序 :RAG(abstract);分类 cs.AI

AI总结 本文提出3R框架,通过提示优化和测试时扩展提升文本到视频生成的准确性与效率。

Comments 2026 ICLR TTU Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01494 2026-03-03 cs.SE cs.AI cs.CR cs.LG 57%

Inference-Time Safety For Code LLMs Via Retrieval-Augmented Revision

通过检索增强的修订实现代码LLM的推理时安全性

Manisha Mukherjee, Vincent J. Hellendoorn

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 通过检索增强的修订机制提升代码LLM的推理时安全性,提高生成代码的安全性并减少漏洞。

Comments Accepted at the ICLR 2026 Workshop on Principled Design for Trustworthy AI: Interpretability, Robustness, and Safety Across Modalities

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01417 2026-03-03 cs.IR 57%

ReFeed: Retrieval Feedback-Guided Dataset Construction for Style-Aware Query Rewriting

ReFeed: 基于检索反馈的领域感知查询重写数据集构建

Jiyoon Myung, Jungki Son, Kyungro Lee, Jihyeon Park, Joohyung Han

专题命中 检索器与排序 :RAG(abstract);分类 cs.IR

AI总结 ReFeed通过检索反馈驱动数据集构建,提升查询重写模型对文档风格的感知能力,改进领域特定场景下的检索效果。

Comments Accepted at the Workshop on New Frontiers in Information Retrieval (AAAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00725 2026-03-03 cs.CL 57%

LaSTR: Language-Driven Time-Series Segment Retrieval

LaSTR:基于语言的时间序列片段检索

Kota Dohi, Harsh Purohit, Tomoya Nishida, Takashi Endo, Yusuke Ohtsubo, Koichiro Yawata, Koki Takeshita, Tatsuya Sasaki, Yohei Kawaguchi

机构 * Research(研究) Development Group, Hitachi, Ltd.(日立有限公司研发小组)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL

AI总结 LaSTR通过结合语言描述和时间序列数据,实现了高效的时间序列片段检索,提升了检索质量和语义一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00460 2026-03-03 cs.AI 57%

MED-COPILOT: A Medical Assistant Powered by GraphRAG and Similar Patient Case Retrieval

MED-COPILOT:一种基于图RAG和相似患者案例检索的医疗助手

Shuheng Chen, Namratha Patil, Haonan Pan, Angel Hsing-Chi Hwang, Yao Du, Ruishan Liu, Jieyu Zhao

机构 * University of Southern California(南加州大学)

专题命中 检索器与排序 :RAG(abstract);分类 cs.AI

AI总结 MED-COPILOT通过结合图RAG和相似患者案例检索,提升临床决策支持系统的证据整合与推理准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13530 2026-03-03 cs.AI 57%

REMem: Reasoning with Episodic Memory in Language Agent

REMem: 在语言代理中进行基于事件记忆的推理

Yiheng Shu, Saisri Padmaja Jonnalagedda, Xiang Gao, Bernal Jiménez Gutiérrez, Weijian Qi, Kamalika Das, Huan Sun, Yu Su

机构 * The Ohio State University(俄亥俄州立大学) Intuit AI Research(Intuit AI研究)

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

AI总结 REMem通过两阶段框架提升语言代理的事件记忆构建与推理能力,显著优于现有系统。

Comments Accepted by The Fourteenth International Conference on Learning Representations (ICLR 2026) as poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23766 2026-03-02 cs.IR 57%

UniFAR: A Unified Facet-Aware Retrieval Framework for Scientific Documents

UniFAR: 一种统一的面向面检索框架用于科学文档

Zheng Dou, Zhao Zhang, Deqing Wang, Yikun Ban, Fuzhen Zhuang

专题命中 检索器与排序 :RAG(abstract);分类 cs.IR

AI总结 UniFAR提出一种统一的面向面检索框架,通过自适应多粒度聚合、可学习的面向锚点和联合训练,有效解决文档与问题驱动检索之间的不匹配问题,提升科学文档检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏