arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 8633 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 4586 篇

2608.00065 2026-08-10 cs.AI cs.LG 版本更新 57%

H+ Embedding: Harmonizing Global and Token-Level Retrieval with Context-Dependent Phrases

H+嵌入:利用上下文相关短语协调全局与词元级检索

Shusen Zhang, Junyi Hu, Ye Feng, Ziteng Wang, Zhaoyuan Pan, Xiaojun Yuan, Jiangshou Hong, Guosheng Dong, Xiangzhi Wang

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

AI总结 该研究提出H+嵌入多粒度检索器,以上下文相关短语为中间检索单元,在16项任务中提升检索效果,且降低了向量使用成本,为实用检索系统提供了质量与成本的平衡方案。

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06213 2026-08-07 cs.IR 新提交 57%

Gryphon-v2: One Model in Place of a Cascade - Generate-and-Rank Recommender with Rollout Distillation

Gryphon-v2:替代级联的单一模型——带Rollout蒸馏的生成排序推荐系统

Anna Lipkina, Daria Tikhonovich, Viktor Yanush, Mariia Ulianova, Oleg Sorokin, Vladislav Dodonov, Ilya Murzin, Denis Burshtein, Nikolay Savushkin

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 Gryphon-v2是替代多阶段级联推荐系统的单一模型,采用生成排序架构与Rollout蒸馏技术,在Yandex Music的在线实验中使活跃用户增1.41%且服务延迟相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06069 2026-08-07 cs.CL 新提交 57%

Training-Free Token-Level Steering for LLM Personalized Co-Writing

面向LLM个性化协同写作的无训练令牌级引导

Wenhao Mao, Chengbin Hou, Weixiao Wang, Jialiang Zhu, Min Liu, Yibin Hao, Hairong Lv

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 针对LLM个性化协同写作的需求,提出无训练框架SteerWrite,无需梯度更新即可适配专业领域,在多数据集、指标和模型上实现SOTA性能,大幅降低人工编辑工作量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02880 2026-08-07 cs.IR cs.LG 版本更新 57%

Field Aware Agent Skill Retrieval

领域感知智能体技能检索

Paimon Goulart, Liang Wu, Kelly Wan, Evangelos E. Papalexakis, Liangjie Hong

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.IR

AI总结 本研究针对终身学习智能体技能检索瓶颈,提出领域感知的技能表示方法,通过保留技能的多字段结构计算相似度,在 SkillRet 和 SRA-Bench 基准上取得优于拼接基线的检索效果,且优势随技能库规模增大而提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26352 2026-08-07 cs.CL 版本更新 57%

RICE-PO: Turning Retrieval Interactions into Credit Signals for Reasoning Agents

RICE-PO:将检索交互转化为推理智能体的信用信号

Mingchen Li, Hansi Zeng, Zhuo Qian, Jiatan Huang, Sunjae Kwon, Hamed Zamani, Hong Yu

机构 * University of Massachusetts, Amherst(马萨诸塞大学阿姆赫斯特分校) Texas Tech University(得克萨斯科技大学) University of Connecticut(康涅狄格大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL

AI总结 提出RICE-PO框架,通过将检索交互转化为局部学习信号,解决推理型检索智能体在训练中推理步骤的信用分配问题,在BRIGHT和BEIR上优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04482 2026-08-06 cs.IR 新提交 57%

Skills Know Their Neighbors: Cluster-Contrastive Capability Pages for Skill Retrieval

技能了解其邻居:用于技能检索的聚类对比能力页面

Zifei Wang, Wei Wen, Qiang Ji, Ruizhi Qiao

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 针对大语言模型智能体技能检索中仅改进检索器无法消除的文档导致的误差,提出聚类对比的能力页面,在SRA-Bench等数据集上显著提升了召回率与任务成功率。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04426 2026-08-06 cs.CV cs.CL 新提交 57%

Predict, Then Retrieve: Cross-Instance Future-State Retrieval from Video Prefixes

预测再检索:从视频前缀中进行跨实例未来状态检索

Quynh Vo, Thong Nguyen, Vinh-Hien Do, Cong-Duy Nguyen, Anh-Tuan Luu

机构 * Centre for AI Research, VinUniversity(VinUniversity人工智能研究中心) National University of Singapore(新加坡国立大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL

AI总结 该研究提出PSR任务,构建含多数据集的基准,提出LFTR模型,发现预测而非感知是核心挑战,LFTR缩小差距且成本低,相关资源已公开。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07885 2026-08-06 cs.AI cs.LG 版本更新 57%

MemFly: On-the-Fly Memory Optimization via Information Bottleneck

MemFly: 通过信息瓶颈实现飞地内存优化

Zhenyuan Zhang, Xianzhang Jia, Zhiqin Yang, Zhenbo Song, Wei Xue, Sirui Han, Yike Guo

机构 * The Hong Kong University of Science(香港科学与技术大学) Nanjing University of Science(南京理工大学)

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.AI

AI总结 MemFly通过信息瓶颈原理实现LLM的飞地内存优化,采用梯度自由优化器和混合检索机制提升内存效率和多跳查询能力。

Comments Accepted by ICLR 2026 MemAgents Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02843 2026-08-05 cs.CR cs.AI 新提交 57%

MutMem: Cryptographically Authorized Mutation in Persistent Agent Memory

MutMem:持久智能体内存中的密码学授权突变

Walid Saidi

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

AI总结 本研究针对持久智能体内存的授权与防篡改问题,提出HOM-AIMOS中的MutMem协议,经实验验证其在多个基准任务中表现良好,可有效抵御中毒攻击。

Comments https://github.com/wallidsaydi-creator/HOM-AIMOS. 32 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28942 2026-08-05 cs.AI 版本更新 57%

NeSyFS: A Neuro-symbolic Fast-Slow Thinking Framework for LLM Agent under Partial Observability

NeSyFS:部分可观测场景下LLM智能体的神经符号快慢思考框架

Duo Xu, Faramarz Fekri

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 该研究针对部分可观测场景下LLM智能体的决策挑战,提出NeSyFS神经符号快慢思考框架,结合知识图谱、TSMC算法与反思模块,在三个基准测试中表现优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15428 2026-08-05 cs.IR 版本更新 57%

Fault Cause Identification across Manufacturing Lines through Ontology-Guided and Process-Aware FMEA Graph Learning with LLMs

基于本体引导和流程感知FMEA图学习结合大语言模型的跨生产线故障原因识别

Sho Okazaki, Kohei Kaminishi, Takuma Fujiu, Yusheng Wang, Manu Sasidharan, Jun Ota

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.IR

AI总结 该研究针对跨生产线故障原因识别难题,提出OGPAL框架,结合LLM与RGCN实现FMEA知识复用,在汽车压力传感器装配线案例中性能优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00183 2026-08-04 cs.CE cs.AI 新提交 57%

Evidence-Unit Fairness and the Limits of Query-Adaptive Sparse-Dense Fusion in Financial Document Retrieval

金融文档检索中的证据单元公平性与查询自适应稀疏-密集融合的局限性

Chenyu Wu, You Lin

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.AI

AI总结 针对金融文档检索问题,在修正语料库后发现简单融合BM25与紧凑密集编码器为强基线,而三种轻量自适应查询加权路由均未取得统计可靠提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08645 2026-08-04 cs.CL 版本更新 57%

Quick on the Uptake: Eliciting Implicit Intents from Human Demonstrations for Personalized Mobile-Use Agents

快速响应:从人类演示中提取隐含意图以构建个性化移动使用代理

Zheng Wu, Heyuan Huang, Yanjia Yang, Yuanyi Song, Xingyu Lou, Weiwen Liu, Weinan Zhang, Jun Wang, Zhuosheng Zhang

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学与工程学院) OPPO Research Institute(OPPO研究院)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文提出IFRAgent框架,通过分析显式和隐式意图流,提升移动代理对人类意图的对齐率和任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01893 2026-08-04 cs.AI cs.LG 版本更新 57%

Geometric Analysis of Token Selection in Multi-Head Attention

多头注意机制中令牌选择的几何分析

Timur Mudarisov, Mikhal Burtsev, Tatiana Petrova, Radu State

机构 * University of Luxembourg(卢森堡大学) London Institute for Mathematical Sciences(伦敦数学科学研究所)

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

AI总结 本研究通过几何分析揭示了多头注意力机制中令牌选择的结构特性,提出了精度、召回率和F分数等指标,并展示了头部在不同制度下的几何特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11872 2026-08-03 q-bio.GN cs.AI 版本更新 57%

ELISA: An Interpretable Hybrid Generative AI Agent for Expression-Grounded Discovery in Single-Cell Genomics

ELISA:一种可解释的混合生成式AI代理,用于单细胞组学中的表达基础发现

Omar Coser

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

AI总结 ELISA结合表达嵌入、语义检索和LLM解释,提供交互式单细胞发现,优于CellWhisperer,尤其在基因签名查询中表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26967 2026-07-30 cs.CL 新提交 57%

Generation or Judgement? A Paradigm Perspective on LLM-Based Emotion-Cause Pair Extraction in Conversation

生成还是判断?基于范式视角的对话中基于大语言模型(LLM)的情感-原因对抽取

Weijie Feng, Hongchuang Wang, Binbin Liu, Zhiyong Cheng

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL

AI总结 该研究针对对话情感-原因对抽取,对比LLM的生成与判断范式,发现对级判断更优,引入辅助检索器后在三个数据集上实现F1提升,明确任务分解与候选范围的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25614 2026-07-29 cs.LG cs.CL 新提交 57%

MemSFT: Mitigating Alignment Tax with an External Parametric Memory

MemSFT:使用外部参数内存减轻对齐代价

Jiarui Wang, Xiang Shi, Jiaqi Cao, Rubin Wei, Xiquan Wang, Hao Sun, Jingzhi Wang, Zhiqi Yang, Qipeng Guo, Bowen Zhou, Zhouhan Lin

机构 * Shanghai AI Laboratory(上海人工智能实验室) Tsinghua University(清华大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL

AI总结 研究针对大语言模型应用于特定领域产生的对齐代价问题,提出MemSFT方法,通过参数内存解耦领域专业化与主干参数更新,经多领域多模型评估,能提升领域性能且通用性能下降小,实现通用与专业能力解耦。

Comments 33 pages, 11 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24826 2026-07-29 cs.IR cs.MA 新提交 57%

Aethel: A Reproducible Graph-Retrieval Framework for Multi-Hop Financial Diligence

Aethel:用于多跳金融尽职调查的可重现图检索框架

Krish Sapru

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR

AI总结 针对二级私募股权交易中财务披露信息综合难题,Aethel框架结合二分个性化PageRank图检索等技术,将语料库建模为实体-段落图。在多跳金融尽职调查任务中,该框架在特定数据集上有较好表现,优势依赖语料库规模和实体索引质量,且发布相关工件保证可重现性。

Comments 11 pages, 3 figures, 2 tables. Includes evaluations on MuSiQue, 2WikiMultiHopQA, and a 4,123-chunk financial-disclosure corpus. Code and evaluation artifacts are available for reproducibility

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24759 2026-07-29 cs.AI cs.CY cs.DL 新提交 57%

Beyond Memory: A Templated Substrate for Heterogeneous Collaborative Knowledge Work with LLM Agents

超越记忆:一种用于异构协作知识工作的带大语言模型代理的模板化基础架构

Priscila Saboia Moreira, Christopher R. Sweet

机构 * University of Notre Dame(圣母大学)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 研究指出知识工作成果难传承,大语言模型代理无持久记忆。提出llm-wiki-memory-template,它是异构协作知识工作基础架构,沿多人类、多代理、多领域三个轴,通过案例研究展示其能保留失败路径等,解决负面结果丢失问题。

Comments 15 pages, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22042 2026-07-29 cs.IR 版本更新 57%

LAMAR: An Open Language-Aware Multilingual Alignment Reranker

LAMAR:一种开放的语言感知多语言对齐重排器

Seongtae Hong, Youngjoon Jang, Jungseob Lee, Seungyoon Lee, Heuiseok Lim

专题命中 检索器与排序 :retrieval augmented generation(abstract);分类 cs.IR

AI总结 研究多语言检索增强生成中重排器对文档语言的考量问题,提出语言感知多语言交叉编码器LAMAR,它通过英语锚定相关性蒸馏和偏好对齐实现语言连贯,在控制实验及实际检索中表现出色,证明其兼顾语言连贯与重排性能。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01862 2026-07-29 cs.MA cs.AI cs.NI 版本更新 57%

RadioMaster: Multi-Agent System for Autonomous Radio Signal Generation

RadioMaster: 自主无线电信号生成的多智能体系统

Jiazhen Lei, Yuxin Sha, Tianze Cao, Sihan Wang, Bingbing Wang, Zeming Yang, Fengyuan Zhu, Xiaohua Tian

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI

AI总结 提出RadioMaster,一个全自主的多智能体框架,通过RadioWiki、RadioAgent和RadioEmulator三大支柱,将用户意图转化为真实无线信号,解决现有模型因领域知识和硬件约束敏感性不足而无法生成无线电信号的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14558 2026-07-29 cs.AI 版本更新 57%

JobMatchAI-An Intelligent Job Matching Platform Using Knowledge Graphs, Semantic Search and Explainable AI

JobMatchAI:基于知识图谱、语义搜索和可解释AI的智能岗位匹配平台

Mayank Vyas, Abhijit Chakraborty, Vivek Gupta

机构 * Arizona State University(亚利桑那州立大学)

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.AI

AI总结 本文提出JobMatchAI平台,整合Transformer嵌入、技能知识图谱和可解释重排序技术,优化技能匹配、经验、地点、薪资和公司偏好,提供 resume 驱动的搜索工作流解释,发布JobSearch-XS基准和混合检索栈评估技能泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24368 2026-07-28 cs.CL 新提交 57%

Keep It InMind: Benchmarking the Implicit-Association Blind Spot in Agent Memory

牢记于心:评估智能体记忆中的隐式关联盲点

Ruizhe Li, Mingxuan Du, Benfeng Xu, Zhendong Mao

机构 * University of Science and Technology of China(中国科学技术大学) Metastone Technology(元石科技)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL

AI总结 研究智能体记忆中的隐式关联盲点问题,引入InMind基准测试,通过配对控制区分三种解释,实验发现将记忆置于上下文时主干回答间接查询比例高,检索相同记忆时其他系统召回率低,诊断探针可缩小差距,指出路由是关键问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23561 2026-07-28 cs.IR 新提交 57%

Towards a Relevance Posterior in Neural Information Access

迈向神经信息访问中的相关性后验

Andrew Parry, Emmanouil Georgios Lionis, Debasis Ganguly, Sean MacAvaney

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.IR

AI总结 研究现代信息检索系统中相关性操作的局限,提出将其理解为近似后验推理,扩展经典概率检索形式,通过显式似然 - 先验分解转移计算,纳入查询独立文档效用,经实验证明能提升检索效果并给出研究方向。

Comments SIGIR 2026 Perspectives Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02818 2026-07-28 cs.IR 版本更新 57%

Session-Level Optimization for Large-Scale Retrieval using REINFORCE with Multi-Step Off-Policy Correction

基于离策略强化学习的大规模生成式检索长期优化

Artem Matveev, Sergei Makeev, Aleksei Krasilnikov, Vladimir Baikalov, Sergei Liamaev, Kirill Khrylchenko

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 将推荐视为会话级序贯决策问题,用离策略REINFORCE在预收集数据上训练生成式检索器,提出多步重要性权重近似,训练用户反馈模型用于离线评估,引入测试时缩放程序,实验表明方法能改进离线估计。

Comments Accepted at the 5th Workshop on End-End Customer Journey Optimization at KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22479 2026-07-27 cs.IR 新提交 57%

Legal Nugget Extraction for Granular Retrieval over Long Jurisprudential Texts

长法律文本的细粒度检索中的法律要点提取

Lucas Pereira, Erick Brito, Roberto Lotufo, Jayr Pereira

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR

AI总结 研究长法律文本检索难题,提出提取法律要点并嵌入索引进行检索的方法,在四个基准上评估,结果显示该方法对部分法学数据集有显著提升,对其他场景效果有别,证明法律要点在特定法学搜索中有用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18796 2026-07-23 cs.IR 版本更新 57%

TSGR: Taobao Search Generative Retrieval

TSGR:淘宝搜索生成式检索

Tianyu Zhan, Gui Ling, Tong Xiong, Kunhai Lin, Yang Wang, Kaixuan Zhang, Zhihong Chen, Yuliang Yan, Dan Ou, Shengyu Zhang, Haihong Tang, Bo Zheng

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 淘宝搜索生成式检索(TSGR)旨在解决现有生成式检索系统对商品业务价值不敏感的问题。它通过引入查询感知并行SID和价值感知排名模块,将价值感知融入商品表示与候选排名。实验证明该框架有效提升了检索性能及业务指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18730 2026-07-22 cs.CL 新提交 57%

Dual Attention Residuals

双注意力残差

Xingda Yu, Yining Li, Xinzhang Liu, Zhihao Yang, Haowei He, Chao Wang, Yongxiang Li, Shuangyong Song

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL

AI总结 研究提出双注意力残差(DAR),通过相互跨流寻址将多流交互引入历史检索,在多个模型中优于标准残差Transformer和注意力残差,路由消融等分析表明其能保留深度多样性,避免冗余和功能不平衡。

Comments 13 pages, 10 figures, and 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17879 2026-07-21 cs.AI 新提交 57%

Exploratory and Assimilating Reflection: Reflective Recall Cycle for Long-term Memory

探索性与同化性反思:用于长期记忆的反思性回忆循环

Ganesh Senrayan, Moyuru Yamada, Ishan Jindal, Kiran Purohit

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

AI总结 研究基于大语言模型的自主智能体外部记忆问题,提出探索性 - 同化性反思(EAR)框架,结合探索性反思与同化性反思两种机制,提高初始检索性能和样本效率,在长期对话基准上比基线检索器提升检索率达 17.9%,且样本效率高、抗噪声反馈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17715 2026-07-21 cs.CL 新提交 57%

C$^2$KV: Compressed and Composable KV Cache Reuse for Efficient LLM Inference

C$^2$KV:用于高效大语言模型推理的压缩可组合键值缓存重用

Chuheng Du, Junyi Chen, Hanlin Tang, Kan Liu, Tao Lan, Lin Qu, Chaoyue Niu, Shengzhong Liu, Guihai Chen, Fan Wu

机构 * Alibaba Group(阿里巴巴集团)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 研究针对长上下文LLM推理成本高问题,提出C$^2$KV框架,联合优化KV提取与推理拼接,学习可组合压缩的KV缓存流形,引入轻量级边车提取器及协同训练策略,显著降低缓存成本,实现推理加速并保持生成质量。

Comments 12 pages, 9 figures, accepted by ACM SIGKDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏