arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 372 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 372 篇

2606.25533 2026-06-25 cs.CR cs.CL 新提交 85%

Security and Privacy in Retrieval-Augmented Generation: Architectures, Threats, Defenses, and Future Directions for Building Trustworthy Systems

检索增强生成中的安全与隐私:构建可信系统的架构、威胁、防御与未来方向

Balamurugan Palanisamy, G S S Chalapathi, Vikas Hassija, Rajkumar Buyya

机构 * Department of Electrical and Electronics Engineering(电子与电气工程系) Birla Institute of Technology and Science, Pilani, Pilani Campus(比拉理工学院和科学学院,比拉校区) Department of Computer Engineering, KIIT University(计算机工程系,KIIT大学) Quantum Cloud Computing and Distributed Systems (qCLOUDS) Laboratory(量子云计算与分布式系统(qCLOUDS)实验室) Department of Computing and Information Systems(计算与信息系统系) The University of Melbourne(墨尔本大学)

专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);RAG(abstract,abstract_cn);分类 cs.CL

AI总结 本文综述了检索增强生成系统在集中式、设备端、联邦和混合范式下的隐私与安全挑战,提出了涵盖检索、上下文构建和生成阶段的统一威胁分类,并分析了攻击类别及防御策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11907 2026-06-11 cs.IR 新提交 85%

Tail-Aware Adaptive-k: Query-Adaptive Context Selection for Retrieval-Augmented Generation

尾部感知自适应-k:面向检索增强生成的查询自适应上下文选择

Ziyu Song, Jiaming Fang, Kuangyu Li, Tuo Xia, Chuanpeng Wang

专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);RAG(abstract,abstract_cn);分类 cs.IR

AI总结 针对固定Top-K检索在查询依赖和重尾相似度分布下的失效问题,提出TAA-k框架,通过局部化极值理论验证策略实现高效、稳定的查询自适应截断,在三个数据集上达到接近最优的检索质量且效率大幅提升。

Comments First two authors contributed equally. Accepted at ECML PKDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24976 2026-07-07 cs.AI cs.CL cs.LG 新提交 85%

Diagnosing and Mitigating Compounding Failures in Agentic Persuasion via Taxonomic Strategy Retrieval

诊断与缓解智能体说服中的复合失败:基于分类策略检索

Sana Ayromlou, Purvi Sehgal, Pradyumna Narayana

机构 * Google(谷歌)

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 针对智能体在主观任务中因语义泄露导致的复合错误,提出分类策略RAG(TS-RAG),通过离散类别瓶颈解耦论证结构与主题内容,显著提升抽象逻辑迁移能力,并在非对称部署中增强轻量级说服者性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26511 2026-06-26 cs.CL cs.AI cs.ET cs.LG 新提交 85%

Temporal Validity in Retrieval Memory: Eliminating Stale-Fact Errors for AI Agents over Evolving Knowledge

检索记忆中的时间有效性:消除AI智能体在知识演化中的过时事实错误

Neeraj Yadav

机构 * MemStrata.dev — Called It Inc. (Enterprise)(MemStrata.dev — Called It Inc.(企业))

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 针对RAG无法处理知识演化导致过时事实错误的问题,提出MemStrata,通过确定性替换规则维护时间有效性,在演化知识上准确率达0.95-1.00,过时事实错误率降至~0%。

Comments 21 pages, 5 tables. Code, prompts, and evaluation datasets included

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20897 2026-06-23 cs.CL cs.AI 新提交 85%

PeerCheck: Enhancing LLM-Generated Academic Reviews Towards Human-Level Quality

PeerCheck: 提升大语言模型生成的学术评审至人类水平质量

Zeyuan Chen, Ziqing Yang, Yihan Ma, Michael Backes, Yang Zhang

机构 * CISPA Helmholtz Center for Information Security(CISPA亥姆霍兹信息安全中心)

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 提出PeerCheck框架,分析LLM与人类评审差异,采用思维链和检索增强生成提升评审质量,发现思维链显著改善但RAG存在悖论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14817 2026-06-16 cs.IR cs.AI 新提交 85%

Combining Retrieval-Augmented Text Generation with LLMs for Reading Content Recommendations

结合检索增强文本生成与大型语言模型的阅读内容推荐

Sooyeon Kim, Piotr S. Maciąg

机构 * Institute of Computer Science, Warsaw University of Technology(计算机科学学院,华沙技术大学)

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.IR、cs.AI

AI总结 提出结合检索增强生成(RAG)与大型语言模型的系统,通过四个模块实现个性化阅读内容生成,实验表明RAG将相关性和接地性提升26-35个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13267 2026-06-12 cs.CV cs.CL cs.IR 新提交 85%

TimeLens: On-Device Artifact Recognition with Retrieval-Augmented Question Answering for the Grand Egyptian Museum

TimeLens: 面向大埃及博物馆的基于检索增强问答的设备端文物识别

Rawan Hesham, Ali Ashraf, Amr Ahmed, Malak Alaa, Omar Ahmed, Omar Wagih

机构 * Grand Egyptian Museum(大埃及博物馆)

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.IR、cs.CL

AI总结 针对博物馆场景中的细粒度视觉相似性、训练数据与手持相机差距以及AI幻觉问题,提出设备端文物检测器与双语检索增强生成(RAG)问答系统,实现实时识别与可靠问答。

Comments 6 pages, 4 figures, 5 tables. Submitted to AIVRCH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06779 2026-06-08 cs.IR cs.AI 新提交 85%

Mind the Gap: Bridging Behavioral Silos with LLMs in Multi-Vertical Recommendations

注意差距:用LLM弥合多垂直领域推荐中的行为孤岛

Nimesh Sinha, Raghav Saboo, Martin Wang, Sudeep Das

机构 * DoorDash Inc.(DoorDash公司)

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.IR、cs.AI

AI总结 提出利用LLM从数据丰富垂直领域(如餐厅)向稀疏领域(如杂货)迁移知识的框架,通过分层RAG生成多级特征,集成到MTL排序模型,显著提升新兴业务个性化与参与度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24915 2026-06-25 cs.CL cs.AI cs.IR 新提交 85%

Error-Aware TF-IDF Retrieval-Augmented Generation for ASR Error Correction

错误感知的TF-IDF检索增强生成用于ASR错误纠正

Mohammad Aref Jafari-Raddani

机构 * Department of Computer Engineering, Qom University of Technology(库姆科技大学计算机工程系) Asa Electronic Akhtaran(阿萨电子阿赫塔兰公司)

专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);retriever(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 提出一种纯词法的错误感知检索增强生成框架,通过对称文本归一化和基于历史错误的稀疏对角惩罚矩阵,将FLEURS波斯语子集的错误感知命中率从53.7%提升至90.9%,最终词错误率从23.06%降至18.83%。

Comments 4 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17781 2026-08-19 cs.CL 新提交 84%

Preference Is Not Intervention: The Structure and Stability Boundaries of Reader-Specific Evidence Utility

偏好并非干预:特定读者证据效用的结构与稳定性边界

Shi Zhou

机构 * College of Software, Jilin University(吉林大学软件学院)

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 该研究在RAG中测试模型特定差异是否形成可复用结构,发现读者序数偏好几何跨任务稳定但符号几何受任务限制,且稳定偏好无法预测干预迁移,表明特定读者效用存在但偏好≠干预。

Comments 16 pages, 6 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12820 2026-08-14 cs.IR 新提交 84%

Query Translation vs. Cross-Lingual Embeddings for Sinhala-Tamil E-Government Information Retrieval

僧伽罗语-泰米尔语电子政务信息检索的查询翻译与跨语言嵌入对比

Dharshi Balasubramaniyam, Tiroshan Madushanka

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.IR

AI总结 本文对比僧伽罗语-泰米尔语电子政务信息检索的CLIR方法,发现多语言嵌入模型BGE-M3性能最优,优于查询翻译方法,可作为低资源政务领域RAG的有效方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08163 2026-08-11 cs.AI 新提交 84%

Agentic AI-driven Immersive Simulation: A Knowledge-Aware Virtual Training Platform forHigh Dose Rate (HDR) Brachytherapy

智能体AI驱动的沉浸式模拟:用于高剂量率(HDR)近距离放射治疗的知识感知虚拟训练平台

Ronghua Xu, Kepha Barasa, Manoj Kumal, Xinyun Liu, Weihua Zhou, Xin Qian

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.AI

AI总结 该研究提出一款智能体AI驱动的沉浸式模拟平台,用于HDR阴道圆柱近距离放射治疗虚拟训练,集成VR、移动计算与RAG技术,经原型验证可提供高保真无风险训练环境,具备合适延迟与高RAG支持质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08100 2026-08-11 cs.CR cs.AI cs.LG 新提交 84%

Defending Retrieval-Augmented Intrusion Detection Against Knowledge Poisoning and Prompt Injection

防御检索增强型入侵检测系统免受知识投毒与提示注入攻击

Kaysarul Anas Apurba, Md. Hasibul Hasan, Mahedee Zaman Moon, Sk. Md. Mizanur Rahman, Atsuo Inomata

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.AI

AI总结 本文提出RAG-IDS三层多智能体入侵检测框架,通过软信任评分、LECC和提示净化的检索边界防御,可在知识投毒与提示注入攻击下恢复分类质量,在CIC-UNSW-NB15数据集上表现出良好的防御效果。

Comments 14 pages with Appnedix, 11 figures. Submitted to IEEE CIC 2026, Research Track (double-blind review)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05076 2026-08-06 cs.LG cs.AI eess.SP 新提交 84%

MultiPathFormer: Towards a Foundation Model for Multipath Wireless Propagation

MultiPathFormer:迈向多径无线传播的基础模型

Blessed Guda, Kayley Sze, Carlee Joe-Wong

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.AI

AI总结 该研究提出MultiPathFormer,以多径传播为预训练对象,结合Environmental RAG机制,在27种环境预训练后,在多项无线通信下游任务中超越SOTA模型,验证了路径级预训练的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02472 2026-08-04 cs.CL 新提交 84%

CTRAG: An In-Context Retrieval-based Framework for Automated Compliance Checking using LLMs

CTRAG:一种基于上下文检索的大语言模型自动化合规检查框架

Muhammad Roman, Karen Rafferty, Barry Devereux

机构 * Bristol Research and Innovation Laboratory (BRIL)(布里斯托尔研究与创新实验室(BRIL)) Toshiba Europe Ltd.(东芝欧洲有限公司) Queen’s University Belfast(贝尔法斯特女王大学)

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文提出基于RAG的CTRAG框架,通过自适应分块、动态检索配置等策略实现自动化合规检查,在四大会计师事务所POC中F1达78%、召回85%,可减少手动工作量并提升监管信任。

Comments 10 pages, 5 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22625 2026-07-28 cs.AI cs.LG 新提交 84%

TokenMem: Faithful Knowledge Injection for Frozen LLMs

TokenMem:为冻结的语言模型进行忠实的知识注入

Chengzhang Yu, Chenyang Zheng, Zening Lu, Yingru He, Yutong Huang, Yiming Zhang, Yue Xu, Zhanpeng Jin

机构 * South China University of Technology(华南理工大学) University of Science and Technology of China(中国科学技术大学)

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.AI

AI总结 研究针对RAG增强LLMs时的知识冲突问题,提出TokenMem轻量级记忆系统,通过专用通道向冻结LLMs注入知识,经两阶段课程训练薄门控适配器,实验显示其在反事实基准上知识一致性远超普通RAG,两阶段课程关键,门控适配器能自主学习策略。

Comments 15 pages, 3figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13038 2026-07-16 cs.CY cs.AI 新提交 84%

Designing Safety-Constrained LLM Systems for Public Health Information Access

设计用于公共卫生信息访问的安全约束大语言模型系统

Ben Torkian, Jun Zhou

机构 * University of South Carolina(南卡罗来纳大学)

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval augmented generation(abstract);分类 cs.AI

AI总结 针对公共卫生信息访问,尤其是母婴健康资源导航,设计实现安全约束大语言模型系统。采用多层架构,含领域受限RAG等,通过可控数据管道确保回复基于精选资源。经场景验证,系统安全约束执行一致、性能稳定,为相关领域部署LLM系统提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07846 2026-07-10 cs.AI cs.CY 新提交 84%

VectorizationLLM: Smart Vectorization Based AI Assistant

向量化语言模型:基于智能向量化的人工智能助手

Ryan Duke

机构 * New York Institute of Technology(纽约理工学院)

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval augmented generation(abstract);分类 cs.AI

AI总结 研究旨在设计基于谷歌开放权重语言模型的VectorizationLLM,用于辅助学生学习MATLAB相关知识。采用RAG知识库和系统提示架构,不直接给答案,通过课堂笔记示例详细解释概念,为课程应用提供有指导意义的智能助手。

Comments 44 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13397 2026-06-12 cs.HC cs.AI cs.CY 新提交 84%

Mod-Guide: An LLM-based Content Moderation Feedback System to Address Insensitive Speech toward Indigenous Ethnic and Religious Minority Communities

Mod-Guide:一种基于LLM的内容审核反馈系统,用于解决针对原住民及少数族裔宗教群体的不敏感言论

Dipto Das, Achhiya Sultana, Ankit Singh Chauhan, Saadia Binte Alam, Mohammad Shidujaman, Shion Guha, Sunandan Chakraborty, Syed Ishtiaque Ahmed

机构 * Department of Computer Science, University of Toronto(计算机科学系,多伦多大学) Independent University Bangladesh(孟加拉国独立大学) Indiana University(印第安纳大学) Faculty of Information, University of Toronto(信息学院,多伦多大学)

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval augmented generation(abstract);分类 cs.AI

AI总结 本文研究LLM审核系统对孟加拉国印度教和查克玛社区不敏感言论的认知局限,通过共同构建文化语料库和检索增强生成(RAG)方法开发Mod-Guide工具,提升模型对少数群体观点的敏感性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02189 2026-08-04 cs.IR cs.CL 新提交 84%

Disentangled Contrastive Learning for Zero-Shot Multilingual Dense Retrieval

用于零样本多语言密集检索的解耦对比学习

Chao Huang, Yufeng Chen, Changhao Guan, Guang Yang, Dongze Chen, Kaiyu Huang

专题命中 检索器与排序 :dense retrieval(title,abstract);retriever(abstract);分类 cs.IR、cs.CL

AI总结 本文针对低资源语言检索数据稀缺问题,提出解耦对比学习方法,将多语言表示分离为语义与语言子空间,在mMARCO、MIRACL上的零样本多语言密集检索性能优于多个强基线。

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24623 2026-06-24 cs.CL cs.AI 新提交 84%

Privacy-Preserving RAG via Multi-Agent Semantic Rewriting: Achieving Confidentiality Without Compromising Contextual Fidelity

基于多智能体语义重写的隐私保护检索增强生成:在不损害上下文保真度的情况下实现机密性

Yuanhe Zhao, Tianyu Zhang, Huafei Xing, Derek F. Wong, Jianbin Li, Tao Fang

机构 * School of Control and Computer Engineering, North China Electric Power University(华北电力大学控制与计算机工程学院) Department of Computer & Information Science & Engineering, University of Florida(佛罗里达大学计算机与信息科学与工程系) NLP2CT Lab, Department of Computer and Information Science, University of Macau(澳门大学计算机与信息科学系NLP2CT实验室) Institute of International Language Services Studies, Macau Millennium College(澳门千禧学院国际语言服务研究所)

专题命中 检索器与排序 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 提出多智能体框架,通过语义重写净化检索内容,在去除敏感标识的同时保留语义核心,显著降低隐私泄露并保持上下文保真度。

Comments This full manuscript contains 23 pages and has been formally accepted for publication in Information Processing & Management (Elsevier IPM). Tao Fang is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01655 2026-08-04 cs.DC 新提交 83%

PrefixPlace: Provable Prefix Key-Value Placement for Large Language Model Serving under Heterogeneous Compute and Transfer Costs

PrefixPlace:异构计算与传输成本下大语言模型服务的可证明前缀键值放置方案

Zhiyu Wang, Rajkumar Buyya

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)

AI总结 针对异构计算与传输成本下LLM前缀KV放置的次优问题,提出PrefixPlace规划器,其性能接近最优且效率高,可提升RAG等场景的成本节省效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27374 2026-07-31 cs.SE cs.CR 新提交 83%

From Backlog Items to Security Guidance: Towards Continuous Security Compliance

从待办事项到安全指南:迈向持续安全合规

Ignacio García Núñez, Florian Angermeir, Fabiola Moyón Constante

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)

AI总结 本研究针对受监管领域持续软件工程中待办事项安全要求明确困难的问题,提出基于NLP的待办事项丰富系统,结合分类器与RAG管道,发布标注数据集,经评估可有效检测安全相关待办事项并关联安全要求,助力持续安全合规。

Comments 11 pages, 3 figures, 3 tables. Accepted at the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026), Industry Showcase track

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21911 2026-07-27 cs.SE cs.DL 新提交 83%

Leveraging Resolved Incident History for LLM-Assisted Software Bug Diagnosis

利用已解决的事件历史进行大语言模型辅助的软件错误诊断

Boyuan Guan, Hailu Xu, Jamie Rogers

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)

AI总结 研究利用已解决事件历史进行软件错误诊断,提出OM-RAG方法,将问题索引为三元组并单跳嵌入检索先例,为大语言模型管理员提供支持,实验表明该方法在诊断准确率和修复正确性上优于其他方法。

Comments 6 pages, 3 figures, accepted at IEEE SMC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17053 2026-07-21 cs.SE cs.AR 新提交 83%

MechMem-RTL: Reusing Verified Mechanism Memories for LLM-Based RTL Repair

MechMem-RTL:用于基于大语言模型的RTL修复的可复用验证机制存储器

Mingyu Cheng, Junjie Gao, Jinhua Cui, Kuncai Zhong

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)

AI总结 研究针对大语言模型修复RTL设计时,利用任务文本相似性易误导的问题,提出MechMem-RTL框架,复用验证器确认的修复记录,通过严格匹配触发证据来注入记录,实验表明该框架在多个任务上修复效果优于标准反馈修复和任务相似性RAG。

Comments 7 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24402 2026-06-24 cs.CR 新提交 83%

Poisoned Playbooks: Demystifying Knowledge Poisoning Effects on AI Security Agents

有毒剧本:揭秘知识投毒对AI安全代理的影响

Juho Park, Hyunmin Choi, Kevin Nam

专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)

AI总结 研究揭示通过RAG注入单条有毒安全知识可系统性改变AI安全代理行为,提出验证边界(VB)分类法,并评估验证提示与多源检索的防御效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00015 2026-08-04 cs.AI 新提交 83%

Optimization and Constraint Modeling using LLMs with a Retrieval Augmented Generation Process

结合检索增强生成流程的大语言模型优化与约束建模

Prateek Roy, Akash Singirikonda

专题命中 检索器与排序 :retrieval augmented generation(title);retrieval-augmented generation(abstract);RAG(abstract_cn);分类 cs.AI

AI总结 本文提出结合检索增强生成的大语言模型优化建模方法,通过合成数据集与检索指导提升Qwen 3 30B Instruct的优化建模准确率,为低成本部署LLM优化工具提供可行方案。

Comments 20 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21951 2026-07-27 cs.IR cs.CR 新提交 83%

SIREN (Luring LLMs onto the Rocks): PAIR-Driven Preference Manipulation in Web-RAG Recommenders

SIREN(诱使大语言模型陷入困境):网页增强型大语言模型推荐系统中基于配对驱动的偏好操纵

Evan Caville, Siamak Layeghy, Billy Sung, Sara Dolnicar, Marius Portmann

专题命中 检索器与排序 :RAG(title,abstract);分类 cs.IR

AI总结 研究网页增强型大语言模型推荐系统中排序推荐的对抗操纵问题,提出SIREN方法,利用23种内容中毒技术迭代编辑检索到的网页,在两个Claude模型上实验,使选定实体多次达排名第1,验证了声明性排名等方式的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24667 2026-06-24 cs.CL 新提交 83%

DREAM: Dense Retrieval Embeddings via Autoregressive Modeling

DREAM:通过自回归建模的密集检索嵌入

Yixuan Tang, Yi Yang

机构 * The Hong Kong University of Science and Technology(香港科技大学)

专题命中 检索器与排序 :dense retrieval(title,abstract);retriever(abstract);分类 cs.CL

AI总结 提出DREAM方法,利用冻结LLM的自回归预测损失训练密集检索器,通过注意力机制注入查询-文档相似度,在BEIR和RTEB上优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01630 2026-08-04 cs.CL cs.AI 新提交 82%

RING: Retrieval-Internalized Generation for Continual Large-Scale Knowledge Injection

RING:用于持续大规模知识注入的检索内化生成

Shicheng Xu, Liang Pang, Liyi Chen, Zihao Wei, Jingcheng Deng, Yan Gao, Yi Wu, Yao Hu, Huawei Shen, Xueqi Cheng

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, CAS(中国科学院计算技术研究所人工智能安全国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Xiaohongshu Inc.(小红书科技有限公司)

专题命中 检索器与排序 :RAG(abstract,abstract_cn);retrieval-augmented generation(abstract);retriever(abstract);分类 cs.CL、cs.AI

AI总结 RING是一种将检索内化的范式,通过三阶段训练学习参数化记忆的检索策略,在自主构建的News-2025基准上,其知识注入的准确性与效率优于或匹配现有方法。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏