arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12698 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 665 篇

2606.09125 2026-06-09 cs.CR cs.AI 新提交 88%

Unveiling Privacy Risks in Multi-modal Large Language Models: Task-specific Vulnerabilities and Mitigation Challenges

多模态大语言模型中的隐私风险揭示:任务特定漏洞与缓解挑战

Tiejin Chen, Pingzhi Li, Kaixiong Zhou, Tianlong Chen, Hua Wei

机构 * Arizona State University(亚利桑那州立大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) North Carolina State University(北卡罗来纳州立大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本研究揭示了多模态大语言模型在处理图像和文本时存在的隐私泄露风险,通过构建MM-Privacy数据集评估了不同任务下的披露风险与保留风险,并强调了任务不一致性对隐私风险的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08397 2026-06-09 cs.CL cs.IR 新提交 88%

TrustMargin: Training-Free Arbitration between Parametric Memory and Retrieved Evidence in Large Language Models

TrustMargin: 大语言模型中参数化记忆与检索证据之间的无训练仲裁

Jingyan Xu, Hong Shi, Yi Shan, Penghui Liu, Yunhao Bai, Ningyuan Li, Xueyang Liu

机构 * Peking University(北京大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 针对大语言模型在知识问答中参数记忆与检索证据冲突的问题,提出无训练仲裁层TrustMargin,利用模型自身似然度评分选择更可信的答案,无需微调或外部评判。

Comments 13 pages, 6 figures, 9 tables. Code and data are available at https://github.com/mojixu/TrustMargin.git

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21867 2026-08-25 cs.AI cs.CL 新提交 88%

MemGuard: Persisting Verifier Signals for LLM-Agent Memory Governance

MemGuard:为大语言模型智能体记忆治理保留验证器信号

Haoyu Wang, Guangyuan Dong, He Liang, Zijing Zhang, Jiachen Luo, Chuang Liu, Chao Xue, Hao Tang

机构 * Nankai University(南开大学) National University of Singapore(新加坡国立大学) Shanghai Institute of Optics and Fine Mechanics, Chinese Academy of Sciences(中国科学院上海光学精密机械研究所) Peking University(北京大学) Technical University of Munich(慕尼黑工业大学) Queen Mary University of London(伦敦大学玛丽女王学院) Wuhan University(武汉大学) University of New South Wales(新南威尔士大学)

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.CL、cs.AI

AI总结 针对LLM智能体记忆的不可靠准入与漂移问题,提出MemGuard方法,通过保留验证器的生命周期元数据提升多任务基准的成功指标与效率,效果优于现有基线。

Comments 30 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16168 2026-08-18 cs.CL cs.AI 新提交 88%

QUMem: Personalized Memory for Query-Conditioned User-State Inference in LLM Agents

QUMem:面向大语言模型智能体查询条件用户状态推理的个性化记忆

Heng Wang, Yifei Li, Lingling Zhang, Pengyu Li, Xinyu Che, Xinyu Zhang, Zesheng Yang

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 QUMem 是一种结构化记忆框架,通过分割交互历史、分解记忆类型、多查询检索等方法,在 PersonaMem 和 KnowU-Bench 上实现了查询条件用户状态推理的最优性能,提升了大语言模型智能体的长期个性化能力。

Comments 9pages,3figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07438 2026-08-10 cs.AI cs.CL cs.HC 新提交 88%

PsychoAgent: An Affect-Sensitive Cognitive Architecture for Conflict-Aware Memory in LLM Agents

PsychoAgent:面向大语言模型智能体的、具备冲突感知记忆的情感敏感认知架构

Mohammad Amanlou, Parham Abed Azad, Farbod Davoodi, Mostafa Masumi, Behnam Bahrak, Abdol-Hossein Vahabie

机构 * School of Electrical and Computer Engineering, College of Engineering, University of Tehran(德黑兰大学工程学院电气与计算机工程学院) Sharif University of Technology(谢里夫理工大学) Missouri University of Science and Technology(密苏里科技大学) Tehran Institute for Advanced Studies, Khatam University(哈塔姆大学德黑兰高等研究院)

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.CL、cs.AI

AI总结 该研究提出PsychoAgent架构,分离事实与情感记忆并通过冲突感知控制器整合,在三类冲突场景中其冲突关键记忆检索率优于相关基线,为LLM智能体建模类人冲突效应提供了可检查机制。

Comments 12 pages main paper + 10 pages supplementary material; supplementary material included

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03130 2026-08-05 cs.CR cs.CL cs.LG 新提交 88%

DP-MemView: A Memory Interface for Attribute-Level Transcript Privacy in Long-Term LLM Agents

DP-MemView:面向长期大语言模型智能体的属性级对话记录隐私的内存接口

Jong Wook Kim, Byoungjae Min, Kennedy Edemacu, Yoonhyuk Choi, Sae-Hong Cho, Beakcheol Jang

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.CL、cs.LG

AI总结 针对长期LLM智能体的自适应对话记录隐私威胁,提出差分隐私内存接口DP-MemView,经实验验证可在保留个性化和响应质量的同时降低隐私泄露风险。

Comments 18 pages, 2 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23286 2026-07-28 cs.AI cs.LG 新提交 88%

TopoFE: topology-aware LLM-guided Automated Feature Engineering

TopoFE:拓扑感知的大语言模型引导的自动特征工程

Sha Li, Naren Ramakrishnan

机构 * Virginia Tech(弗吉尼亚理工大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究表格学习中自动特征工程问题,提出拓扑感知多岛进化框架TOPOFE,结合特定族探索、自适应提示记忆和拓扑引导知识转移,在多个公共数据集实验中,相比现有方法有改进,能发现更多样可转移特征程序。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02255 2026-07-03 cs.AI cs.CL 新提交 88%

AgenticSTS: A Bounded-Memory Testbed for Long-Horizon LLM Agents

AgenticSTS: 一种用于长周期LLM智能体的有界记忆测试平台

Xiangchen Cheng, Yunwei Jiang, Jianwen Sun, Zizhen Li, Chuanhao Li, Xiangcheng Cao, Yihao Liu, Fanrui Zhang, Li Jin, Kaipeng Zhang

机构 * Alaya Lab(Alaya实验室) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Nankai University(南开大学) University of Science and Technology of China(中国科学技术大学)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.CL、cs.AI

AI总结 提出一种有界记忆契约,通过类型化检索组装用户消息,避免原始跨决策转录,在《杀戮尖塔2》中实现并验证,揭示了战略技能层对胜率的提升效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07552 2026-06-26 cs.MA cs.AI cs.LG 新提交 88%

Symbolic Reasoning Frameworks Trigger Memory-Mediated Ecosystem Dynamics in Multi-Agent LLM Systems

符号推理框架在多智能体战略环境中调节大语言模型的风险规避

Augustin Chan

机构 * iterative.day

专题命中 长上下文与记忆 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本研究通过注入符号推理框架(如易经、塔罗牌)作为反思提示,发现其能差异化调节LLM的风险规避倾向,并在多智能体博弈中产生框架特定的胜者分布,且该效应源于反思过程而非内容遵循。

Comments 28 pages, 4 figures, 9 tables, 6 listings. Code and data: https://doi.org/10.5281/zenodo.20338937

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10677 2026-06-10 cs.AI cs.CL 新提交 88%

Infini Memory: Maintainable Topic Documents for Long-Term LLM Agent Memory

Infini Memory:用于长期LLM智能体记忆的可维护主题文档

Suozhao Ji, Baodong Wu, Zehao Wang, Lei Xia, Qingping Li, Ruisong Wang, Wenbo Ding, Zhenhua Zhu, Boxun Li, Guohao Dai, Yu Wang

机构 * Infinigence AI(InfiniGen AI) Tsinghua University(清华大学) Shanghai Jiaotong University(上海交通大学)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.CL、cs.AI

AI总结 提出Infini Memory架构,将智能体记忆组织为主题文档,通过缓冲合并和迭代检索实现可维护的长期记忆,在MemoryAgentBench上达到64.7%的总体得分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09483 2026-06-09 cs.CL cs.AI 新提交 88%

Memory Beyond Recall: A Dual-Process Cognitive Memory System for Self-Evolving LLM Agents

超越回忆的记忆:用于自进化LLM代理的双过程认知记忆系统

Tianxiang Fei, Mingyang Song, Mao Zheng, Xiang Yu

机构 * Tencent(腾讯)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.CL、cs.AI

AI总结 提出DCPM系统,基于双过程理论将代理记忆组织为认知能力层次,通过同步日间写入器和异步夜间引擎分别处理信念修正和模式归纳,在隐式跨会话推理任务上提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22161 2026-07-27 cs.SE cs.CR 新提交 88%

HarnessLLM: Rust Verification Harness Generation with Large Language Models

HarnessLLM:使用大语言模型生成Rust验证框架

Minghua Wang, Yuwei Liu, Lin Huang

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

AI总结 研究针对Rust代码内存安全验证开发验证框架难的问题,提出HarnessLLM自动化工作流程,利用大语言模型从测试套件生成框架,经实验评估效果良好,能检测内存安全漏洞,是首个用大语言模型为Rust项目内存安全验证生成框架的工作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24187 2026-06-25 cs.CV 新提交 88%

Towards Fast and Effective Long Video Understanding of Multimodal Large Language Models via Adaptive Quasi-Gaussian Sampling

面向多模态大语言模型的长视频快速有效理解:自适应准高斯采样

Kun Zhang, Chenxin Fang, Tao Chen, Baiyang Song, Yunhang Shen, Yiyi Zhou, Rongrong Ji

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(厦门大学多媒体可信感知与高效计算教育部重点实验室)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

AI总结 提出自适应无训练帧采样方法AdaQ,基于高斯分布3-σ规则动态调整采样区间,在仅用64帧下使Qwen3-VL-8B平均超越GPT4o 15.8%,显著提升长视频理解的鲁棒性和效率。

Comments NeurIPS 2026 submission. 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12236 2026-06-12 cs.RO cs.CV 新提交 88%

DrivingAgent: Design and Scheduling Agents for Autonomous Driving Systems

DrivingAgent: 自动驾驶系统的设计与调度智能体

Zhongyu Xia, Wenhao Chen, Yongtao Wang, Ming-Hsuan Yang

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王选计算机技术研究所) University of California, Merced(加州大学默塞德分校)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 提出DrivingAgent框架,通过自动化模块开发(设计阶段)和强化学习训练的轻量级LLM实时调度(调度阶段),解决自动驾驶系统集成新模型和满足实时约束的挑战,在nuScenes和Bench2Drive上取得更优速度-精度权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23471 2026-08-25 cs.CR cs.AI 新提交 87%

InjecMEM: Memory Injection Attack on LLM Agent Memory Systems

InjecMEM:针对大语言模型智能体记忆系统的内存注入攻击

Hanling Tian, Gengyu Zhang, Zeyang Sha, Jingying Wang, Yuhang Liu, Zhehao Huang, Kun Yang, Xiaolin Huang

机构 * Institute of Image Processing and Pattern Recognition, Shanghai Jiao Tong University(上海交通大学图像处理与模式识别研究所) Ant Group(蚂蚁集团)

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.AI

AI总结 本研究提出InjecMEM内存注入攻击,无需访问LLM智能体内存存储,通过特定锚点与对抗性命令引导后续查询输出,在多模型上验证了其有效性,为智能体内存安全研究提供了可复现框架。

Comments 29 pages, 3 figures. Accepted at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19758 2026-08-21 cs.CL 新提交 87%

FlashPrefill V2: Block-Sparse Prefill Attention for Long-Context LLM Serving

FlashPrefill V2:面向长上下文大语言模型服务的块稀疏预填充注意力机制

Qihang Fan, Huaibo Huang, Zhiying Wu, Bingning Wang, Ran He

机构 * MAIS&NLPR, CASIA(中国科学院自动化研究所多模态人工智能系统与国家重点实验室) UCAS(中国科学院大学) WeChat, Tencent(腾讯微信)

专题命中 长上下文与记忆 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 FlashPrefill V2通过均值校正、适配FlashAttention-3/4的算子设计及原生支持分页KV缓存等,在128K上下文长度下为长上下文LLM服务提供了高效的块稀疏预填充注意力方案,加速比显著。

Comments FlashPrefill V2

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16114 2026-08-18 cs.CL 新提交 87%

HyperSkill: Self-Evolving LLM Agents via Hypergraph-Structured Skill Memory

HyperSkill:基于超图结构技能记忆的自进化大语言模型智能体

Ruiyao Xu, Tiankai Yang, Wei-Chieh Huang

机构 * University of Southern California(南加州大学) University of Illinois at Chicago(伊利诺伊大学芝加哥分校) Northwestern University(西北大学)

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.CL

AI总结 本文提出HyperSkill超图记忆框架,解决LLM智能体记忆设计的存储、检索与进化问题,在多数据集上较10种基线取得显著性能提升。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12522 2026-08-14 cs.AI 新提交 87%

$\varepsilon$-MemEvo: Adaptive Cross-Task Memory Transfer for LLM Program Evolution

ε-MemEvo:面向大语言模型程序进化的自适应跨任务记忆迁移

Aofan Liu, Shiyuan Song, Yiyan Qi

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.AI

AI总结 ε-MemEvo是面向LLM程序进化的自适应跨任务记忆迁移框架,在8个优化基准上以GPT-5为主干,较AdaEvolve实现AUCC与早期收敛提升,且计算开销极低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11034 2026-08-12 cs.DC cs.LG 新提交 87%

SCOUT: Symmetric Consensus Outlier Detection for Failure Localization in LLM Pre-Training

SCOUT:用于大语言模型预训练中故障定位的对称共识异常检测

Zhuang Wang

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.LG

AI总结 SCOUT是用于LLM预训练故障定位的统一运行时框架,基于等价副本严格多数共识识别异常,可与主流大模型训练框架集成,解决现有诊断方法的局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03844 2026-08-05 cs.AI 新提交 87%

MAFIA: Query-Only Memory Attacks via Probing and Factual Injection against Audited LLM Agents

MAFIA:针对经审计的大语言模型智能体的、基于探测与事实注入的仅查询内存攻击

Jiaming Chen, Yisen Gao, Yanping Li, Zifan Liu, Yumeng Zhang, Jun Zhang

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.AI

AI总结 本研究针对经审计的LLM智能体,提出MAFIA攻击框架,通过放置策略与伪装有效载荷实现高攻击成功率,大幅降低审计检测率,揭示智能体内存系统的关键漏洞。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03391 2026-08-05 cs.LG 新提交 87%

TimeRLM: Recursive Language Models Enable Precise Anomaly Localization in Long-Context Time-Series

TimeRLM:递归语言模型可实现长时序数据中的精准异常定位

Nicolas Zumarraga, Lorenzo Steno, Ning Wang, Max Rosenblattl, Thomas Kaar, Maxwell A. Xu, Kevin O'Sullivan, Markus Kreft, Elgar Fleisch, Paul Schmiedmayer, Patrick Langer, Robert Jakob

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.LG

AI总结 提出TimeRLM(基于递归语言模型的时序异常定位框架),结合强化学习后训练后,在合成基准AnomalyXL及真实世界数据上,均优于现有时序语言模型,可实现长时序数据的精准异常定位。

Comments Open source code and datasets: https://github.com/OpenTSLM/TimeRLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29377 2026-08-03 cs.CL 新提交 87%

Zero-Mem: Zero-Token Memory Operations for LLM Agents

Zero-Mem:面向大语言模型智能体的零令牌内存操作

Yilin Xiao, Zhehan Zhu, Yujing Zhang, Jin Chen, Zijin Hong, Luyao Zhuang, Qinggang Zhang, Shengyuan Chen, Xiaocao Ouyang, Lingfei Ren, Xiao Huang

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.CL

AI总结 Zero-Mem提出零令牌内存操作,以原始交互轨迹为记录来源,通过实体-上下文图与时间层次结构组织信息,仅在最终问答时调用LLM,在长记忆问答基准中实现性能与效率的平衡,降低内存操作时间成本57.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25992 2026-07-29 cs.DB cs.AI 新提交 87%

MemLens: A Value-Aware Memory Management System with Interactive Analytics for LLM-based Agents

MemLens:一种用于基于大语言模型的智能体的具有交互式分析的价值感知内存管理系统

Shuyue Wei, Chang Liu, Zimu Zhou, Yongxin Tong, Lizhen Cui

机构 * C-FAIR & School of Software, Shandong University(C-FAIR与山东大学软件学院) SKLCCSE Lab, Beihang University(北京航空航天大学SKLCCSE实验室) Department of Data Science, City University of Hong Kong(香港城市大学数据科学系)

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.AI

AI总结 研究针对基于LLM的智能体内存管理问题,提出价值感知内存管理系统MemLens,通过端到端交互式分析仪表板展示内存生命周期,经学习助手应用程序帮助用户比较策略,可实现高效、可解释和个性化的长期内存管理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24759 2026-07-29 cs.AI cs.CY cs.DL 新提交 87%

Beyond Memory: A Templated Substrate for Heterogeneous Collaborative Knowledge Work with LLM Agents

超越记忆:一种用于异构协作知识工作的带大语言模型代理的模板化基础架构

Priscila Saboia Moreira, Christopher R. Sweet

机构 * University of Notre Dame(圣母大学)

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.AI

AI总结 研究指出知识工作成果难传承,大语言模型代理无持久记忆。提出llm-wiki-memory-template,它是异构协作知识工作基础架构,沿多人类、多代理、多领域三个轴,通过案例研究展示其能保留失败路径等,解决负面结果丢失问题。

Comments 15 pages, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05612 2026-07-08 cs.CL eess.AS 新提交 87%

Revisiting the Relation Between Language Model Perplexity and ASR Word Error Rate for Modern End-to-End Speech Recognition

重新审视现代端到端语音识别中语言模型困惑度与ASR单词错误率之间的关系

Mohammad Zeineldeen, Albert Zeyer, Haoran Zhang, Robin Schmitt, Ralf Schlüter, Hermann Ney

机构 * AppTek.ai GmbH Machine Learning and Human Language Technology Group, Faculty of Computer Science, RWTH Aachen University(机器学习与人类语言技术小组,计算机科学学院,亚琛工业大学)

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.CL

AI总结 本文重新审视现代端到端ASR系统中语言模型困惑度与ASR单词错误率的关系,研究外部语言模型对系统的作用、PPL-WER关系及相关影响因素,还探讨内部语言建模,发现ILM减法改变关系,强调解释外部LM质量影响时要考虑解码器内部LM。

Comments Submitted to SLT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05029 2026-07-07 cs.CR cs.AI 新提交 87%

Your Agent's Memories Are Not Its Own: Forged Reasoning Attacks on LLM Agent Memory and Defenses

你的智能体记忆并非其自身所有:针对大语言模型智能体记忆的伪造推理攻击及防御

Neeraj Karamchandani, Piyush Nagasubramaniam, Sencun Zhu, Dinghao Wu

机构 * The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对大语言模型智能体记忆伪造推理的攻击,提出FARMA攻击方法,通过规避语言伪造推理痕迹并强化,还引入SENTINEL防御管道,实验表明该防御能有效降低攻击成功率。

Comments Preprint. 10 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02509 2026-07-03 cs.AI 新提交 87%

ReContext: Recursive Evidence Replay as LLM Harness for Long-Context Reasoning

ReContext: 递归证据重放作为大语言模型的长上下文推理工具

Yanjun Zhao, Ruizhong Qiu, Tianxin Wei, Yuanchen Bei, Zhining Liu, Lingjie Chen, Ismini Lourentzou, Hanghang Tong, Jingrui He

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出一种免训练推理方法ReContext,通过模型内部相关性信号构建查询条件证据池并在最终生成前重放,以提升长上下文推理中的证据利用,无需外部记忆或上下文剪枝。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00760 2026-07-02 cs.LG cs.DC 新提交 87%

MosaicKV: Serving Long-Context LLM with Dynamic Two-D KV Cache Compression

MosaicKV: 通过动态二维KV缓存压缩服务长上下文LLM

Sheng Qiang, Ruiwei Chen, Yinpeng Wu, Jinyu Gu, Zhichao Hua, Yubin Xia, Binyu Zang, Haibo Chen

机构 * Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University(上海交通大学并行与分布式系统研究所)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.LG

AI总结 提出MosaicKV系统,利用动态二维KV缓存压缩解决长上下文服务中的内存瓶颈,通过细粒度稀疏性和压缩管理实现高吞吐和低延迟,在H800 GPU上取得最高16倍注意力加速和3倍内存节省。

Comments 15 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00692 2026-07-02 cs.AI 新提交 87%

Self-GC: Self-Governing Context for Long-Horizon LLM Agents

Self-GC:面向长周期LLM智能体的自管理上下文

Xubin Hao, Hongjin Meng, Xin Yin, Jiawei Zhu, Chenpeng Cao

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.AI

AI总结 提出Self-GC框架,通过将工具结果、文件等上下文对象索引化,并利用侧信道规划器进行折叠、掩码和剪枝操作,实现长周期智能体的上下文生命周期管理,显著减少前缀令牌且不影响未来延续。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22330 2026-06-23 cs.AI cs.SE 新提交 87%

Hypothesis-Driven Skill Optimization for LLM Agents

假设驱动的技能优化用于LLM智能体

Fangxin Shang, Yehui Yang

机构 * AI Lab, Qifu Technology(奇富科技人工智能实验室)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.AI

AI总结 提出HDSO框架,通过可证伪假设与验证机制从稀疏轨迹中提取可靠技能,无需训练,在ALFWorld上提升平均成功率6.9-7.1个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏