arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 4789 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 4789 篇

2605.10481 2026-05-12 cs.MA 89%

Safe Multi-Agent Behavior Must Be Maintained, Not Merely Asserted: Constraint Drift in LLM-Based Multi-Agent Systems

安全多智能体行为必须被维护,而非仅仅被断言:基于LLM的多智能体系统中的约束漂移

Tianxiao Li, Yixing Ma, Haiquan Wen, Zhenglin Huang, Qianyu Zhou, Zeyu Fu, Guangliang Cheng

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 本文探讨了基于LLM的多智能体系统中约束漂移问题,指出安全约束在执行过程中可能丢失、扭曲或减弱,提出约束状态治理作为研究范式,以确保安全行为在轨迹中持续有效。

Comments 12 pages, 2 figures, 4 tables. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05247 2026-05-08 cs.SE 89%

DADL: A Declarative Description Language for Enterprise Tool Libraries in LLM Agent Systems

DADL:用于LLM代理系统企业工具库的声明性描述语言

Axel Dunkel

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 DADL通过单一声明性文件描述REST API的端点、认证、分页等,实现企业工具库的集中管理和高效调用,显著降低上下文窗口消耗。

Comments 14 pages, 1 figure. Also published on Zenodo: https://doi.org/10.5281/zenodo.19931788

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00034 2026-05-04 cs.CR cs.PL cs.SE 89%

Symbolic Execution Meets Multi-LLM Orchestration: Detecting Memory Vulnerabilities in Incomplete Rust CVE Snippets

符号执行与多LLM协调:在不完整的Rust CVE代码片段中检测内存漏洞

Zeyad Abdelrazek, Young Lee

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 本文提出结合符号执行(KLEE)与四代理多LLM架构,解决不完整代码问题,通过协作合成可编译的KLEE测试用例,检测Rust不安全代码中的内存漏洞,实现90.3%的测试用例编译成功率,检测到1,206个关键错误。

Comments 11 pages, 1 figure, to be published in : Ease 2026 The 6th International Workshop on Software Security Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22427 2026-04-27 cs.CR 89%

Automation-Exploit: A Multi-Agent LLM Framework for Adaptive Offensive Security with Digital Twin-Based Risk-Mitigated Exploitation

自动化-漏洞利用:一种多智能体LLM框架,用于基于数字孪生的自适应进攻性安全与风险缓解漏洞利用

Biagio Andreucci, Arcangelo Castiglione

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出自动化-漏洞利用框架,通过多智能体系统在复杂黑盒场景中实现自适应进攻性安全,利用数字孪生技术缓解风险,有效解决内存漏洞等安全问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20948 2026-04-24 cs.HC 89%

Can Virtual Agents Care? Designing an Empathetic and Personalized LLM-Driven Conversational Agent

虚拟代理能关心吗?设计一个具有同理心和个性化的LLM驱动对话代理

Truong Le Minh Toan, Dieu Bang Mach, Tan Duy Le, Nguyen Tan Viet Tuyen

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出一种框架,通过检索增强架构、结构化记忆和多模态交互,设计出具有同理心和个性化支持的虚拟代理,以提升心理健康支持的质量和可靠性。

Comments Accepted manuscript version to be presented at the SCI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01379 2026-04-21 cs.SE 89%

Multi-LLM Orchestration for High-Quality Code Generation: Exploiting Complementary Model Strengths

多LLM协同生成高质量代码:利用互补模型优势

Huashan Chen, Zhenyu Qi, Haotang Li, Hong Chen, Jinfu Chen, Kebin Peng, In Kee Kim, Kyu Hyung Lee, Sen He, Weiyi Shang

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出PerfOrch系统,通过分阶段、分类别的多模型协作提升代码生成质量,利用Memory模块选择最适合的模型,实现高准确率和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03003 2026-07-07 cs.CL 新提交 89%

psytechlab at CLPsych 2026: Utilising Natural Language Processing methods and Large Language Models for Social Media Text Analysis

CLPsych 2026 中的心理技术实验室:利用自然语言处理方法和大语言模型进行社交媒体文本分析

Igor Buyanov, Nafisa Valieva, Ekaterina Mazurina

机构 * psytechlab(心理技术实验室)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);分类 cs.CL

AI总结 在 CLPsych 2026 共享任务中,利用自然语言处理方法和大语言模型对社交媒体文本进行自我状态和幸福感分析与总结,为改进心理健康支持系统做贡献。

Comments Accepted by CLPsych2026. CLPsych 2026 will be held at ACL in San Diego July 4th, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10387 2026-06-03 cs.DB cs.AI 89%

Test-Time Optimization of Physical Query Plans with LLMs

基于LLM的物理查询计划测试时优化

Mehmet Hamza Erol, Xiangpeng Hao, Federico Bianchi, Ciro Greco, Jacopo Tagliabue, James Zou

机构 * Stanford University(斯坦福大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) TogetherAI Bauplan

专题命中 长上下文与记忆 :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出DBPlanBench框架,利用LLM在测试时通过语义推理和进化搜索优化物理查询计划,在OLAP查询中实现1.05-1.12倍中位数加速,并支持小规模到大规模的迁移。

Comments Code is available at: https://github.com/BauplanLabs/DBPLANBENCH

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00150 2026-06-02 cs.CR cs.AI 89%

Persona Attack: Incremental Memory Injection Jailbreak Attack against Large Language Models

人格攻击:针对大型语言模型的增量记忆注入越狱攻击

Junyoung Park, Seongyong Ju, Sunghwan Park, Jaewoo Lee

机构 * Chung-Ang University(Chung-Ang 大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);分类 cs.AI

AI总结 提出一种基于记忆注入的越狱方法Persona Attack,通过逐步操纵模型上下文窗口,使模型在记忆积累中优先处理注入指令,从而绕过安全对齐,在特定配置下攻击成功率可达95%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17310 2026-04-13 q-bio.NC cs.CL cs.NE 89%

PaceLLM: Brain-Inspired Large Language Models for Long-Context Understanding

PaceLLM:用于长上下文理解的脑启发式大语言模型

Kangcong Li, Peng Ye, Chongjun Tu, Lin Zhang, Chunfeng Song, Jiamin Wu, Tao Yang, Qihao Zheng, Tao Chen

机构 * School of Information Science and Technology, Fudan University(复旦大学信息科学与技术学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 PaceLLM通过引入持久活动机制和皮层专家聚类,解决大语言模型在长上下文中的信息衰减和语义碎片化问题,提升多文档问答和无限基准任务性能,扩展上下文长度至200K tokens。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07752 2026-04-10 cs.SE cs.AI 89%

MIMIC-Py: An Extensible Tool for Personality-Driven Automated Game Testing with Large Language Models

MIMIC-Py:一种基于人格驱动的大型语言模型自动游戏测试工具

Yifei Chen, Sarra Habchi, Lili Wei

机构 * Electrical and Computer Engineering, McGill University(麦吉尔大学电气与计算机工程系)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 MIMIC-Py通过模块化架构实现人格驱动LLM代理的可重用性和扩展性,支持多种交互机制,降低新游戏环境部署难度。

Comments 10 pages, Accepted by FSE Companion '26, July 5--9, 2026, Montreal, QC, Canada

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20578 2026-03-24 cs.AI 89%

Context Cartography: Toward Structured Governance of Contextual Space in Large Language Model Systems

上下文制图:迈向大型语言模型系统中上下文空间的结构化治理

Zihua Wu, Georg Gartner

机构 * NVIDIA(英伟达) Research Division Cartography, TU Wien(地图研究部,维也纳技术大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出Context Cartography框架,通过定义三区模型和七种制图操作,系统治理上下文空间的结构与信息流动,验证其在实际系统中的有效性。

Comments 31 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14646 2026-03-17 cs.AI 89%

Dynamic Theory of Mind as a Temporal Memory Problem: Evidence from Large Language Models

动态心智理论作为时间记忆问题:来自大语言模型的证据

Thuy Ngoc Nguyen, Duy Nhat Phan, Cleotilde Gonzalez

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 研究探讨了动态心智理论作为时间延伸表征记忆问题,发现大语言模型在跟踪信念轨迹方面存在挑战,揭示了记忆与干扰机制在社会推理中的影响。

Comments 8 pages, 4 figures, 3 tables, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09982 2026-03-06 cs.CL 89%

INMS: Memory Sharing for Large Language Model based Agents

INMS: 基于大语言模型的智能体中的记忆共享

Hang Gao, Yongfeng Zhang

机构 * Rutgers University(罗格斯大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 INMS通过异步交互范式实现多智能体间的动态记忆共享,提升开放性场景下的智能体性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01822 2026-03-03 cs.AI 89%

Emerging Human-like Strategies for Semantic Memory Foraging in Large Language Models

新兴的人类样策略在大语言模型中的语义记忆采集

Eric Lacosse, Mariana Duarte, Peter M. Todd, Daniel C. McNamee

机构 * Champalimaud Research(恰帕拉德研究) Centre for Restorative Neurotechnology(修复性神经技术中心) Indiana University(印第安纳大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);SFT(abstract);分类 cs.AI

AI总结 本研究通过分析大语言模型中的语义流畅任务,探索其语义记忆采集策略,揭示人类与AI在认知机制上的异同。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01832 2026-03-02 cs.CL 89%

MLP Memory: A Retriever-Pretrained Memory for Large Language Models

MLP Memory: 一种用于大语言模型的检索预训练记忆

Rubin Wei, Jiaqi Cao, Jiarui Wang, Jushi Kai, Qipeng Guo, Bowen Zhou, Zhouhan Lin

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL

AI总结 MLP Memory通过参数化学习检索模式,提升大语言模型的知识访问效率与准确性,实现更高效的推理和更少的幻觉。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13614 2026-02-24 cs.CL 89%

MemoTime: Memory-Augmented Temporal Knowledge Graph Enhanced Large Language Model Reasoning

MemoTime: 带记忆的时序知识图增强大语言模型推理

Xingyu Tan, Xiaoyang Wang, Qing Liu, Xiwei Xu, Xin Yuan, Liming Zhu, Wenjie Zhang

机构 * UNSW Data61(新南威尔士大学Data61) CSIRO(澳大利亚联邦科学与工业研究组织) UNSW Sydney Australia(新南威尔士大学悉尼分校) Data61, CSIRO(Data61,澳大利亚联邦科学与工业研究组织)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 MemoTime通过带记忆的时序知识图框架提升LLM的时序推理能力,解决多跳推理、多实体同步、运算符适应和经验重用等挑战,实现先进性能。

Comments Accepted by The Web Conference 2026 (WWW, 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00748 2026-02-04 cs.DC cs.AI cs.AR 89%

HyperOffload: Graph-Driven Hierarchical Memory Management for Large Language Models on SuperNode Architectures

HyperOffload: 图驱动的分层内存管理用于超节点架构上的大型语言模型

Fangxin Liu, Qinghua Zhang, Hanjing Shen, Zhibo Liang, Li Jiang, Haibing Guan, Chong Bao, Xuefeng Jin

机构 * Shanghai Jiao Tong University(上海交通大学) Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 HyperOffload通过图驱动的编译器方法优化超节点架构上的LLM内存管理,减少峰值内存使用并提升计算效率。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07334 2026-01-13 cs.LG 89%

Graph-KV: Breaking Sequence via Injecting Structural Biases into Large Language Models

Graph-KV: 通过向大语言模型注入结构偏差打破序列

Haoyu Wang, Peihao Wang, Mufei Li, Shikun Liu, Siqi Miao, Zhangyang Wang, Pan Li

机构 * Georgia Institute of Technology(佐治亚理工学院) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 Graph-KV通过引入结构偏差打破序列限制,提升大语言模型在图结构任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20662 2025-12-25 cs.AI 89%

Quantifying Laziness, Decoding Suboptimality, and Context Degradation in Large Language Models

量化懒惰、解码亚优性和上下文退化现象于大语言模型

Yiqing Ma, Jung-Hua Liu

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

AI总结 研究量化了大语言模型在多部分指令中的懒惰、解码亚优性和上下文退化现象,发现模型在简单任务中表现稳健,但需通过自我完善和动态提示提升指令合规性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14118 2025-12-17 cs.CL 89%

CogMem: A Cognitive Memory Architecture for Sustained Multi-Turn Reasoning in Large Language Models

CogMem:一种用于大型语言模型中持续多轮推理的认知记忆架构

Yiran Zhang, Jincheng Hu, Mark Dras, Usman Naseem

机构 * Macquarie University(麦考瑞大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 CogMem通过引入认知启发的记忆增强架构,解决大型语言模型在多轮交互中的推理偏差、任务漂移和记忆衰减问题,提升推理的连贯性和可靠性。

Comments underreview

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06727 2025-12-09 cs.LG 89%

KV-CAR: KV Cache Compression using Autoencoders and KV Reuse in Large Language Models

KV-CAR: 使用自编码器和KV重用的KV缓存压缩

Sourjya Roy, Shrihari Sridharan, Surya Selvam, Anand Raghunathan

机构 * Elmore Family School of Electrical and Computer Engineering, Purdue University, West Lafayette, IN(电气与计算机工程系,普渡大学,西拉法叶,印第安纳州)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 KV-CAR通过自编码器和KV重用技术,有效压缩KV缓存,减少内存占用,提升大语言模型推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17129 2025-11-12 cs.CL 89%

Thus Spake Long-Context Large Language Model

Xiaoran Liu, Ruixiao Li, Mianqiu Huang, Zhigeng Liu, Yuerong Song, Qipeng Guo, Siyang He, Qiqi Wang, Linlin Li, Qun Liu, Ziwei He, Yaqian Zhou, Xuanjing Huang, Xipeng Qiu

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments a global picture of the lifecycle of long-context LLMs from four perspectives: architecture, infrastructure, training, and evaluation

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23882 2025-10-29 cs.AI 89%

Hybrid Modeling, Sim-to-Real Reinforcement Learning, and Large Language Model Driven Control for Digital Twins

Adil Rasheed, Oscar Ravik, Omer San

机构 * Department of Engineering Cybernetics, NTNU(工程 cybernetics 系,NTNU) Department of Mechanical, Aerospace and Biomedical Engineering, University of Tennessee(机械、航空航天与生物医学工程系,田纳西大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06560 2025-10-29 cs.CL 89%

NeedleInATable: Exploring Long-Context Capability of Large Language Models towards Long-Structured Tables

Lanrui Wang, Mingyu Zheng, Hongyin Tang, Zheng Lin, Yanan Cao, Jingang Wang, Xunliang Cai, Weiping Wang

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26340 2025-10-01 cs.LG 89%

Memory-Driven Self-Improvement for Decision Making with Large Language Models

Xue Yan, Zijing Ou, Mengyue Yang, Yan Song, Haifeng Zhang, Yingzhen Li, Jun Wang

机构 * Institute of Automation, Chinese Academy of Science(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Imperial College London(伦敦帝国学院) University of Bristol(布里斯托大学) AI Centre, Department of Computer Science, University College London(伦敦大学学院计算机科学系人工智能中心)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13753 2025-09-18 cs.LG 89%

ST-LINK: Spatially-Aware Large Language Models for Spatio-Temporal Forecasting

Hyotaek Jeon, Hyunwook Lee, Juwon Kim, Sungahn Ko

机构 * Pohang University of Science and Technology(釜山科学技术大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments 11 pages, 4 figures, Accepted to CIKM 2025. Code: https://github.com/HyoTaek98/ST_LINK

Journal ref The 34th ACM International Conference on Information and Knowledge Management (CIKM 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21407 2025-09-03 cs.AI 89%

Graph-Augmented Large Language Model Agents: Current Progress and Future Prospects

Yixin Liu, Guibin Zhang, Kun Wang, Shiyuan Li, Shirui Pan

机构 * Griffith University(格里菲斯大学) National University of Singapore(国立新加坡大学) Nanyang Technological University(南洋理工大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 15 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21004 2025-08-29 cs.CL 89%

Lethe: Purifying Backdoored Large Language Models with Knowledge Dilution

Chen Chen, Yuchen Sun, Jiaxin Gao, Xueluan Gong, Qian Wang, Ziyao Wang, Yongsen Zheng, Kwok-Yan Lam

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13152 2025-08-27 cs.CV cs.AI cs.RO 89%

SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models

Xiangyu Dong, Haoran Zhao, Jiang Gao, Haozhou Li, Xiaoguang Ma, Yaoming Zhou, Fuhai Chen, Juan Liu

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏