arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 4789 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 4789 篇

2405.19010 2024-05-30 cs.CL cs.AI cs.IR 90%

Evaluating the External and Parametric Knowledge Fusion of Large Language Models

Hao Zhang, Yuyang Zhang, Xiaoguang Li, Wenxuan Shi, Haonan Xu, Huanshuo Liu, Yasheng Wang, Lifeng Shang, Qun Liu, Yong Liu, Ruiming Tang

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 15 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17259 2024-05-29 cs.CL cs.AI 90%

Empowering Working Memory for Large Language Model Agents

Jing Guo, Nan Li, Jianchuan Qi, Hang Yang, Ruiqiao Li, Yuzhen Feng, Si Zhang, Ming Xu

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15638 2024-04-30 cs.CR cs.CL cs.LG 90%

Differentially Private Next-Token Prediction of Large Language Models

James Flemings, Meisam Razaviyayn, Murali Annavaram

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09747 2024-03-18 cs.CL cs.AI 90%

Re-Search for The Truth: Multi-round Retrieval-augmented Large Language Models are Strong Fake News Detectors

Guanghua Li, Wensheng Lu, Wei Zhang, Defu Lian, Kezhong Lu, Rui Mao, Kai Shu, Hao Liao

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13300 2024-02-28 cs.CL cs.AI 90%

Adaptive Chameleon or Stubborn Sloth: Revealing the Behavior of Large Language Models in Knowledge Conflicts

Jian Xie, Kai Zhang, Jiangjie Chen, Renze Lou, Yu Su

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments ICLR 2024 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11353 2024-02-20 cs.HC cs.AI cs.CL 90%

Understanding the Impact of Long-Term Memory on Self-Disclosure with Large Language Model-Driven Chatbots for Public Health Intervention

Eunkyung Jo, Yuin Jeong, SoHyun Park, Daniel A. Epstein, Young-Ho Kim

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACM CHI 2024 as a full paper

Journal ref In Proceedings of the CHI Conference on Human Factors in Computing Systems (CHI '24), May 11-16, 2024, Honolulu, HI, USA. ACM, New York, NY, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.11459 2024-01-23 cs.AR cs.AI cs.LG 90%

AttentionLego: An Open-Source Building Block For Spatially-Scalable Large Language Model Accelerator With Processing-In-Memory Technology

Rongqing Cong, Wenyang He, Mingxuan Li, Bangning Luo, Zebin Yang, Yuchao Yang, Ru Huang, Bonan Yan

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

Comments for associated source codes, see https://bonany.cc/attentionleg

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07159 2024-01-17 cs.LG cs.AI 90%

Quantized Side Tuning: Fast and Memory-Efficient Tuning of Quantized Large Language Models

Zhengxin Zhang, Dan Zhao, Xupeng Miao, Gabriele Oliaro, Qing Li, Yong Jiang, Zhihao Jia

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01242 2023-12-05 cs.AI cs.CL 90%

Responsible Task Automation: Empowering Large Language Models as Responsible Task Automators

Zhizheng Zhang, Xiaoyi Zhang, Wenxuan Xie, Yan Lu

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07314 2023-11-14 cs.CL cs.AI 90%

Semi-automatic Data Enhancement for Document-Level Relation Extraction with Distant Supervision from Large Language Models

Junpeng Li, Zixia Jia, Zilong Zheng

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08129 2023-11-03 cs.CV cs.AI cs.CL 90%

AVIS: Autonomous Visual Information Seeking with Large Language Model Agent

Ziniu Hu, Ahmet Iscen, Chen Sun, Kai-Wei Chang, Yizhou Sun, David A Ross, Cordelia Schmid, Alireza Fathi

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Published on NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10250 2023-05-23 cs.CL cs.AI 90%

MemoryBank: Enhancing Large Language Models with Long-Term Memory

Wanjun Zhong, Lianghong Guo, Qiqi Gao, He Ye, Yanlin Wang

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.17557 2023-03-31 cs.CL cs.LG cs.NE 90%

Recognition, recall, and retention of few-shot memories in large language models

A. Emin Orhan

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);small language model(abstract);分类 cs.CL、cs.LG

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20202 2026-08-21 cs.AI cs.CL cs.CY cs.DB cs.LG 新提交 89%

MemTrapBench: Benchmarking Cognitive Traps in LLM Memory Use

MemTrapBench:大语言模型记忆使用中认知陷阱的基准测试

Mengru Wang, Haozhe Luo, Zhenqian Xu, Zhixiang Cui, Haoming Xu, Qu Yang, Jizhan Fang, Junfeng Fang, Ningyu Zhang

专题命中 长上下文与记忆 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究人员提出MemTrapBench基准测试,发现现有LLM记忆策略存在认知陷阱致性能下降,进而提出AdaptiveMem方法可缓解该问题并提升标准记忆基准性能。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16023 2026-08-18 eess.AS 新提交 89%

Cached LLM Probability Retrieval for Speech Recognition

用于语音识别的缓存大语言模型概率检索

Sheng Li, Takahiro Shinozaki, Tatsuya Kawahara

专题命中 长上下文与记忆 :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 针对LLM直接重评分ASR假设成本高的问题,本文提出无需训练的缓存LLM概率检索方法,在多数设置下优于1-pass ASR,是轻量有效的ASR适配方案。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13962 2026-08-17 cs.AR 新提交 89%

MoE Expert Execution in Disaggregated LLM Serving with a High-Bandwidth ReRAM Near-Memory Architecture

采用高带宽ReRAM近内存架构的分散式大语言模型(LLM)服务中的MoE专家执行

Kunming Shao, Ming Zeng, Xin Yuan, Binbin Liao, Yangming Zhang, Wei Wang, Tim Kwang-Ting Cheng, Chi-Ying Tsui

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 本文针对分散式LLM服务中MoE专家执行的资源效率问题,提出ReRAM近内存架构,通过优化池化、放置与取数策略提升资源占用率,在实测中大幅降低延迟与能耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27187 2026-07-30 cs.PF 新提交 89%

A Photonic-CXL Memory Appliance for Scalable KV Cache Management in LLM Inference

用于LLM推理中可扩展KV缓存管理的光子-CXL存储设备

Jing Ding, Yash Nishant, Chandrish Ambati, Jyothsna Kamati, Trung Diep

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 该研究针对LLM推理的存储墙问题,提出Marvell光子-CXL混合存储设备,实现32 TB共享内存,延迟降超50%,多轮对话首token时间提升6.6倍,解决了电气CXL池的部署痛点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06273 2026-07-08 cs.SE 新提交 89%

AgentTether: Graph-Guided Diagnosis and Runtime Intervention for Reliable LLM Agent Operation

AgentTether:用于可靠大语言模型代理操作的图引导诊断与运行时干预

Chenyu Zhao, Shenglin Zhang, Wenwei Gu, Yongqian Sun, Dan Pei, Chetan Bansal, Saravan Rajmohan, Minghua Ma

专题命中 长上下文与记忆 :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究LLM代理生产可靠性有限问题,提出AgentTether运行时修复框架,通过抽象运行、构建关键转换图等定位故障子轨迹并转换为指导,经实验评估,该框架能提高修复效果,减少资源消耗,为代理部署提供实用可靠性层。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26883 2026-07-01 cs.DL 新提交 89%

EconSimulacra: A Digital Twin Platform of Socio-Economic Systems Powered by LLM Agents

EconSimulacra:基于LLM代理的社会经济系统数字孪生平台

Ryuji Hashimoto, Masahiro Kaneko, Kentaro Ueda, Takehiro Takayanagi, Kiyoshi Izumi

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 提出EconSimulacra,一种通过共享内部状态机制耦合消费经济、移动性和社交网络的多智能体模拟器,使代理能产生跨领域一致行为,并复现线上关注与线下流行度的非线性关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23752 2026-06-24 cs.SE 新提交 89%

ESAA-Conversational: An Event-Sourced Memory Layer for Continuity, Handoff, and Curation Across Heterogeneous LLM Coding Agents

ESAA-Conversational:一种用于异构LLM编码智能体之间连续性、交接和策管的事件溯源记忆层

Elzo Brito dos Santos Filho

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 提出ESAA-Conversational架构,通过事件溯源实现跨多个LLM编码智能体的共享会话记忆,解决会话状态漂移问题,支持连续性、交接和策管。

Comments 11 pages, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15229 2026-06-16 cs.CR 新提交 89%

LLM: LSTM Look-Ahead Moving Target Defense Based on Historical Malicious Scan

LLM:基于历史恶意扫描的LSTM前瞻移动目标防御

Yu Li

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 提出LLM方法,利用LSTM网络预测攻击者可能扫描的目标地址,结合集成学习和动态变异机制,提升IP shuffling的安全性和降低开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14779 2026-06-16 cs.AR 新提交 89%

Unified KV Pooling to Accelerate Long-Context LLM Serving

统一KV池化以加速长上下文LLM服务

Minchul Kang, Changyong Shin, Jinwoo Jeong, Jaerim Park, Woohyun Kim, Bonyul Gu, Dongwoo Kang, Gyeongsik Yang, Chuck Yoo

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 针对长上下文LLM服务中KV缓存卸载到主机内存和SSD时的高延迟问题,提出统一KV池化方法,聚合多设备并绕过内核文件系统,实现TTFT降低约4.1倍。

Comments 7 pages, 12 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12142 2026-06-11 cs.RO cs.CV 新提交 89%

AerialClaw: An Open-Source Framework for LLM-Driven Autonomous Aerial Agents

AerialClaw:一个用于LLM驱动的自主空中智能体的开源框架

Ke Li, Jianfei Yang, Luyao Zhang, Guo Yu, Chengwei Yan, Yuan Ding, Di Wang, Nan Luo, Gang Liu, Xiao Gao, Quan Wang

机构 * Xidian University(西安电子科技大学) Xi'an University of Architecture and Technology(西安建筑科技大学)

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 提出AerialClaw开源框架,采用模块化脑-技能-运行时架构,使基于LLM的智能体能够理解自然语言任务、调用空中技能、闭环决策,提升无人机系统的灵活性、可复现性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06254 2026-06-03 cs.IR 89%

EviRerank: Adaptive Evidence Construction for Long-Document LLM Reranking

EviRerank:面向长文档LLM重排序的自适应证据构建

Minghan Li, Eric Gaussier, Juntao Li, Guodong Zhou

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 针对解码器-only LLM重排序长文档时推理成本高、相关信号被无关上下文稀释的问题,提出EviRerank框架,通过轻量选择器分块、自适应证据预算(AEB)和摘要增强(SA)构建紧凑证据上下文,再用LLM重排序,在多个基准上超越全文档重排序和强基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13301 2026-06-01 cs.AR 89%

LIMCA: LLM for Automating Analog In-Memory Computing Architecture Design Exploration

LIMCA: 用于自动化模拟内存计算架构设计探索的LLM

Deepak Vungarala, Md Hasibul Amin, Pietro Mercati, Arnob Ghosh, Arman Roohi, David Z. Pan, Ramtin Zand, Shaahin Angizi

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 提出一种无需微调的大语言模型驱动框架LIMCA,通过无人工干预的自动化流程生成和验证模拟内存计算交叉阵列的电路网表,实现设计空间探索,在MNIST分类任务中达到≥96%准确率和≤3W功耗。

Comments 4 Figures, 6 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29157 2026-05-29 cs.LG cs.AI cs.CL 89%

Parallax: Parameterized Local Linear Attention for Language Modeling

Parallax: 参数化局部线性注意力用于语言建模

Yifei Zuo, Dhruv Pai, Zhichen Zeng, Alec Dewulf, Shuming Hu, Zhaoran Wang

机构 * Northwestern University(西北大学) Tilde Research(Tilde研究) University of Washington(华盛顿大学)

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);pretraining(abstract)

AI总结 提出Parallax,一种可扩展的参数化局部线性注意力机制,通过消除数值求解器并学习查询投影器,在语言模型预训练中实现一致的困惑度改进和下游任务迁移优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27419 2026-05-28 cs.MA cs.CY 89%

APS: Bias-Controlled Adaptive Prototype Simulation for Population-Scale LLM Agents

APS:面向群体规模LLM智能体的偏差控制自适应原型模拟

Quan Zheng, Yan Gao, Shaobin He, Haoxiang Guan, Yuanhe Tian, Jie Feng, Ming Wang, Shuxin Zheng, Zhen Liu

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 提出自适应原型模拟(APS)框架,通过原型响应、影子审计和尾部保护机制减少在线LLM调用,实现群体规模多轮模拟的高效近似,并在千万级智能体模拟中实现381倍加速且保持低分布差异。

Comments 32 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16045 2026-05-18 cs.CL cs.AI cs.LG 89%

RecMem: Recurrence-based Memory Consolidation for Efficient and Effective Long-Running LLM Agents

RecMem:基于递归的记忆巩固用于高效且有效的长运行LLM代理

Zijie Dai, Shiyuan Deng, Sheng Guan, Yizhou Tian, Xin Yao, Xiao Yan, James Cheng

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) School of Computer Science, Beijing University of Posts and Telecommunications(北京邮电大学计算机学院) Huawei Cloud(华为云) Huawei Theory Lab(华为理论实验室) Institute for Math and AI, Wuhan University(武汉大学数学与人工智能研究院)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 RecMem通过递归机制优化内存巩固,减少token消耗并提升准确性,有效解决长运行LLM代理的内存管理问题。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00364 2026-05-18 cs.CR 89%

"Someone Hid It": Query-Agnostic Black-Box Attacks on LLM-Based Retrieval

有人隐藏了它:针对基于大语言模型的检索的查询无关黑盒攻击

Jiate Li, Defu Cao, Li Li, Wei Yang, Yuehan Qin, Chenxiao Yu, Tiannuo Yang, Ryan A. Rossi, Yan Liu, Xiyang Hu, Yue Zhao

专题命中 长上下文与记忆 :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 本文提出一种无需查询或模型知识的黑盒攻击方法,通过零样本代理LLM生成可迁移的注入标记,揭示LLM检索系统的脆弱性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16056 2026-05-14 cs.DC cs.NI cs.PF 89%

MultiPath Memory Access: Breaking Host-GPU Bandwidth Bottlenecks in LLM Services

多路径内存访问:突破LLM服务中的主机-GPU带宽瓶颈

Lingfeng Tang, Daoping Zhang, Junjie Chen, Peihao Huang, Feng Jin, Chengguang Xu, Yuxin Chen, Feiqiang Sun, Guo Chen

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 本文提出MMA系统,通过多路径内存访问技术提升主机与GPU间的数据传输效率,减少LLM服务中的延迟瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏