arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 4797 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 4797 篇

2505.00675 2025-12-25 cs.CL 85%

Rethinking Memory in LLM based Agents: Representations, Operations, and Emerging Topics

重新思考基于大语言模型的智能体中的记忆:表示、操作与新兴主题

Yiming Du, Wenyu Huang, Danna Zheng, Zhaowei Wang, Sebastien Montella, Mirella Lapata, Kam-Fai Wong, Jeff Z. Pan

机构 * The Chinese University of Hong Kong Hong Kong China The University of Edinburgh Edinburgh UK The Hong Kong University of Science Huawei Technologies Research \& Development (UK) Limited Edinburgh UK The Chinese University of Hong Kong The University of Edinburgh Huawei Technologies Research \& Development (UK) Limited

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出基于大语言模型的智能体中记忆的分类框架,涵盖参数型与上下文型记忆,定义六个核心操作,并揭示四个关键研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20237 2025-12-24 cs.AI 85%

MemR$^3$: Memory Retrieval via Reflective Reasoning for LLM Agents

MemR$^3$: 通过反思推理实现LLM代理的记忆检索

Xingbo Du, Loka Li, Duzhen Zhang, Le Song

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 MemR$^3$通过反思推理实现LLM代理的记忆检索,提升检索准确性和闭环控制能力。

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12923 2025-12-16 cs.AI cs.MA 85%

The Traitors: Deception and Trust in Multi-Agent Language Model Simulations

背叛者:多智能体语言模型模拟中的欺骗与信任

Pedro M. P. Curvo

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

AI总结 The Traitors通过多智能体模拟研究LLM在社交互动中的欺骗与信任问题,揭示先进模型在欺骗能力与检测能力上的不对称性。

Comments 9 main pages, 31 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02665 2025-12-03 cs.CL 85%

Input Order Shapes LLM Semantic Alignment in Multi-Document Summarization

输入顺序影响多文档摘要中LLM语义对齐

Jing Ma

机构 * University of Zurich(苏黎世大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究发现输入顺序显著影响LLM在多文档摘要中的语义对齐,优先位置的文章对摘要的语义相似性有显著影响。

Comments 9 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01357 2025-12-02 cs.DC cs.AI cs.AR 85%

Tangram: Accelerating Serverless LLM Loading through GPU Memory Reuse and Affinity

Tangram: 通过GPU内存重用和亲和力加速无服务器LLM加载

Wenbin Zhu, Zhaoyan Shen, Zili Shao, Hongjun Dai, Feng Chen

机构 * Shandong University(山东大学) The Chinese University of Hong Kong(香港中文大学) Indiana University Bloomington(印第安纳大学布卢明顿分校)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Tangram通过GPU内存重用和亲和力调度技术,显著提升无服务器LLM的加载速度和冷启动性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14794 2025-11-20 cs.SE cs.AI 85%

irace-evo: Automatic Algorithm Configuration Extended With LLM-Based Code Evolution

Camilo Chacón Sartori, Christian Blum

机构 * Catalan Institute of Nanoscience and Nanotechnology (ICN2), CSIC and BIST(加泰罗尼亚纳米科学与纳米技术研究所(ICN2)、西班牙国家科研学院(CSIC)和巴塞罗那技术研究所(BIST)) Artificial Intelligence Research Institute (IIIA-CSIC)(人工智能研究所(IIIA-CSIC))

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20462 2025-11-06 cs.AI 85%

TAMO: Fine-Grained Root Cause Analysis via Tool-Assisted LLM Agent with Multi-Modality Observation Data in Cloud-Native Systems

Xiao Zhang, Qi Wang, Mingyi Li, Yuan Yuan, Mengbai Xiao, Fuzhen Zhuang, Dongxiao Yu

机构 * School of Computer Science and Technology, Shandong University(山东大学计算机科学与技术学院) Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能研究院)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00321 2025-11-04 cs.AR cs.AI 85%

Scalable Processing-Near-Memory for 1M-Token LLM Inference: CXL-Enabled KV-Cache Management Beyond GPU Limits

Dowon Kim, MinJae Lee, Janghyeon Kim, HyuckSung Kwon, Hyeonggyu Jeong, Sang-Soo Park, Minyong Yoon, Si-Dong Roh, Yongsuk Kwon, Jinin So, Jungwook Choi

机构 * Hanyang University(翰阳大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22956 2025-10-28 cs.CL cs.IR 85%

Tagging-Augmented Generation: Assisting Language Models in Finding Intricate Knowledge In Long Contexts

Anwesan Pal, Karen Hovsepian, Tinghao Guo, Mengnan Zhao, Somendra Tripathi, Nikos Kanakaris, George Mihaila, Sumit Nigam

机构 * AWS AI Labs(AWS人工智能实验室) Amazon Web Services(亚马逊网络服务) Amazon OTS(亚马逊OTS) Amazon Catalog AI(亚马逊目录人工智能)

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments Paper accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15648 2025-10-28 cs.CR cs.LG cs.SE 85%

deepSURF: Detecting Memory Safety Vulnerabilities in Rust Through Fuzzing LLM-Augmented Harnesses

Georgios Androutsopoulos, Antonio Bianchi

机构 * Purdue University(普渡大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments At IEEE S&P 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23804 2025-10-22 cs.CR cs.CL cs.IR cs.MA 85%

DrunkAgent: Stealthy Memory Corruption in LLM-Powered Recommender Agents

Shiyi Yang, Zhibo Hu, Xinshu Li, Chen Wang, Tong Yu, Xiwei Xu, Liming Zhu, Lina Yao

机构 * The University of New South Wales(新南威尔士大学) Macquarie University(麦考瑞大学) Adobe Research(Adobe研究)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13925 2025-10-17 cs.CL cs.CR cs.NI 85%

An LLM-Powered AI Agent Framework for Holistic IoT Traffic Interpretation

Daniel Adu Worae, Spyridon Mastorakis

机构 * University of Notre Dame(内布拉斯加大学达灵顿分校)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09688 2025-10-17 cs.CL 85%

Squeezed Attention: Accelerating Long Context Length LLM Inference

Coleman Hooper, Sehoon Kim, Hiva Mohammadzadeh, Monishwaran Maheswaran, Sebastian Zhao, June Paik, Michael W. Mahoney, Kurt Keutzer, Amir Gholami

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 22 Pages

Journal ref ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12423 2025-10-15 cs.AI 85%

MTOS: A LLM-Driven Multi-topic Opinion Simulation Framework for Exploring Echo Chamber Dynamics

Dingyi Zuo, Hongjie Zhang, Jie Ou, Chaosheng Feng, Shuwan Liu

机构 * Sichuan Normal University, College of Computer Science(四川师范大学计算机学院) University of Electronic Science and Technology of China, School of Information and Software Engineering(电子科技大学信息与软件工程学院)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 14 pages, 11figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16067 2025-10-14 cs.AI 85%

How Memory Management Impacts LLM Agents: An Empirical Study of Experience-Following Behavior

Zidi Xiong, Yuping Lin, Wenya Xie, Pengfei He, Zirui Liu, Jiliang Tang, Himabindu Lakkaraju, Zhen Xiang

机构 * Harvard University(哈佛大学) University of Georgia(佐治亚大学) Michigan State University(密歇根州立大学) University of Minnesota-Twin Cities(明尼苏达大学双城分校)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07925 2025-10-10 cs.AI cs.HC 85%

Enabling Personalized Long-term Interactions in LLM-based Agents through Persistent Memory and User Profiles

Rebecca Westhäußer, Wolfgang Minker, Sebatian Zepf

机构 * Ulm University(乌尔姆大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 8 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14053 2025-10-10 cs.AR cs.AI cs.MA 85%

MAHL: Multi-Agent LLM-Guided Hierarchical Chiplet Design with Adaptive Debugging

Jinwei Tang, Jiayin Qin, Nuo Xu, Pragnya Sudershan Nalla, Yu Cao, Yang, Zhao, Caiwen Ding

机构 * University of Minnesota - Twin Cities(明尼苏达大学-双城分校)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05186 2025-10-08 cs.DC cs.AI math.OC 85%

OptPipe: Memory- and Scheduling-Optimized Pipeline Parallelism for LLM Training

Hongpei Li, Han Zhang, Huikang Liu, Dongdong Ge, Yinyu Ye

机构 * Shanghai University of Finance and Economics(上海金融学院) National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学) Stanford University(斯坦福大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Use Mathematical Programming to model Pipeline Parallelism with Offloading to balance efficiency and memory requirement

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02373 2025-10-06 cs.CR cs.AI 85%

A-MemGuard: A Proactive Defense Framework for LLM-Based Agent Memory

Qianshan Wei, Tengchao Yang, Yaochen Wang, Xinfeng Li, Lijun Li, Zhenfei Yin, Yi Zhan, Thorsten Holz, Zhiqiang Lin, XiaoFeng Wang

机构 * Nanyang Technological University(南洋理工大学) University of Oxford(牛津大学) Max Planck Institute(马克斯·普朗克研究所) The Ohio State University(俄亥俄州立大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25370 2025-10-01 cs.AI 85%

Where LLM Agents Fail and How They can Learn From Failures

Kunlun Zhu, Zijia Liu, Bingxuan Li, Muxin Tian, Yingxuan Yang, Jiaxun Zhang, Pengrui Han, Qipeng Xie, Fuyang Cui, Weijia Zhang, Xiaoteng Ma, Xiaodong Yu, Gowtham Ramesh, Jialian Wu, Zicheng Liu, Pan Lu, James Zou, Jiaxuan You

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23113 2025-09-30 cs.AI cs.CY 85%

Exploring LLM-based Frameworks for Fault Diagnosis

Xian Yeow Lee, Lasitha Vidyaratne, Ahmed Farahat, Chetan Gupta

机构 * Hitachi America Ltd.(日立美国有限公司)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09081 2025-09-30 cs.SI cs.AI cs.MA 85%

SALM: A Multi-Agent Framework for Language Model-Driven Social Network Simulation

Gaurav Koley

机构 * Boston University(波士顿大学)

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21224 2025-09-26 cs.AI 85%

What Do LLM Agents Do When Left Alone? Evidence of Spontaneous Meta-Cognitive Patterns

Stefan Szeider

机构 * Algorithms and Complexity Group TU Wien(算法与复杂性组维也纳技术大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09790 2025-09-24 cs.SE cs.AI cs.PF 85%

Prompting for Performance: Exploring LLMs for Configuring Software

Helge Spieker, Théo Matricon, Nassim Belmecheri, Jørn Eirik Betten, Gauthier Le Bartz Lyan, Heraldo Borges, Quentin Mazouni, Dennis Gross, Arnaud Gotlieb, Mathieu Acher

机构 * Inria-Simula associate team RIPOST(Inria-Simula联合团队RIPOST) Inria Défi LLM4Code project(Inria LLM4Code项目)

专题命中 长上下文与记忆 :prompting(title);LLM(abstract);large language model(abstract);language model(abstract)

Comments ICTAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12810 2025-09-17 cs.AI 85%

H$^2$R: Hierarchical Hindsight Reflection for Multi-Task LLM Agents

Shicheng Ye, Chao Yu, Kaiqiang Ke, Chengdong Xu, Yinqi Wei

机构 * Sun Yat-sen University(中山大学) The University of Sydney(悉尼大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13231 2025-09-16 cs.AR cs.AI cs.PF 85%

Accelerating LLM Inference via Dynamic KV Cache Placement in Heterogeneous Memory System

Yunhua Fang, Rui Xie, Asad Ul Haq, Linsen Ma, Kaoutar El Maghraoui, Naigang Wang, Meng Wang, Liu Liu, Tong Zhang

机构 * Rensselaer Polytechnic Institute(拉特格斯理工学院) IBM T.J. Watson Research Center(IBM 沃森研究中心)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments IEEE Computer Architecture Letter

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08596 2025-09-11 cs.CL 85%

LLM Ensemble for RAG: Role of Context Length in Zero-Shot Question Answering for BioASQ Challenge

Dima Galat, Diego Molla-Aliod

机构 * University of Technology Sydney (UTS), Australia(悉尼技术大学(UTS))

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments CEUR-WS, CLEF2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03990 2025-09-09 cs.AI 85%

Meta-Policy Reflexion: Reusable Reflective Memory and Rule Admissibility for Resource-Efficient LLM Agent

Chunlong Wu, Ye Luo, Zhibo Qu, Min Wang

机构 * Tongji University(同济大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10491 2025-09-03 cs.CL 85%

Surface Fairness, Deep Bias: A Comparative Study of Bias in Language Models

Aleksandra Sorokovikova, Pavel Chizhov, Iuliia Eremenko, Ivan P. Yamshchikov

机构 * Constructor University(Constructor大学) CAIRO, THWS, Würzburg(CAIRO、THWS、弗赖堡) University of Kassel(卡塞尔大学)

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20231 2025-08-14 cs.CL 85%

MemGuide: Intent-Driven Memory Selection for Goal-Oriented Multi-Session LLM Agents

Yiming Du, Bingbing Wang, Yang He, Bin Liang, Baojun Wang, Zhongyang Li, Lin Gui, Jeff Z. Pan, Ruifeng Xu, Kam-Fai Wong

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏