arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 4797 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 4797 篇

2512.16962 2025-12-22 cs.CR cs.AI cs.LG 86%

MemoryGraft: Persistent Compromise of LLM Agents via Poisoned Experience Retrieval

MemoryGraft: 通过中毒经验检索持续破坏LLM代理

Saksham Sahai Srivastava, Haoyu He

机构 * School of Computing University of Georgia(计算机学院 佐治亚大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 MemoryGraft 通过在LLM代理的长期记忆中植入恶意经验,实现对代理行为的持续破坏。

Comments 14 pages, 1 figure, includes appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13713 2025-12-17 cs.AI cs.LG cs.MA 86%

LoopBench: Discovering Emergent Symmetry Breaking Strategies with LLM Swarms

LoopBench: 通过LLM群体发现涌现的对称性打破策略

Ali Parsaee, Yashar Talebirad, Csongor Szepesvári, Vishwajeet Ohal, Eden Redman

机构 * University of Alberta(阿尔伯塔大学) Network for Applied Technology(应用技术网络)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 LoopBench通过LLM群体研究分布式对称性打破策略,揭示先进模型在解决死锁问题上的能力。

Comments 11 pages, 3 figures, submitted to ANTS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11282 2025-12-15 cs.CL cs.AI 86%

CIP: A Plug-and-Play Causal Prompting Framework for Mitigating Hallucinations under Long-Context Noise

CIP: 一种用于在长上下文噪声下缓解幻觉的即插即用因果提示框架

Qingsen Ma, Dianyun Wang, Ran Jing, Yujun Sun, Zhenbo Xu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Northwestern University(西北大学)

专题命中 长上下文与记忆 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 CIP通过因果推理框架提升大语言模型的可解释性、稳定性和效率,有效缓解长上下文噪声下的幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04307 2025-12-05 cs.LG cs.AI 86%

Evaluating Long-Context Reasoning in LLM-Based WebAgents

评估基于大语言模型的WebAgent的长上下文推理能力

Andy Chung, Yichi Zhang, Kaixiang Lin, Aditya Rawal, Qiaozi Gao, Joyce Chai

机构 * University of Michigan(密歇根大学) Amazon(亚马逊)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文评估了基于大语言模型的WebAgent在长上下文场景中的推理能力,发现随着上下文长度增加,性能显著下降,提出隐式RAG方法以改进任务执行。

Comments Accepted NeurIPS 25 LAW Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02228 2025-12-03 cs.AI cs.LG 86%

STRIDE: A Systematic Framework for Selecting AI Modalities -- Agentic AI, AI Assistants, or LLM Calls

STRIDE:一种选择AI模态的系统框架——代理AI、AI助手或LLM调用

Shubhi Asthana, Bing Zhang, Chad DeLuca, Ruchi Mahindru, Hima Patel

机构 * IBM Research – Almaden(IBM阿尔马登研究实验室) IBM Research – Yorktown(IBM约克镇研究实验室) IBM Research – India(IBM印度研究实验室)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 STRIDE提供了一种系统框架,帮助选择AI模态,通过评估任务动态性决定是否使用自主代理,提升效率并降低成本。

Comments 10 pages, 4 Figures, 5 Tables Paper presented at NeurIPS 2025 LAW workshop: Bridging Language, Agent, and World Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21204 2025-10-31 cs.AI cs.CL 86%

Fuzzy, Symbolic, and Contextual: Enhancing LLM Instruction via Cognitive Scaffolding

Vanessa Figueiredo

机构 * Department of Computer Science University of Regina(计算机科学系 皇家大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17021 2025-10-21 cs.LG cs.CL 86%

Forgetting to Forget: Attention Sink as A Gateway for Backdooring LLM Unlearning

Bingqi Shang, Yiwei Chen, Yihua Zhang, Bingquan Shen, Sijia Liu

机构 * Michigan State University(密歇根州立大学) National University of Singapore(新加坡国立大学) IBM Research(IBM研究院)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11967 2025-10-15 cs.CL cs.LG 86%

Scaling Long-Horizon LLM Agent via Context-Folding

Weiwei Sun, Miao Lu, Zhan Ling, Kang Liu, Xuesong Yao, Yiming Yang, Jiecao Chen

机构 * Carnegie Mellon University(卡内基梅隆大学) Stanford University(斯坦福大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08510 2025-10-10 cs.CV cs.AI cs.CL 86%

To Sink or Not to Sink: Visual Information Pathways in Large Vision-Language Models

Jiayun Luo, Wan-Cyuan Fan, Lyuyang Wang, Xiangteng He, Tanzila Rahman, Purang Abolmaesumi, Leonid Sigal

机构 * University of British Columbia(不列颠哥伦比亚大学) Vector Institute for AI(人工智能矢量研究所)

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Preprint. Project page: https://davidhalladay.github.io/diysink_demo

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06270 2025-10-09 cs.LG cs.AI 86%

MCCE: A Framework for Multi-LLM Collaborative Co-Evolution

Nian Ran, Zhongzheng Li, Yue Wang, Qingsong Ran, Xiaoyuan Zhang, Shikun Feng, Richard Allmendinger, Xiaoguang Zhao

机构 * Zhongguancun Academy(中关村学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) University of Manchester(曼彻斯特大学) Tongji University(同济大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05520 2025-10-08 cs.CL cs.AI 86%

CAM: A Constructivist View of Agentic Memory for LLM-Based Reading Comprehension

Rui Li, Zeyu Zhang, Xiaohe Bo, Zihang Tian, Xu Chen, Quanyu Dai, Zhenhua Dong, Ruiming Tang

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04851 2025-10-07 cs.AI cs.LG cs.MA 86%

LEGOMem: Modular Procedural Memory for Multi-agent LLM Systems for Workflow Automation

Dongge Han, Camille Couturier, Daniel Madrigal Diaz, Xuchao Zhang, Victor Rühle, Saravan Rajmohan

机构 * Microsoft(微软)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24160 2025-09-30 cs.RO cs.AI cs.LG 86%

Memory Transfer Planning: LLM-driven Context-Aware Code Adaptation for Robot Manipulation

Tomoyuki Kagaya, Subramanian Lakshmi, Yuxuan Lou, Thong Jing Yuan, Jayashree Karlekar, Sugiri Pranata, Natsuki Murakami, Akira Kinose, Yang You

机构 * Panasonic Connect Co., Ltd.(松下电器(控股)公司) Panasonic R&D Center(松下研发中心) National University of Singapore(新加坡国立大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23767 2025-09-30 cs.CL cs.AI 86%

From Personal to Collective: On the Role of Local and Global Memory in LLM Personalization

Zehong Wang, Junlin Wu, ZHaoxuan Tan, Bolian Li, Xianrui Zhong, Zheli Liu, Qingkai Zeng

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20600 2025-09-26 cs.NI cs.AI cs.LG 86%

An LLM-based Agentic Framework for Accessible Network Control

Samuel Lin, Jiawei Zhou, Minlan Yu

机构 * Meta Stony Brook University(石溪大学) Harvard University(哈佛大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 11 pages, 6 figures

Journal ref AI Crossroads: Systems, Energy, and Applications Workshop of ACM SIGMETRICS 2025 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06221 2025-09-09 eess.AS cs.AI cs.CL cs.HC 86%

Beamforming-LLM: What, Where and When Did I Miss?

Vishal Choudhari

机构 * Columbia University(哥伦比亚大学) Institute for Clarity in Documentation(清晰文档研究所) Inria Paris-Rocquencourt(Inria巴黎- Rocquencourt研究所) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒姆研究实验室)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17642 2025-09-04 cs.CL cs.AI 86%

Banishing LLM Hallucinations Requires Rethinking Generalization

Johnny Li, Saksham Consul, Eda Zhou, James Wong, Naila Farooqui, Yuxin Ye, Nithyashree Manohar, Zhuxiaona Wei, Tian Wu, Ben Echols, Sharon Zhou, Gregory Diamos

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments I want to revisit some of the experiments in this paper, specifically figure 5

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00510 2025-09-03 cs.AI cs.CL 86%

LLM-Assisted Iterative Evolution with Swarm Intelligence Toward SuperBrain

Li Weigang, Pedro Carvalho Brom, Lucas Ramson Siefert

机构 * TransLab, Computer Science Department University of Brasilia(TransLab,计算机科学系巴西大学) Math Department Federal Institute of Brasilia(数学系巴西联邦理工学院)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 24 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.21231 2025-09-01 cs.DC cs.AI cs.LG 86%

ByteScale: Efficient Scaling of LLM Training with a 2048K Context Length on More Than 12,000 GPUs

Hao Ge, Junda Feng, Qi Huang, Fangcheng Fu, Xiaonan Nie, Lei Zuo, Haibin Lin, Bin Cui, Xin Liu

机构 * Peking University(北京大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 12 pages, 21 figures

Journal ref SIGCOMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11742 2025-08-26 cs.CL cs.AI 86%

CRABS: A syntactic-semantic pincer strategy for bounding LLM interpretation of Python notebooks

Meng Li, Timothy M. McPhillips, Dingmin Wang, Shin-Rong Tsai, Bertram Ludäscher

机构 * School of Information Sciences, University of Illinois Urbana-Champaign(信息科学学院,伊利诺伊大学厄巴纳-香槟分校) Department of Computer Science, University of Oxford(计算机科学系,牛津大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08525 2025-08-26 cs.AI cs.CL 86%

Task Memory Engine (TME): Enhancing State Awareness for Multi-Step LLM Agent Tasks

Ye Ye

机构 * Ye Ye(独立研究者)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 5 figures. Preprint prepared for future submission. Includes implementation and token-efficiency analysis. Code at https://github.com/biubiutomato/TME-Agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04903 2025-08-13 cs.CL cs.AI cs.MA 86%

RCR-Router: Efficient Role-Aware Context Routing for Multi-Agent LLM Systems with Structured Memory

Jun Liu, Zhenglun Kong, Changdi Yang, Fan Yang, Tianqi Li, Peiyan Dong, Joannah Nanjekye, Hao Tang, Geng Yuan, Wei Niu, Wenbin Zhang, Pu Zhao, Xue Lin, Dong Huang, Yanzhi Wang

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00305 2025-08-04 cs.CL cs.LG cs.PF 86%

Systematic Evaluation of Optimization Techniques for Long-Context Language Models

Ammar Ahmed, Sheng Di, Franck Cappello, Zirui Liu, Jingoo Han, Ali Anwar

机构 * University of Minnesota(明尼苏达大学) Argonne National Laboratory(阿贡国家实验室) Samsung Semiconductor Inc.(三星半导体公司)

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22925 2025-08-01 cs.CL cs.AI 86%

Hierarchical Memory for High-Efficiency Long-Term Reasoning in LLM Agents

Haoran Sun, Shaoning Zeng

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19353 2025-07-28 cs.CL cs.AI 86%

Smooth Reading: Bridging the Gap of Recurrent LLM to Self-Attention LLM on Long-Context Tasks

Kai Liu, Zhan Su, Peijie Dong, Fengran Mo, Jianfei Gao, ShaoTing Zhang, Kai Chen

机构 * Shanghai AI Laboratory(上海人工智能实验室) Tongji University(同济大学) University of Montreal(蒙特利尔大学) HKUST(GZ)(香港科技大学(广州))

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05330 2025-07-09 cs.CL cs.AI 86%

MindFlow: Revolutionizing E-commerce Customer Support with Multimodal LLM Agents

Ming Gong, Xucheng Huang, Chenghan Yang, Xianhan Peng, Haoxin Wang, Yang Liu, Ling Jiang

机构 * Xiaoduo AI(小多AI) University of Dayton(代顿大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04625 2025-07-08 cs.CL cs.AI 86%

Knowledge-Aware Self-Correction in Language Models via Structured Memory Graphs

Swayamjit Saha

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03042 2025-07-08 cs.CL cs.AI 86%

Dynamic Long Short-Term Memory Based Memory Storage For Long Horizon LLM Interaction

Yuyang Lou, Charles Li

机构 * University of Washington(华盛顿大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 7 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14606 2025-06-18 cs.CL cs.AR cs.LG cs.PL cs.SE 86%

Guaranteed Guess: A Language Modeling Approach for CISC-to-RISC Transpilation with Testing Guarantees

Ahmed Heakl, Sarim Hashmi, Chaimaa Abi, Celine Lee, Abdulrahman Mahmoud

机构 * MBZUAI(人工智能研究所) Cornell University(康奈尔大学)

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments Project page: https://ahmedheakl.github.io/Guaranteed-Guess/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13879 2025-05-27 cs.CL cs.AI cs.CR 86%

Crabs: Consuming Resource via Auto-generation for LLM-DoS Attack under Black-box Settings

Yuanhe Zhang, Zhenhong Zhou, Wei Zhang, Xinyue Wang, Xiaojun Jia, Yang Liu, Sen Su

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 22 pages, 8 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏