arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-23 至 2025-12-23 共收录 9 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 9 篇

2512.18746 2025-12-23 cs.CL cs.MA 83%

MemEvolve: Meta-Evolution of Agent Memory Systems

MemEvolve: 代理记忆系统的元进化

Guibin Zhang, Haotian Ren, Chong Zhan, Zhenhong Zhou, Junhao Wang, He Zhu, Wangchunshu Zhou, Shuicheng Yan

机构 * OPPO AI Agent Team, LV-NUS lab(OPPO 人工智能代理团队,LV-NUS 实验室)

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(abstract);分类 cs.CL

AI总结 MemEvolve通过元进化框架联合进化代理的经验知识和记忆架构,实现代理在环境交互中的高效学习与泛化能力提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22732 2025-12-23 cs.LG cs.AI cs.CL cs.IR cs.MA cs.RO 82%

WebATLAS: An LLM Agent with Experience-Driven Memory and Action Simulation

WebATLAS: 一种基于经验驱动记忆和动作模拟的LLM代理

Jiali Cheng, Anjishnu Kumar, Roshan Lal, Rishi Rajasekaran, Hani Ramezani, Omar Zia Khan, Oleg Rokhlenko, Sunny Chiu-Webster, Gang Hua, Hadi Amiri

机构 * University of Massachusetts Lowell(马萨诸塞大学洛威尔分校) Amazon Alexa AI(亚马逊Alexa人工智能)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 WebATLAS通过经验驱动的记忆和前瞻动作模拟,实现无需微调的自主网页导航,成功率达63%。

Comments 9 pages, NeurIPS 2025 Workshop on Language Agents and World Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18892 2025-12-23 econ.TH cs.AI cs.LG 81%

Structural Reinforcement Learning for Heterogeneous Agent Macroeconomics

异质主体宏观经济学的结构强化学习

Yucheng Yang, Chiyuan Wang, Andreas Schaab, Benjamin Moll

机构 * University of Zurich and SFI(苏黎世大学和SFI) Peking University, School of Computer Science and BIGAI(北京大学计算机学院和BIGAI) UC Berkeley(加州大学伯克利分校) London School of Economics(伦敦经济学院)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出结构强化学习方法,用于高效求解异质主体宏观经济学模型,克服传统方法限制,实现快速全局求解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10218 2025-12-23 cs.SE 79%

Does SWE-Bench-Verified Test Agent Ability or Model Memory?

SWE-Bench-Verified测试的是代理能力还是模型记忆?

Thanosan Prathifkumar, Noble Saji Mathews, Meiyappan Nagappan

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.SE

AI总结 研究发现SWE-Bench-Verified基准可能反映模型训练记忆而非真实问题解决能力,建议转向更注重污染控制的新数据集。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08139 2025-12-23 cs.IT cs.LG math.IT 79%

SCA-LLM: Spectral-Attentive LLM-Based Wireless World Modeling for Agentic Communications

SCA-LLM:基于频谱-注意力的LLM无线世界建模用于智能通信

Ke He, Le He, Lisheng Fan, Xianfu Lei, Thang X. Vu, George K. Karagiannidis, Symeon Chatzinotas

机构 * Interdisciplinary Centre for Security, Reliability and Trust (SnT), University of Luxembourg(安全、可靠性与信任跨学科研究中心(SnT),卢森堡大学) School of Computer Science of Guangzhou University(广州大学计算机科学学院) School of Information Science and Technology, Institute of Mobile Communications, Southwest Jiaotong University(信息科学与技术学院,移动通信研究所,西南交通大学) Department of Electrical and Computer Engineering, Aristotle University of Thessaloniki(电气与计算机工程系,塞萨洛尼基阿瑞斯托大学) Cyber Security Systems and Applied AI Research Center, Lebanese American University (LAU)(网络安全与应用人工智能研究中心,黎巴嫩美国大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.LG

AI总结 SCA-LLM通过频谱-注意力适配器将信道状态信息与LLM结合,实现无线世界建模,提升预测性能和零样本泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19154 2025-12-23 cs.LG cs.AI 62%

Beyond Sliding Windows: Learning to Manage Memory in Non-Markovian Environments

超越滑动窗口:在非马尔可夫环境中学习管理内存

Geraud Nangue Tasse, Matthew Riemer, Benjamin Rosman, Tim Klinger

机构 * CSAM School, University of the Witwatersrand(瓦茨堡大学CSAM学院) IBM Research(IBM研究院) Mila, Université de Montréal(蒙特利尔大学Mila)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出自适应堆叠元算法,通过维护较小的记忆堆栈,在非马尔可夫环境中减少计算和内存需求,同时有效管理记忆以避免过度删除重要经验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18940 2025-12-23 cs.CL cs.SE 62%

FASTRIC: Prompt Specification Language for Verifiable LLM Interactions

FASTRIC:用于可验证大语言模型交互的提示规范语言

Wen-Long Jin

机构 * Department of Civil and Environmental Engineering(土木与环境工程系) California Institute for Telecommunications and Information Technology(电信与信息科技学院) Institute of Transportation Studies(交通研究学院) University of California, Irvine, CA 92697-3600(加州大学伊维德分校)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL、cs.SE

AI总结 FASTRIC通过显式化有限状态机构建可验证的大语言模型交互协议,揭示模型特定的规范正式程度范围,实现交互设计的系统化工程。

Comments 13 pages, 3 figures. Supplementary materials at https://doi.org/10.17605/OSF.IO/PV6R3

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19537 2025-12-23 cs.CL 57%

Event Extraction in Large Language Model

大规模语言模型中的事件提取

Bobo Li, Xudong Han, Jiang Liu, Yuzhe Ding, Liqiang Jing, Zhaoqi Zhang, Jinheng Li, Xinya Du, Fei Li, Meishan Zhang, Min Zhang, Aixin Sun, Philip S. Yu, Hao Fei

机构 * National University of Singapore(新加坡国立大学) University of Sussex(苏塞克斯大学) Wuhan University(武汉大学) University of Texas at Dallas(德克萨斯大学达拉斯分校) Nanyang Technological University(南洋理工大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) University of Illinois at Chicago(伊利诺伊大学香槟分校)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

AI总结 本文探讨了大规模语言模型中事件提取的系统组件,提出通过事件方案、结构和存储提升事件处理的可靠性与智能体准备性。

Comments 38 pages, 9 Figures, 5 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18109 2025-12-23 eess.SY cs.SY 50%

Timing-Aware Two-Player Stochastic Games with Self-Triggered Control

具有自触发控制的时序感知双人随机游戏

Yunian Pan, Quanyan Zhu

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出了一种基于自触发控制的双人随机游戏框架,解决了纳什和斯塔克尔伯格时序承诺问题,并通过动态规划分解实现了可解的策略优化。

详情

展开后加载摘要…

URL PDF HTML 收藏