arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4766 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4766 篇

2412.10813 2024-12-17 math.OC 71%

Depth of planning the state of a dynamic discrete system by autocorrelation function

Sergei Masaev

专题命中 记忆与上下文管理 :planning(title)

Journal ref 2020 International Russian Automation Conference (RusAutoCon), Sochi, Russia, 2020, pp. 989-993

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01173 2024-12-03 quant-ph 71%

Programming Variational Quantum Circuits with Quantum-Train Agent

Chen-Yu Liu, Samuel Yen-Chi Chen, Kuan-Cheng Chen, Wei-Jia Huang, Yen-Jui Chang

专题命中 记忆与上下文管理 :agent(title)

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17710 2024-11-28 cs.DC cs.OS 71%

Agent Centric Operating System -- a Comprehensive Review and Outlook for Operating System

Shian Jia, Xinbo Wang, Mingli Song, Gang Chen

专题命中 记忆与上下文管理 :agent(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17136 2024-06-26 cs.RO 71%

Stable Tool-Use with Flexible Musculoskeletal Hands by Learning the Predictive Model of Sensor State Transition

Kento Kawaharazuka, Kei Tsuzuki, Moritaka Onitsuka, Yuki Asano, Kei Okada, Koji Kawasaki, Masayuki Inaba

专题命中 记忆与上下文管理 :tool-use(title)

Comments Accepted at ICRA2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.04014 2024-02-08 quant-ph 71%

Ozawa's Intersubjectivity Theorem as objection to QBism individual agent perspective

Andrei Khrennikov

专题命中 记忆与上下文管理 :agent(title)

Journal ref International Journal of Theoretical Physics 63, 23 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.11975 2024-02-08 q-bio.NC 71%

Toward the biological model of the hippocampus as the successor representation agent

Hyunsu Lee

专题命中 记忆与上下文管理 :agent(title)

Comments 9 pages, 1 figure

Journal ref 2022, Biosystems, 213, 104612

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15060 2023-12-27 physics.soc-ph 71%

Monte Carlo Study of Agent-Based Blume-Capel Model for Political Depolarization

Hung T. Diep, Miron Kaufman, Sanda Kaufman

专题命中 记忆与上下文管理 :agent(title)

Comments 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.08091 2023-09-22 cs.RO cs.SY eess.SY 71%

Joint State and Input Estimation of Agent Based on Recursive Kalman Filter Given Prior Knowledge

Zida Wu, Zhaoliang Zheng, Ankur Mehta

专题命中 记忆与上下文管理 :agent(title)

Journal ref In 2022 International Conference on Robotics and Automation (ICRA) (pp. 1675-1681). IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.05742 2023-03-13 q-bio.PE 71%

JUNE-Germany: An Agent-Based Epidemiology Simulation including Multiple Virus Strains, Vaccinations and Testing Campaigns

Kerem Akdogan, Lucas Heger, Andrew Iskauskas, Friedemann Neuhaus, Matthias Schott

专题命中 记忆与上下文管理 :agent(title)

Comments 10 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.05227 2022-10-12 nlin.AO nlin.PS 71%

Provenance of Lyfe: Chemical Autonomous Agents Surviving through Associative Learning

Stuart Bartlett, David Louapre

专题命中 记忆与上下文管理 :autonomous agent(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.09158 2022-04-27 cond-mat.stat-mech quant-ph 71%

Power law decay of entanglement quantifiers in a single agent to a many body system coupling

Ohad Shpielberg

专题命中 记忆与上下文管理 :agent(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.07663 2019-08-23 physics.flu-dyn 71%

Attenuation of an Ultrasound Contrast Agent Estimated from Transient Solution of Linearized Rayleigh-Plesset Equation

Lang Xia

专题命中 记忆与上下文管理 :agent(title)

Comments 11 pages. arXiv admin note: text overlap with arXiv:1809.10605

详情

展开后加载摘要…

URL PDF HTML 收藏
1707.07338 2017-07-25 q-fin.CP 71%

Agent Inspired Trading Using Recurrent Reinforcement Learning and LSTM Neural Networks

David W. Lu

专题命中 记忆与上下文管理 :agent(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
1210.8242 2012-11-01 cs.DB cs.DC 71%

Pipelined Workflow in Hybrid MPI/Pthread runtime for External Memory Graph Construction

Sandeep Gupta

专题命中 记忆与上下文管理 :workflow(title)

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
physics/0701148 2009-12-01 physics.soc-ph 71%

The critical properties of the agent-based model with environmental-economic interactions

Z. Kuscsik, D. Horvath, M. Gmitra

专题命中 记忆与上下文管理 :agent(title)

Comments 12 pages, 6 figures, published in Physica A

Journal ref Physica A, 2007, Vol 379/1 pp 199-206

详情

展开后加载摘要…

URL PDF HTML 收藏
physics/0510257 2009-12-01 physics.soc-ph cond-mat.stat-mech q-fin.TR 71%

News and price returns from threshold behaviour and vice-versa: exact solution of a simple agent-based market model

Damien Challet

专题命中 记忆与上下文管理 :agent(title)

Comments 4 pages, 3 figures. This is quite possibly the final version. To appear in J. Phys A

详情

展开后加载摘要…

URL PDF HTML 收藏
math/0612675 2009-12-01 math.DS 71%

State Agreement in Finite Time

Feng Xiao, Long Wang

专题命中 记忆与上下文管理 :agent(abstract,comments);multi-agent(abstract,comments)

Comments Finite-time state agreement problems for continuous-time multi-agent systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.02513 2022-06-22 cs.MA cs.AI cs.LG 71%

Multi Type Mean Field Reinforcement Learning

Sriram Ganapathi Subramanian, Pascal Poupart, Matthew E. Taylor, Nidhi Hegde

专题命中 记忆与上下文管理 :agent(abstract,comments);分类 cs.AI、cs.LG;autonomous agent(comments);multi-agent(comments)

Comments The paper appears in the proceedings of International Conference on Autonomous Agents and Multi-Agent Systems (AAMAS) 2020. Revised version has some typos corrected

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21156 2026-08-24 cs.IR cs.AI cs.ET 新提交 70%

Graph Engineering in the Era of LLM Agents: From Individual Intelligence to System Intelligence

大语言模型智能体时代的图工程:从个体智能到系统智能

Yuyuan Feng, Zhishang Xiang, Chaobin Yang, Qichao Ma, Zerui Chen, Yujing Zhang, Ke Huang, Chuanjie Wu, Zhaoxu Liu, Yili Wang, Xin He, Jiapu Wang, Zijin Hong, Hao Chen, Yuanchen Bei, Kun Wang, Shengyuan Chen, Ningyu Zhang, Enyan Dai, Linhao Luo, Qingyi Pan, Qi Wang, Wenqi Fan, Guangjing Wang, Na Zou, Yangqiu Song, Xin Wang, Zechao Li, Xia Hu, Qing Li, Xiao Huang, Zhihong Zhang, Jinsong Su, Qinggang Zhang, Yi Chang

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 该研究针对LLM智能体复杂任务的个体智能局限,提出图工程范式,通过构建动态图结构组织协调异构智能体,为系统智能提供统一基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07107 2026-08-24 cs.AI 版本更新 70%

MemWM: Memory-Augmented Text-Based World Model

MemWM:记忆增强的基于文本的世界模型

Yujun Wang, Tao Zhang, Jinhe Bi, Aniri, Wenxuan Ye, Boliang Liu, Sikuan Yan, Shuning Wang, Xuebing Zhou, Sören Pirk, Hinrich Schütze, Yunpu Ma

机构 * LMU Munich(慕尼黑大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Huawei Heisenberg Research Center(华为海森堡研究中心) Zhejiang University(浙江大学) Technical University of Munich (TUM)(慕尼黑工业大学) TU Berlin(柏林工业大学) Kiel University(基尔大学)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 该研究提出记忆增强的基于文本的世界模型MemWM,通过引入世界记忆解决世界模型的系统性预测错误,在ALFWorld等基准上提升智能体规划成功率与效率。

Comments Accepted to EMNLP 2026 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18884 2026-08-20 cs.AI 新提交 70%

Training-Free Inference-Time Self-Reflection and Cost-Bounded Early Stopping for Large Language Models

面向大语言模型的无训练推理时自我反思与成本受限早停机制

Wei Yu, Suxing Liu, Minjie Yu, Jiahao Wang, Zhijian Zheng, Haocheng Deng, Bing Li

机构 * School of Digital Arts, Jiangxi Arts & Ceramics Technology Institute(江西工艺美术职业技术学院数字艺术学院) School of Computing, Universiti Sains Malaysia(马来西亚理科大学计算机学院)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出无训练的推理时协议EvoResearcher,通过成本受限的自我反思实现大语言模型早停,在多个推理基准上验证其成本受限自我验证的价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16775 2026-08-18 cs.CR cs.AI 新提交 70%

Topological Attribution Distance (TAD): Revealing Segment-Level RAG Influence on LLM Output Geometry for Incident Log Analysis

拓扑归因距离(TAD):揭示用于事件日志分析的RAG片段级影响对LLM输出几何的作用

Reza Fayyazi, Michael Zuzak, Shanchieh Jay Yang

专题命中 记忆与上下文管理 :autonomous agent(abstract);agentic(abstract);分类 cs.AI

AI总结 该研究针对LLM在网络安全应用中证据归因追踪的缺口,提出拓扑归因距离(TAD)方法,可自适应识别对LLM输出关键的事件日志,为证据验证提供可解释追踪。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04268 2026-08-18 cs.LG physics.ao-ph 版本更新 70%

Replacing Tunable Parameters in Weather and Climate Models with State-Dependent Functions using Reinforcement Learning

用强化学习替代天气和气候模型中的可调参数以状态依赖函数

Pritthijit Nath, Sebastian Schemm, Henry Moss, Peter Haynes, Emily Shuckburgh, Mark J. Webb

机构 * Department of Applied Mathematics and Theoretical Physics, University of Cambridge(剑桥大学应用数学与理论物理系) School of Mathematical Sciences, Lancaster University(兰卡斯特大学数学科学学院) Department of Computer Science and Technology, University of Cambridge(剑桥大学计算机科学与技术系) Met Office Hadley Centre(英国气象局哈德利中心)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文通过强化学习在线学习天气和气候模型中的参数方案,展示了在简化测试环境中,强化学习在气候偏差校正、辐射-对流平衡和纬向平均能量平衡模型中的应用,证明了强化学习在改进模型性能方面的有效性。

Comments 79 pages, 24 figures

Journal ref Journal of Advances in Modeling Earth Systems (JAMES) 18 (8), e2026MS005745

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13940 2026-08-17 cs.AI 新提交 70%

AI Research Preference Models

AI研究偏好模型

Thomas Simon Foster, Bassel Al Omari, Tingchen Fu, Thomas Mann, Carl Domond, Lucia Cipolina-Kun, Bhavul Gauri, Muna Aghamelu, Alexander D. Goldie, Eryk Helenowski, Jean-Christophe Gagnon-Audet, Alberto Pepe, Saba Nazir, Daniel Izcovich, Noam Levi, Rishi Hazra, Karen Hambardzumyan, Nicolas Baldwin, Xian Li, Martin Josifoski, Paris Giampouras, Masoud Jalili Sabet, Anya Sims, Hela Momand, Tatiana Shavrina, Despoina Magka, Jason Weston, Yulin Wang, Anirudh Goyal, João Henriques, Yoram Bachrach, Emily McMilin, Jakob Nicolaus Foerster

机构 * FAIR at Meta University of Oxford(牛津大学) University College London(伦敦大学学院)

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 该研究针对AI研究智能体的候选方案评估成本过高问题,提出AI研究偏好模型,将其集成到AIRA-dojo智能体后提升了基准任务性能,且达到目标性能的时间更短、预算更少。

Comments 34 pages, 17 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13420 2026-08-14 cs.AI 新提交 70%

Enhancing Virtual Agents through SLMs and Edge-Computing: An Exploratory Evaluation of Think and Memory Processes

通过小型语言模型(SLMs)与边缘计算增强虚拟智能体:对思考与记忆过程的探索性评估

Aimilios Hadjiliasi, Louis Nisiotis

机构 * University of Central Lancashire(中央兰开夏大学)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文探索利用SLMs与边缘计算支持CEAA的“思考”“记忆”组件,在NVIDIA Jetson Orin NX上用Qwen2.5模型开发边缘虚拟智能体网关,经模拟实验验证其可高效运行部分CEAA过程,助力沉浸式虚拟世界具身智能体开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14401 2026-08-13 cs.AI cs.DB 版本更新 70%

Credo: Declarative Control of LLM Pipelines via Beliefs and Policies

Credo:通过信念和策略实现LLM流水线的声明式控制

Duo Lu, Andrew Crotty, Uğur Çetintemel

机构 * Brown University(布朗大学) Northwestern University(西北大学)

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出Credo,通过声明式策略和信念管理LLM流水线的决策,实现可适应、可审计和可组合的执行。

Comments VLDB 2026 (Demo)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10502 2026-08-12 cs.AI 新提交 70%

From Faulty Memories to Corrected Actions: Dependency-Guided Rollback Repair for Memory-Augmented Agents

从错误记忆到修正行动:记忆增强智能体的依赖引导回滚修复

Caili Yu, Yiqi Wang, Jiaqi Zhang, Yiqun Duan, Mingkai Zheng, Zhangkai Wu, Kaize Shi, Taotao Cai

专题命中 记忆与上下文管理 :tool use(abstract);tool-use(abstract);分类 cs.AI

AI总结 该研究针对记忆增强智能体的错误记忆问题,提出依赖引导回滚修复方法,在150案例受控基准和50案例改编测试中,均优于对比方法,实现了更优的记忆恢复效果与成本权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09948 2026-08-12 physics.ao-ph cs.LG 新提交 70%

An adaptive and evolvable deep reinforcement learning framework for weather prediction

一种用于天气预报的自适应可演化深度强化学习框架

Qiang Wu, Han Li, Jianping Huang

专题命中 记忆与上下文管理 :agent(abstract,abstract_cn);分类 cs.LG

AI总结 该研究提出FTAE-Weather框架,通过深度强化学习协调预训练气象模型,以极低额外参数实现预报误差显著降低,优于传统集合基线,将模型多样性转化为科学优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08795 2026-08-11 cs.CR cs.CL 新提交 70%

Toward Metacognitive One-Shot Indirect Prompt Injection: Strategy Abstraction Via Outcome-Conditioned Reflection

迈向元认知少样本间接提示注入:基于结果条件反射的策略抽象

Sihan Hou, Xinmeng Hou, Zhijun Zhang, Zehao Wang, Xuhong Ren, Sibo Qin, Kuntharrgyal Khysru, Qing Guo

专题命中 记忆与上下文管理 :agent(abstract,abstract_cn);分类 cs.CL

AI总结 本文提出SAVOR方法,将攻击适配转向离线策略蒸馏,仅需一次目标智能体查询,在多基准与模型上攻击成功率显著优于现有方法,且记忆可跨防御迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11953 2026-08-10 cs.LG 版本更新 70%

When Does Reward Teach State? A Hidden-Automaton Instrument and a Group-Language Warning Signal

奖励何时能引导对状态的理解?一种隐藏自动机工具与群语言边界

James E. Allchin

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.LG

AI总结 研究强化学习中高奖励与潜在状态理解的关系,通过将任务表示为隐藏自动机,利用三个可控轴(优化器强度、任务结构、观察信息量)来分别测量奖励成功和潜在状态学习,区分感知差距和规划差距,得出高奖励非任务理解证据且智能体恢复潜在状态可预测的结论。

Comments 17 pages, 3 figures, 6 tables (9-page main text). Ancillary file hidden-automata-rl-code.zip contains reproduction code and the complete per-run data behind every table and figure. v3: author name corrected, title revised, text rewritten for clarity, new robustness checks (nonlinear and off-policy probes) added; results and conclusions unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏