arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-09-04 至 2025-09-04 共收录 5 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 5 篇

2505.13188 2025-09-04 cs.LG cs.AI stat.ML 84%

When a Reinforcement Learning Agent Encounters Unknown Unknowns

Juntian Zhu, Miguel de Carvalho, Zhouwang Yang, Fengxiang He

机构 * University of Edinburgh(爱丁堡大学) University of Science and Technology of China(中国科学技术大学)

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21314 2025-09-04 cs.LG 79%

Convergence of regularized agent-state-based Q-learning in POMDPs

Amit Sinha, Matthieu Geist, Aditya Mahajan

机构 * Department of Electrical and Computer Engineering, McGill University(麦吉尔大学电气与计算机工程系) Earth Species Project(地球物种计划)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.LG

Comments Accepted in CDC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01086 2025-09-04 cs.LG cs.SY eess.SY 57%

MPCritic: A plug-and-play MPC architecture for reinforcement learning

Nathan P. Lawrence, Thomas Banker, Ali Mesbah

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments CDC 2025 final version

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02424 2025-09-04 cs.CV 50%

Faster and Better: Reinforced Collaborative Distillation and Self-Learning for Infrared-Visible Image Fusion

Yuhao Wang, Lingjuan Miao, Zhiqiang Zhou, Yajun Qiao, Lei Zhang

机构 * Yuhao Wang, Lingjuan Miao, Zhiqiang Zhou, Yajun Qiao, Lei Zhang(作者)

专题命中 记忆与上下文管理 :agent(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.14142 2025-09-04 math.OC 50%

ADMM-Tracking Gradient for Distributed Optimization over Asynchronous and Unreliable Networks

Guido Carnevale, Nicola Bastianello, Giuseppe Notarstefano, Ruggero Carli

专题命中 记忆与上下文管理 :agent(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏