arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 181 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 181 篇

2601.21881 2026-06-09 physics.comp-ph 版本更新 50%

Acquiring Human-Like Data-Efficient Mechanics Prediction from Deep Reinforcement Learning

从深度强化学习中获取类人数据高效的力学预测能力

Jingruo Peng, Shuze Zhu

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 提出一种强化学习框架,通过跨相似观测的回合切换,仅用少量观测即可获得泛化到广泛参数范围的力学直觉,并在最速降线、大变形弹性板和量子谐振子问题上验证,通过跨参数贝尔曼一致性解释泛化机制。

详情

展开后加载摘要…

URL PDF HTML 收藏