arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-16 至 2026-02-16 共收录 4 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4 篇

2602.12375 2026-02-16 cs.LG cs.AI 62%

Value Bonuses using Ensemble Errors for Exploration in Reinforcement Learning

利用集成误差的值奖金用于强化学习中的探索

Abdul Wahab, Raksha Kumaraswamy, Martha White

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 VBE通过集成误差设计价值奖金,实现强化学习中的首次访问乐观性和深度探索,优于现有方法。

Comments Accepted at Reinforcement Learning Conference (RLC) 2025

Journal ref Reinforcement Learning Journal, vol. 6, 2025, pp. 1894-1915

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12636 2026-02-16 cs.LG cs.RO 57%

Dual-Granularity Contrastive Reward via Generated Episodic Guidance for Efficient Embodied RL

双粒度对比奖励 via 生成 episodic 引导 为高效 embodied RL

Xin Liu, Yixuan Li, Yuhui Chen, Yuxing Qin, Haoran Li, Dongbin Zhao

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本文提出DEG方法,通过生成episodic引导实现高效具身RL,无需人工标注,提升样本效率和任务完成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16348 2026-02-16 cs.CL 57%

Embodied Agents Meet Personalization: Investigating Challenges and Solutions Through the Lens of Memory Utilization

具身智能体与个性化:通过记忆利用的视角探讨挑战与解决方案

Taeyoon Kwon, Dongwook Choi, Hyojun Kim, Sunghwan Kim, Seungjun Moon, Beong-woo Kwak, Kuan-Hao Huang, Jinyoung Yeo

机构 * Department of Artificial Intelligence, Yonsei University(人工智能系,延世大学) Department of Computer Science and Engineering, Texas A&M University(计算机科学与工程系,德克萨斯大学)

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.CL

AI总结 本文提出MEMENTO框架,通过分析记忆利用中的挑战,设计了基于层次知识图谱的用户档案记忆模块,提升智能体在个性化任务中的表现。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03704 2026-02-16 cs.LG 57%

Memory Injection Attacks on LLM Agents via Query-Only Interaction

通过仅查询交互对LLM代理进行内存注入攻击

Shen Dong, Shaochen Xu, Pengfei He, Yige Li, Jiliang Tang, Tianming Liu, Hui Liu, Zhen Xiang

机构 * Michigan State University(密歇根州立大学) University of Georgia(佐治亚大学) Singapore Management University(新加坡管理大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本文提出MINJA攻击,通过仅查询交互向LLM代理注入恶意记录,破坏其内存安全,揭示了代理内存安全的潜在风险。

Comments Code released

详情

展开后加载摘要…

URL PDF HTML 收藏