AgentMemBench: A Systematic Benchmark for Evaluating Long-Term Memory Management Strategies in Conversational AI Agents
AgentMemBench:用于评估对话AI智能体长期记忆管理策略的系统基准
机构 * Sofrecom(索弗雷科姆)
专题命中 视觉定位与Grounding :grounding(abstract);分类 cs.AI
AI总结 该研究构建了AgentMemBench基准,评估五种记忆策略及两款现有系统,发现外部键值存储(EKV)在长程对话记忆任务中表现最优,但存在内存占用成本,同时公开了全部可复现资源。
Comments 22 pages, 3 figures submitted on Neural Computing and Applications