Agent-ToM: Learning to Monitor Autonomous LLM Agents via Theory-of-Mind Reasoning
Agent-ToM: 通过心智理论推理学习监控自主LLM智能体
机构 * Cisco Outshift(思科Outshift)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 针对自主LLM智能体的隐蔽恶意行为监控难题,提出基于心智理论推理的Agent-ToM框架,通过信念推断、意图假设与验证实现结构化轨迹分析,在监控基准上取得优于集成方法的性能。
Comments 23 pages, 9 figures