SafeCommit: Certifying When Memory-Grounded Agents May Safely Act
SafeCommit:验证基于记忆的智能体何时可以安全行动
机构 * Florida International University(佛罗里达国际大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI
AI总结 针对长程智能体过早承诺的问题,提出SafeCommit风险控制层,通过构建合理潜在世界、共形动作证书等实现安全行动决策,还展示了安全-效用权衡。
Comments 14 pages, 6 tables, and 1 figure, target NeurIPS