The Oversight Game: Learning to Cooperatively Balance an AI Agent's Safety and Autonomy
视角游戏:学习协作平衡AI代理的安全性与自主性
机构 * Graduate School of Business(商学院) ; Stanford University(斯坦福大学)
专题命中 工具调用 :agent(title,abstract);AI agent(title);tool-use(abstract);agentic(abstract)
AI总结 本文提出了一种视角游戏框架,通过马尔可夫游戏模型平衡AI代理的安全性与自主性,减少开放环境中的安全违规。