TRAP: Benchmark for Task-completion and Resistance to Active Privacy-extraction
TRAP:任务完成与主动隐私提取抵抗基准
机构 * Dept. of Electrical Engineering, POSTECH(POSTECH电子工程系) ; Grad. School of Artificial Intelligence, POSTECH(POSTECH人工智能研究生院) ; School of Computing, KAIST(韩国科学技术院计算机学院)
专题命中 Agent评测 :agent(abstract);分类 cs.AI
AI总结 提出TRAP基准,评估智能体在文档密集型任务中平衡任务准确性与隐私泄露的能力,发现所有模型均存在非平凡泄露,并证明基于提示的防御无法同时实现高任务成功率和零泄露概率,提出结构化的私有字段隔离方法。