Capable but Careless: Do Computer-Use Agents Follow Contextual Integrity?
有能力但粗心:计算机使用代理是否遵循情境完整性?
机构 * Ubiquitous Knowledge Processing Lab (UKP Lab), Department of Computer Science, TU Darmstadt(达姆施塔特工业大学计算机科学系泛在知识处理实验室(UKP Lab)) ; National Research Center for Applied Cybersecurity ATHENE(国家应用网络安全研究中心ATHENE)
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI
AI总结 提出AgentCIBench基准,测试计算机使用代理在跨应用操作时是否泄露不适当信息,发现15个前沿代理中11个在超过50%场景中泄露信息,平均泄露率67.9%。