TrojanStego: Your Language Model Can Secretly Be A Steganographic Privacy Leaking Agent
TrojanStego: 你的语言模型可能 secretly 成为一个隐写术隐私泄露代理
机构 * University of Göttingen(哥廷根大学) ; LKA NRW(北莱茵-威斯特法伦州检察署) ; Bocconi University(博科尼大学)
AI总结 TrojanStego通过语言隐写术在LLM输出中隐秘泄露敏感信息,展示了一种新型被动且危险的LLM数据外泄攻击方式。
Comments 9 pages, 5 figures To be presented in the Conference on Empirical Methods in Natural Language Processing, 2025