When Reject Turns into Accept: Quantifying the Vulnerability of LLM-Based Scientific Reviewers to Indirect Prompt Injection
当拒绝转为接受:量化基于LLM的科学评审员对间接提示注入的脆弱性
机构 * BITS Pilani ; KIIT University(KIIT大学)
专题命中 提示注入 :prompt injection(title);jailbreak(abstract);分类 cs.CL、cs.AI
AI总结 本研究量化了基于LLM的科学评审系统对间接提示注入攻击的脆弱性,揭示了通过隐藏文本注入和布局感知攻击翻转评审决定的风险,并提出WAVS指标评估此类攻击的严重性。