Jailbreaking on Text-to-Video Models via Scene Splitting Strategy
通过场景分割策略对文本到视频模型进行劫持
机构 * Yonsei University(延世大学) ; Korea Institute of Science and Technology(韩国科学技术院) ; AIM Intelligence(AIM智能) ; Seoul National University(首尔国立大学) ; Kyung Hee University(庆熙大学)
专题命中 其他LLM :LLM(abstract_cn);分类 cs.AI
AI总结 本文提出了一种新的黑盒劫持方法SceneSplit,通过将有害叙述分割成多个良性场景,利用场景组合作为约束来引导最终输出,从而提高生成有害视频的可能性,验证了当前文本到视频模型的安全机制存在漏洞。
Comments ICLR 2026. Project page at https://velpegor.github.io/SceneSplit/