Rethinking Bottlenecks in Safety Fine-Tuning of Vision Language Models
重新审视视觉语言模型安全微调中的瓶颈
机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; Purdue University(普渡大学) ; Tianjin University(天津大学)
专题命中 安全评测 :safety(title,abstract);harmlessness(abstract);分类 cs.CL
AI总结 本文提出多图像安全数据集,通过增强视觉推理能力,提升模型在安全关键任务中的性能与通用能力。
Journal ref ICLR 2026