Diagnosing and Repairing Unsafe Channels in Vision-Language Models via Causal Discovery and Dual-Modal Safety Subspace Projection
通过因果发现和双模态安全子空间投影诊断和修复视觉-语言模型中的不安全通道
机构 * Beijing University of Posts and Telecommunications(北京邮电大学) ; Huawei Technologies Ltd.(华为技术有限公司) ; Peking University(北京大学) ; Chongqing University of Posts and Telecommunications(重庆邮电大学)
专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI
AI总结 本文提出CARE框架,通过因果分析和双模态安全子空间投影修复视觉-语言模型中的不安全通道,提升安全性而不影响多模态能力。
Comments Accepted by CVPR 2026 main conference