Think-Reflect-Revise: A Policy-Guided Reflective Framework for Safety Alignment in Large Vision Language Models
思考-反思-修订:一种基于策略的反思框架,用于大型视觉语言模型的安全对齐
机构 * Shanghaitech University(上海科技大学) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
专题命中 复杂问题求解 :reasoning(abstract);self-correction(abstract);分类 cs.CL
AI总结 TRR通过策略引导的反思框架提升大型视觉语言模型的安全对齐,显著提高安全响应率至87.7%。