RAPO: Risk-Aware Preference Optimization for Generalizable Safe Reasoning
RAPO:面向通用安全推理的风险感知优化
机构 * Shanghai AI Laboratory(上海人工智能实验室)
专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 RAPO 提出了一种风险感知优化框架,通过提升安全推理的泛化能力,增强大型推理模型在复杂攻击下的安全性与实用性。