Reasoning over Precedents Alongside Statutes: Case-Augmented Deliberative Alignment for LLM Safety
在法规中进行推理:结合案例的 deliberative 对齐方法用于 LLM 安全性
机构 * Rutgers University(罗格斯大学) ; NVIDIA Research(NVIDIA研究) ; Nanyang Technological University(南洋理工大学) ; Adobe Research(Adobe研究) ; University of Connecticut(康涅狄格大学) ; Fordham University(福特汉姆大学) ; Google DeepMind(谷歌DeepMind)
专题命中 安全训练 :alignment(title,abstract);safety(title,abstract);harmlessness(abstract);分类 cs.AI
AI总结 本文提出CADA方法,通过案例增强的推理链进行强化学习,提升LLM的安全性和实用性,避免过度依赖规则。