2601.08000
2026-01-14
cs.AI
cs.SE
79%
Reasoning over Precedents Alongside Statutes: Case-Augmented Deliberative Alignment for LLM Safety
在法规中进行推理:结合案例的 deliberative 对齐方法用于 LLM 安全性
Can Jin, Rui Wu, Tong Che, Qixin Zhang, Hongwu Peng, Jiahui Zhao, Zhenting Wang, Wenqi Wei, Ligong Han, Zhao Zhang, Yuan Cao, Ruixiang Tang, Dimitris N. Metaxas
机构
*
Rutgers University(罗格斯大学)
;
NVIDIA Research(NVIDIA研究)
;
Nanyang Technological University(南洋理工大学)
;
Adobe Research(Adobe研究)
;
University of Connecticut(康涅狄格大学)
;
Fordham University(福特汉姆大学)
;
Google DeepMind(谷歌DeepMind)
专题命中
其他推理
:reasoning(title,abstract);分类 cs.AI
AI总结
本文提出CADA方法,通过案例增强的推理链进行强化学习,提升LLM的安全性和实用性,避免过度依赖规则。