CARO: Chain-of-Analogy Reasoning Optimization for Robust Content Moderation
CARO:用于鲁棒内容审核的类比推理优化
机构 * National Engineering Laboratory for Big Data System Computing Technology(大数据系统计算技术国家工程实验室) ; Shenzhen University(深圳大学) ; Tsinghua University(清华大学) ; National University of Singapore(新加坡国立大学)
AI总结 CARO通过两阶段训练框架提升LLM的类比推理能力,有效缓解内容审核中的误导性决策短路问题,实验显示其在模糊审核基准上平均F1得分提升24.9%。
Comments Accepted to ACL 2026 findings; under official publication process