Scaling Reinforcement Learning for Content Moderation with Large Language Models
利用大语言模型扩展强化学习用于内容审核
机构 * Meta AI
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI
AI总结 本文提出利用强化学习扩展大语言模型,以提升内容审核的准确性和效率,特别是在标签稀疏和政策复杂的情况下。