Contextual Integrity in LLMs via Reasoning and Reinforcement Learning
通过推理和强化学习实现大语言模型中的上下文完整性
机构 * Purdue University(普渡大学) ; Microsoft(微软) ; National Univ of Singapore(新加坡国立大学)
专题命中 推理评测 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 本文通过推理和强化学习方法,提升大语言模型在执行任务时的信息披露合理性,减少不适当信息泄露,同时保持任务性能。
Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)