Training Proactive and Personalized LLM Agents
训练主动且个性化的大语言模型智能体
机构 * Carnegie Mellon University(卡内基梅隆大学) ; OpenHands
AI总结 该研究提出训练协作型LLM智能体的新范式,形式化PPP三维度,构建UserVille环境与多目标强化学习框架,在SWE-Bench等任务上使智能体性能优于GPT-5等基线,验证了以用户为中心反馈的重要性。
Comments COLM 2026
作者
Natural Language Processing
训练主动且个性化的大语言模型智能体
机构 * Carnegie Mellon University(卡内基梅隆大学) ; OpenHands
AI总结 该研究提出训练协作型LLM智能体的新范式,形式化PPP三维度,构建UserVille环境与多目标强化学习框架,在SWE-Bench等任务上使智能体性能优于GPT-5等基线,验证了以用户为中心反馈的重要性。
Comments COLM 2026