LLM Reasoning for Subjective Tasks: Failure Modes, Mitigation, and Dynamic Reasoning Routing
用于主观任务的大语言模型推理:失败模式、缓解措施与动态推理路由
机构 * Duke University(杜克大学) ; Netflix(网飞公司)
专题命中 推理与问题求解 :LLM(title,summary_cn);large language model(abstract);language model(abstract);post-training(abstract)
AI总结 该研究针对主观任务中LLM推理的失败模式,提出带条件长度惩罚的后训练算法缓解推理崩溃,还发现推理风格不匹配是主观验证误差主因,给出算法补丁与架构蓝图。
Comments 20th ACM Conference on Recommender Systems (RecSys 2026)