Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?
推理是否能帮助大语言模型捕捉人类标注者的分歧?
专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);RLHF(abstract)
AI总结 本文研究了推理方法对大语言模型捕捉人类标注分歧的影响,发现RLVR推理会降低性能,而朴素推理能提升性能,揭示了用推理模型替代人类标注的风险。
Comments EACL 2026 Main