RFEval: Benchmarking Reasoning Faithfulness under Counterfactual Reasoning Intervention in Large Reasoning Models
RFEval: 在大推理模型中评估推理忠实性下的反事实推理干预基准测试
机构 * AIDAS Laboratory(AIDAS实验室) ; IPAI ; ECE(电子工程系) ; Seoul National University(首尔国立大学)
专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL、cs.AI
AI总结 RFEval通过反事实推理干预评估大推理模型的推理忠实性,发现49.7%的输出不忠实,主要源于立场不一致,强调准确性不能作为忠实性的可靠代理。
Comments Accepted in ICLR 2026 Poster: https://iclr.cc/virtual/2026/poster/10011763