arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-30 至 2025-12-30 共收录 2 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 2 篇

2512.12620 2025-12-30 cs.CL cs.AI 81%

Understanding Syllogistic Reasoning in LLMs from Formal and Natural Language Perspectives

从形式和自然语言角度理解大语言模型中的三段论推理

Aheli Poddar, Saptarshi Sahoo, Sujata Ghosh

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文从形式和自然语言角度研究大语言模型的三段论推理能力,通过测试14种模型的符号推理和自然语言理解,探讨大语言模型是否正向形式化推理机制发展。

Comments 9 pages, 4 figures, 5 tables. Accepted at AAAI 2026 Bridge Program on Logic & AI. Code available at https://github.com/XAheli/Logic-in-LLMs

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22892 2025-12-30 stat.AP 50%

Counterfactual Harm: A Counter-argument

反事实伤害:一种反论点

Amit N. Sawant, Mats J. Stensrud

专题命中 代码与定理证明 :reasoning(abstract)

AI总结 本文指出基于反事实的伤害定义在多治疗选项场景下会产生不一致性,提出基于预期效用的干预定义以确保治疗排名的传递性。

详情

展开后加载摘要…

URL PDF HTML 收藏