arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-10-31 至 2025-10-31 共收录 2 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 2 篇

2510.25623 2025-10-31 cs.CL 79%

Evaluating the Role of Verifiers in Test-Time Scaling for Legal Reasoning Tasks

Davide Romano, Jonathan Schwarz, Daniele Giofré

机构 * Thomson Reuters(汤姆森·路透)

专题命中 代码与定理证明 :reasoning(title);verifier(abstract);分类 cs.CL

Comments Accepted to EMNLP - NLLP Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.06736 2025-10-31 cs.CL 77%

Are LLMs Rigorous Logical Reasoners? Empowering Natural Language Proof Generation by Stepwise Decoding with Contrastive Learning

Ying Su, Mingwen Liu, Zhijiang Guo

机构 * South China University of Technology(华南理工大学) Likelihood Lab(Likelihood实验室) HKUST(GZ)(香港科技大学(广州)) HKUST(香港科技大学)

专题命中 代码与定理证明 :reasoning(abstract);planning(abstract);logical reasoning(abstract);分类 cs.CL

Comments 15 pages, 2 figures, 11 tables. Accepted by AACL 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏