arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-05 至 2025-12-05 共收录 2 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 2 篇

2512.04228 2025-12-05 cs.AI 79%

Addressing Logical Fallacies In Scientific Reasoning From Large Language Models: Towards a Dual-Inference Training Framework

解决大型语言模型在科学推理中的逻辑谬误:一种双推理训练框架

Peter B. Walker, Hannah Davidson, Aiden Foster, Matthew Lienert, Thomas Pardue, Dale Russell

机构 * Intelligenesis LLC Uniformed Services University(美国武装部队服务大学)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出一种双推理训练框架,旨在解决大型语言模型在科学推理中的逻辑谬误问题,通过整合肯定生成与反事实否定,提升模型的鲁棒性和可解释性。

Comments 12 pages, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04374 2025-12-05 cs.CL cs.FL 57%

LangSAT: A Novel Framework Combining NLP and Reinforcement Learning for SAT Solving

LangSAT:一种结合自然语言处理和强化学习的SAT求解新框架

Muyu Pan, Matthew Walter, Dheeraj Kodakandla, Mahfuza Farooque

机构 * Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL

AI总结 LangSAT结合自然语言处理和强化学习,通过将英语描述转换为CNF并优化求解过程,提升SAT求解的效率和普及性。

详情

展开后加载摘要…

URL PDF HTML 收藏