arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-03 至 2026-02-03 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 6 篇

2602.02462 2026-02-03 cs.CL cs.AI 81%

Abstract Activation Spaces for Content-Invariant Reasoning in Large Language Models

抽象激活空间用于大语言模型中的内容不变推理

Gabriele Maraia, Marco Valentino, Fabio Massimo Zanzotto, Leonardo Ranaldi

机构 * Human Centric ART, University of Rome Tor Vergata(人类中心ART,罗马大学托尔维加塔分校) ILCC, School of Informatics, University of Edinburgh(ILCC,信息学院,爱丁堡大学) School of Computer Science, University of Sheffield(计算机科学学院,谢菲尔德大学) Almawave S.p.A.(Almawave公司)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本研究提出了一种抽象引导推理框架,通过分离结构推理与词法语义,减少语义干扰对形式推理的影响,提升大语言模型的推理鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00998 2026-02-03 cs.CL 74%

Reliable Use of Lemmas via Eligibility Reasoning and Section$-$Aware Reinforcement Learning

通过资格推理和面向节段的强化学习可靠地使用引理

Zhikun Xu, Xiaodong Yu, Ben Zhou, Jiang Liu, Jialian Wu, Ze Wang, Ximeng Sun, Hao Chen, Zicheng Liu

机构 * Arizona State University(亚利桑那州立大学) Advanced Micro Devices, Inc.(先进微器件公司)

专题命中 代码与定理证明 :reasoning(title);分类 cs.CL

AI总结 通过资格推理和面向节段的强化学习提升LLM在数学引理应用的可靠性与鲁棒性

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09917 2026-02-03 cs.SE 67%

Enhancing LLM-based Specification Generation via Program Slicing and Logical Deletion

通过程序切片和逻辑删除增强基于LLM的规范生成

Zehan Chen, Long Zhang, Zhiwei Zhang, JingJing Zhang, Ruoyu Zhou, Yulong Shen, JianFeng Ma, Lin Yang

专题命中 代码与定理证明 :reasoning(abstract);logical reasoning(abstract)

AI总结 SLD-Spec通过程序切片和逻辑删除提升LLM生成规范的准确性和完整性

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00337 2026-02-03 cs.DL 67%

Smarter AI Through Prompt Engineering: Insights and Case Studies from Data Science Application

通过提示工程实现更智能的AI:来自数据科学应用的洞察与案例研究

Snehasish Paul, Rohit Kumar, Laxman Das

专题命中 代码与定理证明 :reasoning(abstract);chain-of-thought(abstract)

AI总结 本文通过提示工程在不同领域的应用案例,展示其提升AI性能的潜力及方法论有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00638 2026-02-03 cs.CL 57%

Formal Semantic Control over Language Models

语言模型的正式语义控制

Yingji Zhang

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL

AI总结 本研究通过VAE框架,探索了在潜在空间中解构语义特征以提升语言模型的可解释性和可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01291 2026-02-03 cs.LO 50%

Construction-Verification: A Benchmark for Applied Mathematics in Lean 4

构造-验证:Lean 4中的应用数学基准

Bowen Yang, Yi Yuan, Chenyi Li, Ziyu Wang, Liangqi Li, Bo Zhang, Zhe Li, Zaiwen Wen

专题命中 代码与定理证明 :reasoning(abstract)

AI总结 本文提出Lean 4中的构造-验证框架,通过AMBER基准评估应用数学领域中显式解决方案合成与验证能力,揭示通用模型在复杂构造任务中的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏