arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-23 至 2025-12-23 共收录 4 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 4 篇

2509.16958 2025-12-23 cs.AI 79%

Quantum Abduction: A New Paradigm for Reasoning under Uncertainty

量子反向推理:一种在不确定性下推理的新范式

Remo Pareschi

机构 * Stake Lab, University of Molise(斯泰克实验室,莫利塞大学)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI

AI总结 量子反向推理通过非经典范式模拟人类在不确定性下的多线索推理,实现动态综合而非排除,适用于历史谜团、文学、医学和科学理论变革等领域。

Comments 23 pages, 8 figures, 3 tables; submitted to Sci, MDPI

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16707 2025-12-23 cs.AI cs.LO 57%

Dual Computational Horizons: Incompleteness and Unpredictability in Intelligent Systems

双重计算 horizon:智能系统中的不完全性与不可预测性

Abhisek Ganguly

机构 * Engineering Mechanics Unit, Jawaharlal Nehru Centre for Advanced Scientific Research, Bangalore 560064, India(奈尔中心先进科学研究所工程力学单元,班加罗尔560064,印度)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 本文研究了智能系统中由于形式不完全性和动态不可预测性导致的计算限制,并探讨了推理、预测与自我分析之间的权衡。

Comments 8 Pages, 0 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18256 2025-12-23 cs.AI cs.LO 57%

MSC-180: A Benchmark for Automated Formal Theorem Proving from Mathematical Subject Classification

MSC-180:一个用于从数学学科分类自动形式定理证明的基准

Sirui Li, Wangyue Lu, Xiaorui Shi, Ke Weng, Haozhe Sun, Minghe Yu, Tiancheng Zhang, Ge Yu, Hengyu Liu, Lun Du

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 MSC-180是一个用于评估自动形式定理证明的基准,揭示了当前基于LLM的定理证明者在数学领域覆盖和泛化能力上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00251 2025-12-23 cs.AI 57%

Instruction-Level Weight Shaping: A Framework for Self-Improving AI Agents

指令级权重塑造:一种自我改进的AI代理框架

Rimom Costa

机构 * Adobe Commerce Cloud Support Engineering - EMEA Division(Adobe 商业云支持工程 - EMEA部门)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 指令级权重塑造通过外部可审计伪参数提升AI代理的自我改进能力,实现低延迟部署和减少幻觉,适用于动态领域。

Comments 12 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏