arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-13 至 2026-02-13 共收录 9 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 9 篇

2510.18134 2026-02-13 cs.AI 86%

Evaluating LLM Reasoning Beyond Correctness and CoT

评估大语言模型推理能力超越正确性与链式思维

Soheil Abbasloo

机构 * Microsoft Research, Vancouver, Canada(微软研究院,温哥华,加拿大)

专题命中 数学推理 :reasoning(title,abstract);CoT(title);分类 cs.AI

AI总结 SIEV框架通过动态轨迹评估推理过程,揭示模型在面对冲突和挑战时的鲁棒性与综合能力,展现大语言模型推理能力的显著差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12022 2026-02-13 cs.CL cs.AI 86%

Teaching LLMs According to Their Aptitude: Adaptive Reasoning for Mathematical Problem Solving

根据能力教学LLMs:数学问题解决的自适应推理

Xin Xu, Yan Xu, Tianhao Chen, Yuchen Yan, Chengwu Liu, Zaoyu Chen, Yufei Wang, Yichun Yin, Yasheng Wang, Lifeng Shang, Qun Liu, Lu Yin

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Zhejiang University(浙江大学) Peking University(北京大学) The Hong Kong Polytechnic University(香港理工大学) University of Surrey(萨里大学)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

AI总结 TATA通过自适应框架使LLMs根据自身能力自主调整推理策略,提升数学问题解决的效率和准确性。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12164 2026-02-13 cs.AI 83%

Sci-CoE: Co-evolving Scientific Reasoning LLMs via Geometric Consensus with Sparse Supervision

Sci-CoE: 通过稀疏监督与几何共识共演化科学推理LLM

Xiaohan He, Shiyang Feng, Songtao Huang, Lei Bai, Bin Wang, Bo Zhang

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学)

专题命中 数学推理 :reasoning(title,abstract);verifier(abstract);分类 cs.AI

AI总结 Sci-CoE 通过稀疏监督与几何共识共演化科学推理LLM,提升复杂推理能力与可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11639 2026-02-13 cs.CL 79%

PACE: Prefix-Protected and Difficulty-Aware Compression for Efficient Reasoning

PACE: 用于高效推理的前缀保护和难度感知压缩

Ruixiang Feng, Yuntao Wen, Silin Zhou, Ke Shi, Yifan Wang, Ran Le, Zhenwei An, Zongchao Chen, Chen Yang, Guangyue Peng, Yiming Jia, Dongsheng Wang, Tao Zhang, Lisi Chen, Yang Song, Shen Gao, Shuo Shang

机构 * University of Electronic Science and Technology of China(电子科技大学) Nanbeige Lab, BOSS Zhipin(纳米贝实验室,BOSS智联) Peking University(北京大学)

专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL

AI总结 PACE通过双层框架实现前缀保护和难度感知压缩,有效减少token使用并提升推理准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11175 2026-02-13 cs.CL 79%

Barriers to Discrete Reasoning with Transformers: A Survey Across Depth, Exactness, and Bandwidth

Transformer在离散推理中的障碍:深度、精确性与带宽的跨领域综述

Michelle Yuan, Weiyi Sun, Amir H. Rezaeian, Jyotika Singh, Sandip Ghoshal, Yao-Ting Wang, Miguel Ballesteros, Yassine Benajiba

机构 * Oracle AI

专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本文综述了Transformer在离散推理任务中的理论限制,从电路复杂度、近似理论和通信复杂度三个角度分析了深度、精确性和带宽等障碍,并探讨了模型设计的改进方向。

Comments Accepted to EACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11164 2026-02-13 cs.LG cs.AI cs.CL 67%

Automated Optimization Modeling via a Localizable Error-Driven Perspective

通过可定位的误差驱动视角实现自动化优化建模

Weiting Liu, Han Wu, Yufei Kuang, Xiongwei Han, Tao Zhong, Jianfeng Feng, Wenlian Lu

机构 * Fudan University(复旦大学) Huawei Noah’s Ark Lab(华为诺亚实验室) University of Science and Technology of China(中国科学技术大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 MIND通过可定位的误差驱动视角,改进自动化优化建模方法,提升训练后性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12172 2026-02-13 cs.AI cs.CL 62%

Pedagogically-Inspired Data Synthesis for Language Model Knowledge Distillation

教学启发式数据合成用于语言模型知识蒸馏

Bowei He, Yankai Chen, Xiaokun Zhang, Linghe Kong, Philip S. Yu, Xue Liu, Chen Ma

机构 * MBZUAI McGill(麦吉尔大学) CityUHK(城市大学香港分校) SJTU(上海交通大学) UIC(美国国际大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出基于教学原理的知识蒸馏框架,通过三阶段流程提升学生模型性能,在复杂推理任务中取得显著改进。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11779 2026-02-13 cs.LG 57%

Temperature as a Meta-Policy: Adaptive Temperature in LLM Reinforcement Learning

温度作为元策略:LLM强化学习中的自适应温度

Haoran Dang, Cuiling Lan, Hai Wan, Xibin Zhao, Yan Lu

机构 * Tsinghua University(清华大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 数学推理 :reasoning(abstract);分类 cs.LG

AI总结 TAMPO通过将温度控制转化为可学习的元策略,实现了LLM强化学习中的自适应探索,优于固定或启发式温度方法。

Comments Accepted at ICLR 2026. 10 pages (main text) + supplementary material, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11717 2026-02-13 cs.AI 57%

Beyond Parameter Arithmetic: Sparse Complementary Fusion for Distribution-Aware Model Merging

超越参数运算:用于分布感知模型融合的稀疏互补融合

Weihong Lin, Lin Sun, Qilong Shi, Aomufei Yuan, Yuxuan Tian, Zhengyang Wang, Guangxiang Zhao, Xiangzheng Zhang, Tong Yang

机构 * Beijing Qiyuan Technology Co., Ltd.(北京启元科技有限公司) Peking University(北京大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出SCF-RKL方法,通过稀疏、分布感知的更新控制功能干扰,提升模型融合的稳定性与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏