arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-29 至 2025-12-29 共收录 2 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 2 篇

2512.21540 2025-12-29 cs.AI 79%

Leash: Adaptive Length Penalty and Reward Shaping for Efficient Large Reasoning Model

Leash:自适应长度惩罚与奖励塑造用于高效大推理模型

Yanhao Li, Lu Ma, Jiaran Zhang, Lexiang Tang, Wentao Zhang, Guibo Luo

机构 * Peking University(北京大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 数学推理 :reasoning(title,abstract);分类 cs.AI

AI总结 Leash通过自适应长度惩罚与奖励塑造,有效提升大模型推理效率,减少推理长度60%同时保持性能竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21911 2025-12-29 cs.CL 57%

Accelerate Speculative Decoding with Sparse Computation in Verification

通过验证中的稀疏计算加速推测解码

Jikai Wang, Jianchao Tan, Yuxuan Hu, Jiayu Qin, Yerui Sun, Yuchen Xie, Xunliang Cai, Juntao Li, Min Zhang

机构 * Key Laboratory of Data Intelligence and Advanced Computing, Soochow University(数据智能与先进计算 key laboratory,苏州大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出了一种稀疏验证框架,通过联合稀疏化注意力、FFN和MoE组件,减少验证阶段的计算成本,并结合检索重用策略提升效率-准确性平衡。

Comments Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏