arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-04 至 2026-02-04 共收录 13 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 13 篇

2505.16552 2026-02-04 cs.CL 85%

Think Silently, Think Fast: Dynamic Latent Compression of LLM Reasoning Chains

静思速思:动态潜在空间压缩LLM推理链

Wenhui Tan, Jiaze Li, Jianzhong Ju, Zhenbo Luo, Ruihua Song, Jian Luan

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) MiLM Plus, Xiaomi Inc.(小米公司)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

AI总结 CoLaR通过动态潜在空间压缩LLM推理链,实现高效推理与灵活速度调整,提升数学推理任务的准确率和效率。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19326 2026-02-04 cs.CL 83%

Slot Filling as a Reasoning Task for SpeechLLMs

槽填充作为推理任务用于语音大语言模型

Kadri Hacioglu, Manjunath K E, Andreas Stolcke

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 本文提出通过推理任务提升语音大语言模型在槽填充任务中的性能,探讨了不同基础模型对推理语音LLM的影响。

Journal ref Proc. IEEE ICASSP, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02842 2026-02-04 cs.AI cs.CL cs.LG 82%

Chain of Simulation: A Dual-Mode Reasoning Framework for Large Language Models with Dynamic Problem Routing

模拟链:一种用于大语言模型的双模式推理框架,具有动态问题路由

Saeid Sheikhi

机构 * Faculty of Information Technology(信息科技学院) Electrical Engineering University of Oulu, Oulu, Finland, 90014(奥卢大学电气工程学院)

专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 CoS是一种双模式推理框架,通过动态问题路由提升大语言模型的推理能力,实现更高效的准确性和效率平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02545 2026-02-04 cs.LG cs.AI 81%

Beyond Alignment: Expanding Reasoning Capacity via Manifold-Reshaping Policy Optimization

超越对齐:通过流形重塑策略优化扩展推理能力

Dayu Wang, Jiaye Yang, Weikang Li, Jiahui Liang, Yang Li

机构 * Baidu Inc.(百度公司) Peking University(北京大学)

专题命中 数学推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出流形重塑策略优化方法,通过几何干预扩展LLM的推理能力,实验证明其在数学任务中优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00294 2026-02-04 cs.LG cs.AI 73%

Free Draft-and-Verification: Toward Lossless Parallel Decoding for Diffusion Large Language Models

免费草稿与验证:迈向无损并行解码的扩散大语言模型

Shutong Wu, Jiawei Zhang

机构 * Department of Computer Sciences, University of Wisconsin--Madison, Madison, WI(计算机科学系,威斯康星大学麦迪逊分校,麦迪逊,WI)

专题命中 数学推理 :reasoning(abstract);math reasoning(abstract);分类 cs.AI、cs.LG

AI总结 FreeDave是一种专为DLLMs设计的快速解码算法,通过无损并行解码实现高效推理,无需模型修改或额外模块,提升了推理速度而不影响性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03635 2026-02-04 cs.CL cs.LG 62%

TRE: Encouraging Exploration in the Trust Region

TRE: 在信任区域中鼓励探索

Chao Huang, Yujing Lu, Quangang Li, Shenghe Wang, Yan Wang, Yueyang Zhang, Long Xia, Jiashu Zhao, Zhiyuan Sun, Daiting Shi, Tingwen Liu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Baidu Inc.(百度公司) Wilfrid Laurier University(威尔弗里德·劳里埃大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 TRE通过在模型信任区域内鼓励探索,提升了大型语言模型在数学推理、组合搜索和偏好对齐任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03452 2026-02-04 cs.LG cs.AI 62%

Beyond Variance: Prompt-Efficient RLVR via Rare-Event Amplification and Bidirectional Pairing

超越方差:通过稀有事件放大和双向配对实现高效的提示式强化学习可验证奖励

Xin Sheng, Jiaxin Li, Yujuan Pang, Ran Peng, Yong Ma

机构 * Beijing University of Post(北京邮电大学) Sichuan Agricultural University(四川农业大学) RapidAI Research(RapidAI研究院)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 通过稀有事件放大和双向配对方法提升提示式强化学习可验证奖励的样本效率和转移性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03309 2026-02-04 cs.LG cs.AI 62%

Entropy-Gated Selective Policy Optimization:Token-Level Gradient Allocation for Hybrid Training of Large Language Models

熵门选择策略优化:用于大型语言模型混合训练的token级梯度分配

Yuelin Hu, Zhengxue Cheng, Wei Liu, Li Song

机构 * Department of Computer Science Anonymous University(计算机科学系 匿名大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 EGSPO通过token级梯度分配提升大型语言模型的混合训练效果,实现数学推理任务的性能提升并降低计算开销。

Comments accepted by cscwd2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02888 2026-02-04 cs.CL cs.AI 62%

HALT: Hallucination Assessment via Log-probs as Time series

HALT:通过log-prob作为时间序列进行幻觉评估

Ahmad Shapiro, Karan Taneja, Ashok Goel

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 HALT通过log-prob时间序列检测幻觉,比Lettuce更高效且兼容专有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03075 2026-02-04 cs.CL 57%

ReMiT: RL-Guided Mid-Training for Iterative LLM Evolution

ReMiT: 通过强化学习指导的迭代大语言模型进化

Junjie Huang, Jiarui Qin, Di Yin, Weiwen Liu, Yong Yu, Xing Sun, Weinan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Tencent Youtu Lab(腾讯优图实验室)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

AI总结 ReMiT通过强化学习指导中训练过程,实现大语言模型的迭代进化,提升模型在数学、代码和推理任务上的表现。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03073 2026-02-04 cs.LG 57%

TMS: Trajectory-Mixed Supervision for Reward-Free, On-Policy SFT

TMS:轨迹混合监督用于无奖励、在线策略微调

Rana Muhammad Shahroz Khan, Zijie Liu, Zhen Tan, Charles Fleming, Tianlong Chen

专题命中 数学推理 :reasoning(abstract);分类 cs.LG

AI总结 TMS通过轨迹混合监督在无奖励的情况下提升大语言模型的保留能力,有效弥补了传统SFT与RL之间的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03679 2026-02-04 math.HO 50%

Footprints of the Walking of Numbers: A Dynamic Visualization Task for Understanding Decimal Numbers in Secondary Education

数字行走的足迹:一种动态可视化任务,用于理解中学阶段的小数

Felix De la Cruz Serrano

专题命中 数学推理 :reasoning(abstract)

AI总结 本文提出一种动态可视化任务,通过生成小数的几何路径帮助中学学生理解小数结构和特性。

Comments in Spanish language

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03060 2026-02-04 cs.CV 50%

IVC-Prune: Revealing the Implicit Visual Coordinates in LVLMs for Vision Token Pruning

IVC-Prune: 在大型视觉-语言模型中揭示隐式的视觉坐标以进行视觉标记剪枝

Zhichao Sun, Yidong Ma, Gang Liu, Yibo Chen, Xu Tang, Yao Hu, Yongchao Xu

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) Xiaohongshu Inc(小红书公司)

专题命中 数学推理 :reasoning(abstract)

AI总结 IVC-Prune通过揭示LVLMs中隐式的视觉坐标,提出一种无训练、提示感知的视觉标记剪枝方法,有效减少标记数量并保持高性能。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏