arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-09 至 2026-02-09 共收录 2 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 2 篇

2602.06266 2026-02-09 cs.CL 85%

Is my model "mind blurting"? Interpreting the dynamics of reasoning tokens with Recurrence Quantification Analysis (RQA)

我的模型在“思维模糊”吗?通过递归量化分析(RQA)解读推理令牌的动力学

Quoc Tuan Pham, Mehdi Jafari, Flora Salim

机构 * School of Computer Science and Engineering, University of New South Wales(计算机科学与工程学院,新南威尔士大学)

专题命中 测试时计算 :reasoning(title,abstract);CoT(abstract);test-time compute(abstract);分类 cs.CL

AI总结 通过递归量化分析(RQA)研究推理模型在测试时的令牌生成动力学,提升任务复杂度预测能力8%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06375 2026-02-09 cs.AI 57%

Difficulty-Estimated Policy Optimization

难度估计策略优化

Yu Zhao, Fan Jiang, Tianle Liu, Bo Zeng, Yu Liu, Longyue Wang, Weihua Luo

机构 * Alibaba International Digital Commerce(阿里巴巴国际数字商务) School of Software Technology, Dalian University of Technology(大连理工大学软件学院)

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI

AI总结 DEPO通过动态难度估计器优化推理对齐的效率和鲁棒性,减少回放成本并提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏