arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-11-20 至 2025-11-20 共收录 3 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 3 篇

2511.14773 2025-11-20 cs.CL 85%

Temporal Predictors of Outcome in Reasoning Language Models

Joey David

机构 * Independent Researcher(独立研究者)

专题命中 测试时计算 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

Comments 4 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17979 2025-11-20 cs.AI cs.CL 84%

Trade-offs in Large Reasoning Models: An Empirical Analysis of Deliberative and Adaptive Reasoning over Foundational Capabilities

Weixiang Zhao, Xingyu Sui, Jiahe Guo, Yulin Hu, Yang Deng, Yanyan Zhao, Xuda Zhi, Yongbo Huang, Hao He, Wanxiang Che, Ting Liu, Bing Qin

专题命中 测试时计算 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

Comments To appear at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17793 2025-11-20 cs.CL cs.AI cs.LG 82%

Foundational Automatic Evaluators: Scaling Multi-Task Generative Evaluator Training for Reasoning-Centric Domains

Austin Xu, Xuan-Phi Nguyen, Yilun Zhou, Chien-Sheng Wu, Caiming Xiong, Shafiq Joty

机构 * Salesforce AI Research(Salesforce人工智能研究)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 29 pages, 9 tables, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏