arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-11-03 至 2025-11-03 共收录 3 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 3 篇

2506.00413 2025-11-03 cs.CL cs.AI cs.LG cs.PF 67%

Accelerating Diffusion LLMs via Adaptive Parallel Decoding

Daniel Israel, Guy Van den Broeck, Aditya Grover

专题命中 测试时计算 :verifier(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26995 2025-11-03 stat.ME cs.AI cs.LG 62%

LLMs are Overconfident: Evaluating Confidence Interval Calibration with FermiEval

Elliot L. Epstein, John Winnicki, Thanawat Sornwanee, Rajat Dwaraknath

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14276 2025-11-03 cs.AI cs.LG 62%

Don't throw the baby out with the bathwater: How and why deep learning for ARC

Jack Cole, Mohamed Osman

机构 * Mindware Consulting, Inc.(Mindware咨询公司) MindsAI Tufa Labs(Tufa实验室)

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏