arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-18 至 2026-02-18 共收录 2 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 2 篇

2509.03581 2026-02-18 cs.AI 83%

Learning When to Plan: Efficiently Allocating Test-Time Compute for LLM Agents

学习何时计划:高效分配测试时计算用于LLM代理

Davide Paglieri, Bartłomiej Cupiał, Jonathan Cook, Ulyana Piterbarg, Jens Tuyls, Edward Grefenstette, Jakob Nicolaus Foerster, Jack Parker-Holder, Tim Rocktäschel

机构 * University of Warsaw(华沙大学) University of Oxford(牛津大学) New York University(纽约大学) Princeton University(普林斯顿大学) University College London(伦敦大学学院)

专题命中 测试时计算 :test-time compute(title,abstract);planning(abstract);分类 cs.AI

AI总结 本文提出一种动态规划框架,通过两阶段训练提升LLM在长周期任务中的样本效率和复杂目标达成能力,同时展示人类计划对代理系统性能的增强作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15156 2026-02-18 cs.AI 70%

Panini: Continual Learning in Token Space via Structured Memory

Panini:通过结构化记忆在令牌空间中实现持续学习

Shreyas Rajesh, Pavan Holur, Mehmet Yigit Turali, Chenda Duan, Vwani Roychowdhury

机构 * ucla(加州大学洛杉矶分校)

专题命中 测试时计算 :reasoning(abstract);test-time compute(abstract);分类 cs.AI

AI总结 Panini通过结构化记忆在令牌空间中实现持续学习,提升推理效率和准确性。

Comments 35 pages, code available at: https://github.com/roychowdhuryresearch/gsw-memory

详情

展开后加载摘要…

URL PDF HTML 收藏