arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-05 至 2026-02-05 共收录 5 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 5 篇

2602.04290 2026-02-05 cs.CL 88%

Guided Verifier: Collaborative Multimodal Reasoning via Dynamic Process Supervision

引导验证器:通过动态过程监督实现协作多模态推理

Lingzhuang Sun, Ruitong Liu, Yuxia Zhu, Xiaohan Xu, Jingxuan Wei, Xiangxiang Zhang, Bihui Yu, Wentao Zhang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Peking University(北京大学) The University of Hong Kong(香港大学)

专题命中 测试时计算 :reasoning(title,abstract);verifier(title,abstract);分类 cs.CL

AI总结 本文提出引导验证器框架,通过动态过程监督实现多模态推理的协作优化,提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03975 2026-02-05 cs.AI 83%

Adaptive Test-Time Compute Allocation via Learned Heuristics over Categorical Structure

通过学习的启发式方法在分类结构上实现自适应测试时计算分配

Shuhui Qu

机构 * Stanford University(斯坦福大学)

专题命中 测试时计算 :test-time compute(title);reasoning(abstract);verifier(abstract);分类 cs.AI

AI总结 本文提出了一种基于学习启发式的自适应测试时计算分配方法,通过状态级选择性验证框架在MATH基准测试中实现更高的准确率,同时减少验证器调用次数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00640 2026-02-05 cs.AI cs.CL cs.LG 82%

DTS: Enhancing Large Reasoning Models via Decoding Tree Sketching

DTS: 通过解码树草图增强大推理模型

Zicheng Xu, Xiuyi Lou, Guanchu Wang, Yu-Neng Chuang, Feng Luo, Guangyao Zheng, Alexander S. Szalay, Zirui Liu, Vladimir Braverman

机构 * Johns Hopkins University(约翰霍普金斯大学) University of North Carolina at Charlotte(北卡罗来纳大学教堂山分校) Rice University(莱斯大学) University of Minnesota(明尼苏达大学)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 DTS通过解码树草图方法提升大推理模型的推理能力,显著提高准确性并减少重复生成,使小模型超越大模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04742 2026-02-05 cs.CY cs.CL 79%

Inference-Time Reasoning Selectively Reduces Implicit Social Bias in Large Language Models

推理时的推理选择性减少大语言模型中的隐性社会偏见

Molly Apsel, Michael N. Jones

机构 * Cognitive Science Program Department of Psychological & Brain Sciences Indiana University Bloomington(心理与脑科学系认知科学计划印第安纳大学布卢明顿)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL

AI总结 该研究通过推理增强减少大语言模型中的隐性社会偏见,揭示推理对公平性评估的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04254 2026-02-05 cs.CL 79%

Scaling Agentic Verifier for Competitive Coding

为竞争编程设计的扩展代理验证器

Zeyao Ma, Jing Zhang, Xiaokang Zhang, Jiaxi Yang, Zongmeng Zhang, Jiajun Zhang, Yuheng Jing, Lei Zhang, Hao Zheng, Wenting Zhao, Junyang Lin, Binyuan Hui

机构 * Renmin University of China(中国人民大学) Qwen Team, Alibaba Group(通义实验室,阿里巴巴集团)

专题命中 测试时计算 :verifier(title,abstract);分类 cs.CL

AI总结 本文提出Agentic Verifier,通过主动推理和高效测试输入生成,提升竞争编程问题解决的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏