arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-11 至 2026-02-11 共收录 4 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 4 篇

2602.08030 2026-02-11 cs.AI cs.CL 84%

Free(): Learning to Forget in Malloc-Only Reasoning Models

Free(): 学会遗忘的仅malloc推理模型

Yilun Zheng, Dongyang Ma, Tian Liang, Jiahao Xu, Xinting Huang, Lihui Chen, Haitao Mi, Yan Wang

机构 * Tencent AI Lab(腾讯AI实验室) Nanyang Technological University(南洋理工大学)

专题命中 测试时计算 :reasoning(title,abstract);test-time compute(abstract);分类 cs.CL、cs.AI

AI总结 Free()LM通过引入内在自我遗忘机制,解决推理模型中过多思考标记导致性能下降的问题,实现模型在不同规模上的性能提升,并在长周期任务中恢复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09501 2026-02-11 cs.CL 70%

Where-to-Unmask: Ground-Truth-Guided Unmasking Order Learning for Masked Diffusion Language Models

Where-to-Unmask: 基于真实情况引导的去掩码顺序学习用于掩码扩散语言模型

Hikaru Asano, Tadashi Kozuno, Kuniaki Saito, Yukino Baba

机构 * The University of Tokyo, Tokyo, Japan(东京大学)

专题命中 测试时计算 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL

AI总结 本文提出Gt-Margin方法,通过真实标记计算去掩码顺序,提升MDLM在逻辑推理任务中的生成质量。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09438 2026-02-11 cs.CL 70%

Breaking the Pre-Sampling Barrier: Activation-Informed Difficulty-Aware Self-Consistency

突破预采样障碍:基于激活的难度感知自一致性

Taewoong Yoon, Geunyeong Jeong, Geon Park, Sihyeong Yeom, Harksoo Kim

机构 * Konkuk University(韩国康克大学)

专题命中 测试时计算 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 ACTSC通过利用神经元激活信号构建轻量级难度估计探针,无需额外调用或预采样,有效降低推理成本并保持准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10030 2026-02-11 cs.CL cs.AI 62%

Inference-Aware Prompt Optimization for Aligning Black-Box Large Language Models

面向推理的提示优化以对齐黑盒大语言模型

Saaduddin Mahmud, Mason Nakamura, Kyle Hollins Wray, Shlomo Zilberstein

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出IAPO框架,通过联合优化提示和推理规模,提升黑盒大语言模型对齐效果。

Comments Accepted to AAAI 2026. Extended 17-page version

详情

展开后加载摘要…

URL PDF HTML 收藏