arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-10-02 至 2025-10-02 共收录 4 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 4 篇

2505.14999 2025-10-02 cs.LG cs.AI cs.CL stat.ML 88%

Learning to Rank Chain-of-Thought: Using a Small Model

Eric Hanchen Jiang, Haozheng Luo, Shengyuan Pang, Xiaomin Li, Zhenting Qi, Hengli Li, Cheng-Fu Yang, Zongyu Lin, Xinfeng Li, Hao Xu, Kai-Wei Chang, Ying Nian Wu

专题命中 测试时计算 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);verifier(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15674 2025-10-02 cs.CL cs.AI cs.CR 84%

Leaky Thoughts: Large Reasoning Models Are Not Private Thinkers

Tommaso Green, Martin Gubri, Haritz Puerto, Sangdoo Yun, Seong Joon Oh

机构 * Parameter Lab(参数实验室) Data and Web Science Group(数据与网络科学小组) University of Mannheim(曼海姆大学) UKP Lab(UKP实验室) Technical University of Darmstadt(达姆施塔特技术大学) NAVER AI Lab(NAVER人工智能实验室) University of Tübingen(图宾根大学) Tübingen AI Center(图宾根人工智能中心)

专题命中 测试时计算 :reasoning(title,abstract);test-time compute(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2025 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01032 2025-10-02 cs.LG 79%

Meaningless Tokens, Meaningful Gains: How Activation Shifts Enhance LLM Reasoning

Zeru Shi, Yingjia Wan, Zhenting Wang, Qifan Wang, Fan Yang, Elisa Kreiss, Ruixiang Tang

机构 * Rutgers University(罗格斯大学) UCLA(加州大学洛杉矶分校) Meta AI Wake Forest University(威克森林大学)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17251 2025-10-02 cs.LG cs.AI 62%

Training-free LLM Verification via Recycling Few-shot Examples

Dongseok Lee, Jimyung Hong, Dongyoung Kim, Jaehyung Kim

机构 * Yonsei University(延世大学) KAIST(韩国科学技术院)

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏