arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-11-25 至 2025-11-25 共收录 5 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 5 篇

2511.19131 2025-11-25 cs.CL 87%

Eliciting Chain-of-Thought in Base LLMs via Gradient-Based Representation Optimization

通过基于梯度的表示优化在基础LLM中引导链式思维

Zijian Wang, Yanxiang Ma, Chang Xu

机构 * Zijian Wang, Yanxiang Ma, Chang Xu(作者)

专题命中 数学推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);logical reasoning(abstract)

AI总结 本文提出了一种基于概率条件生成的隐藏状态优化方法,通过梯度优化提升基础LLM的链式思维推理能力,有效解决隐藏状态操纵中的分布偏移问题。

Comments AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14258 2025-11-25 cs.CL 83%

Entropy-Guided Reasoning Compression

熵引导的推理压缩

Hourun Zhu, Yang Gao, Wenlong Fei, Jiawei Li, Huashan Sun

机构 * School of Computer Science and Technology(计算机科学与技术学院)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 本文提出熵引导的推理压缩框架,通过平衡熵变化引导模型在高效推理与探索之间取得平衡,实验表明在保持准确性的同时将推理长度压缩至原始的20%。

Comments 10pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18617 2025-11-25 cs.CR cs.LG 83%

DarkMind: Latent Chain-of-Thought Backdoor in Customized LLMs

DarkMind: 自定义大语言模型中的潜在推理链后门

Zhen Guo, Shanghao Shi, Shamim Yazdani, Ning Zhang, Reza Tourani

专题命中 数学推理 :chain-of-thought(title);reasoning(abstract);CoT(abstract);分类 cs.LG

AI总结 DarkMind是一种针对定制化大语言模型的潜在推理链后门攻击,通过操纵内部推理步骤实现隐蔽攻击,展示了高攻击成功率并揭示了推理层面安全威胁的紧迫性。

Comments 19 pages, 15 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17577 2025-11-25 cs.LG cs.AI cs.CL 82%

Efficient Mathematical Reasoning Models via Dynamic Pruning and Knowledge Distillation

通过动态剪枝和知识蒸馏实现高效的数学推理模型

Fengming Yu, Qingyu Meng, Haiwei Pan, Kejia Zhang

机构 * Harbin Engineering University(哈尔滨工程大学)

专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出通过动态剪枝和知识蒸馏优化方法,提升大型语言模型在数学推理任务中的效率与性能。

Comments 12 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19333 2025-11-25 cs.CL 79%

Learning to Reason: Training LLMs with GPT-OSS or DeepSeek R1 Reasoning Traces

学习推理:通过GPT-OSS或DeepSeek R1推理轨迹训练LLMs

Shaltiel Shmidman, Asher Fredman, Oleg Sudakov, Meriem Bendris

机构 * DICTA NVIDIA

专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本研究通过比较DeepSeek-R1和gpt-oss生成的推理轨迹对中型LLMs在数学问题上的微调效果,评估了推理轨迹在提升模型推理能力中的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏