arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-25 至 2025-12-25 共收录 4 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 4 篇

2505.14582 2025-12-25 cs.CL 89%

Can Pruning Improve Reasoning? Revisiting Long-CoT Compression with Capability in Mind for Better Reasoning

剪枝能否提升推理?基于能力对齐的Long-Cot压缩以获得更好的推理

Shangziqi Zhao, Jiahao Yuan, Jinyang Wu, Zhenglin Wang, Guisong Yang, Usman Naseem

机构 * XJTU(西安交通大学) ECNU(华东师范大学) THU(清华大学) SEU(上海师范大学) USST(上海师范大学)

专题命中 逻辑推理 :reasoning(title,abstract);CoT(title,abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 本文提出Prune-on-Logic框架,通过结构感知剪枝提升Long-CoT推理效率,发现验证剪枝在保持准确性的同时减少令牌使用,揭示剪枝与模型容量对齐的重要性。

Comments 19 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21250 2025-12-25 cs.CR cs.MA 82%

CoTDeceptor:Adversarial Code Obfuscation Against CoT-Enhanced LLM Code Agents

CoTDeceptor:对抗增强CoT的LLM代码代理的对抗性代码混淆

Haoyang Li, Mingjin Li, Jinxin Zuo, Siqi Li, Xiao Li, Hao Wu, Yueming Lu, Xiaochuan He

专题命中 逻辑推理 :CoT(title,abstract);reasoning(abstract)

AI总结 CoTDeceptor通过构建多阶段混淆策略链,有效对抗增强CoT的LLM检测器,实现对14个漏洞类别的绕过。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20812 2025-12-25 cs.CL 79%

Semantic Deception: When Reasoning Models Can't Compute an Addition

语义欺骗:当推理模型无法计算加法时

Nathaniël de Leeuw, Marceau Nahon, Mathis Reymond, Raja Chatila, Mehdi Khamassi

机构 * Institute of Intelligent Systems and Robotics(智能系统与机器人研究所) CNRS(法国国家科学研究中心) Sorbonne University(索邦大学) Paris Cité University(巴黎城市大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 研究发现LLMs在面对语义欺骗时表现不佳,揭示其在符号操作上的局限性及对表面语义的依赖。

Comments 22 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20664 2025-12-25 cs.AI cs.LO 79%

Eidoku: A Neuro-Symbolic Verification Gate for LLM Reasoning via Structural Constraint Satisfaction

Eidoku:一种通过结构约束满足的神经符号验证门用于LLM推理

Shinobu Miya

机构 * Independent Researcher(独立研究者)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 Eidoku通过结构约束满足方法有效检测LLM推理中的结构不一致幻觉,提供神经符号验证机制。

详情

展开后加载摘要…

URL PDF HTML 收藏