arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-01-08 至 2026-01-08 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 6 篇

2601.03649 2026-01-08 cs.CL 85%

SyncThink: A Training-Free Strategy to Align Inference Termination with Reasoning Saturation

SyncThink: 一种无需训练的策略,用于将推理饱和与推理终止对齐

Gengyang Li, Wang Cai, Yifeng Gao, Yunfang Wu

机构 * National Key Laboratory for Multimedia Information Processing, Peking University(北京大学多媒体信息处理国家级重点实验室) School of Software and Microelectronics, Peking University(北京大学软件与微电子学院) School of Computer Science, Peking University(北京大学计算机科学学院)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

AI总结 SyncThink是一种无需训练的解码方法,通过监控模型自身的推理过渡信号来终止推理,从而减少CoT的开销并提高推理效率。

Comments 14 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03542 2026-01-08 cs.CL cs.AI 84%

Layer-Order Inversion: Rethinking Latent Multi-Hop Reasoning in Large Language Models

层序倒置:重新思考大语言模型中的潜在多跳推理

Xukai Liu, Ye Liu, Jipeng Zhang, Yanghai Zhang, Kai Zhang, Qi Liu

机构 * State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) University of Science and Technology of China(中国科学技术大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 本文提出"层序倒置"现象,通过概率性回忆与提取框架解释大语言模型中多跳推理的机制,揭示了层序倒置与总跳步数的关系,并提供了多跳失败的诊断方法。

Comments 16 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03534 2026-01-08 cs.CL cs.CV cs.HC cs.LG 73%

Persona-aware and Explainable Bikeability Assessment: A Vision-Language Model Approach

具有人格意识和可解释性的自行车适应性评估:一种视觉-语言模型方法

Yilong Dai, Ziyi Wang, Chenguang Wang, Kexin Zhou, Yiheng Qian, Susu Xu, Xiang Yan

机构 * University of Alabama(阿拉巴马大学) University of Maryland, College Park(马里兰大学学院公园分校) Stony Brook University(石溪大学) University of Florida(佛罗里达大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.LG

AI总结 本文提出一种视觉-语言模型框架,通过人格意识和可解释性方法评估自行车适应性,解决道路环境复杂性和用户感知异质性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06640 2026-01-08 cs.CL cs.LG 62%

A Comparative Analysis of Contextual Representation Flow in State-Space and Transformer Architectures

状态空间与变换器架构中上下文表示流的比较分析

Nhat M. Hoang, Do Xuan Long, Cong-Duy Nguyen, Min-Yen Kan, Luu Anh Tuan

机构 * Nanyang Technological University(南洋理工大学) National University of Singapore(国立新加坡大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 本文比较了状态空间与变换器架构中上下文表示流,揭示了两者在表示传播和过度平滑机制上的差异,为长上下文推理模型设计提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03914 2026-01-08 cs.CL 57%

When Models Decide and When They Bind: A Two-Stage Computation for Multiple-Choice Question-Answering

当模型决策时与当它们绑定时:多选题问答的两阶段计算

Hugh Mee Wong, Rick Nouwen, Albert Gatt

机构 * Utrecht University(乌特勒支大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文研究了多选题问答中模型如何通过两阶段机制先在内容空间选择胜者,再绑定到输出符号。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03500 2026-01-08 cs.CV cs.AI 57%

SDCD: Structure-Disrupted Contrastive Decoding for Mitigating Hallucinations in Large Vision-Language Models

SDCD: 结构破坏对比解码用于缓解大视觉-语言模型中的幻觉

Yuxuan Xia, Siheng Wang, Peng Li

机构 * University of California, Santa Barbara(加州大学圣巴巴拉分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 SDCD通过结构破坏对比解码缓解大视觉-语言模型中的幻觉问题,有效抑制纹理驱动偏见,提升多模态能力。

详情

展开后加载摘要…

URL PDF HTML 收藏