arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-01-16 至 2026-01-16 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 11 篇

2503.17523 2026-01-16 cs.CL cs.AI 81%

Bayesian Teaching Enables Probabilistic Reasoning in Large Language Models

贝叶斯教学使大语言模型具备概率推理能力

Linlu Qiu, Fei Sha, Kelsey Allen, Yoon Kim, Tal Linzen, Sjoerd van Steenkiste

机构 * MIT(麻省理工学院) Meta Google(谷歌公司) DeepMind University of British Columbia(不列颠哥伦比亚大学深度思维学院) Vector Institute(向量研究所) New York University(纽约大学) Google Research(谷歌研究)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 通过教学使大语言模型模仿贝叶斯模型预测,提升其概率推理能力并推广至新任务。

Comments Nature Communications

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09855 2026-01-16 cs.AI cs.CL 81%

Thinking Long, but Short: Stable Sequential Test-Time Scaling for Large Reasoning Models

深入思考,但简短:大型推理模型的稳定序列测试时间扩展

Michael R. Metel, Yufei Cui, Boxing Chen, Prasanna Parthasarathi

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出Min-Seek方法,通过高效管理KV缓存实现大型推理模型在扩展推理长度时的稳定性与准确性提升。

Comments Findings of EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10332 2026-01-16 cs.CV 78%

Think-Then-Generate: Reasoning-Aware Text-to-Image Diffusion with LLM Encoders

思考-然后-生成:基于LLM编码器的推理感知文本到图像扩散模型

Siqi Kou, Jiachun Jin, Zetong Zhou, Ye Ma, Yugang Wang, Quan Chen, Peng Jiang, Xiao Yang, Jun Zhu, Kai Yu, Zhijie Deng

机构 * Shanghai Jiao Tong University(上海交通大学) Kuaishou Technology(快手科技) Tsinghua University(清华大学)

专题命中 其他推理 :reasoning(title,abstract)

AI总结 本文提出基于LLM编码器的推理感知文本到图像扩散模型,通过推理重写提示提升生成质量,达到接近GPT-4的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10274 2026-01-16 cs.LG cs.AI cs.IT cs.NI math.IT math.OC 76%

Queueing-Aware Optimization of Reasoning Tokens for Accuracy-Latency Trade-offs in LLM Servers

面向队列的推理令牌优化:在LLM服务器中准确率与延迟的权衡

Emre Ozbas, Melih Bastopcu

机构 * Department of Electrical and Electronics Engineering(电气与电子工程系)

专题命中 其他推理 :reasoning(title);分类 cs.AI、cs.LG

AI总结 本文提出了一种面向队列的推理令牌优化方法,通过优化LLM服务器中准确率与延迟的权衡,提升系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10058 2026-01-16 cs.LG 70%

Unlabeled Data Can Provably Enhance In-Context Learning of Transformers

未标记数据可以证明性地增强Transformer的上下文学习

Renpu Liu, Jing Yang

机构 * University of Virginia(弗吉尼亚大学)

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract);分类 cs.LG

AI总结 本文提出了一种增强ICL框架,通过结合标记和未标记数据,利用CoT提示使Transformer模拟EM算法,从而证明性地提升ICL性能。

Comments Published as a conference paper at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23773 2026-01-16 cs.LG cs.AI cs.CL cs.SI 67%

Knowledge Homophily in Large Language Models

大型语言模型中的知识同质性

Utkarsh Sahu, Zhisheng Qi, Mahantesh Halappanavar, Nedim Lipka, Ryan A. Rossi, Franck Dernoncourt, Yu Zhang, Yao Ma, Yu Wang

机构 * University of Oregon Eugene OR USA Pacific Northwest National Laboratory Richland WA USA Adobe Research San Jose CA USA Texas A\&M University College Station TX USA Rensselaer Polytechnic Institute Troy NY USA University of Oregon Pacific Northwest National Laboratory Adobe Research Texas A\&M University Rensselaer Polytechnic Institute

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种基于图神经网络的模型,通过分析LLM知识的同质性,提高知识标注效率和推理问答性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03296 2026-01-16 cs.DC 67%

APEX: Asynchronous Parallel CPU-GPU Execution for Online LLM Inference on Constrained GPUs

APEX:异步并行CPU-GPU执行用于受限GPU上的在线LLM推理

Jiakun Fan, Yanglin Zhang, Xiangchen Li, Dimitrios S. Nikolopoulos

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract)

AI总结 APEX通过动态调度策略提升受限GPU上的LLM推理效率,提高吞吐量并保持延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10112 2026-01-16 cs.SE cs.AI 57%

Repository Intelligence Graph: Deterministic Architectural Map for LLM Code Assistants

仓库智能图:用于LLM代码助手的确定性架构图

Tsvi Cherny-Shahar, Amiram Yehudai

机构 * Blavatnik School of Computer Science Tel Aviv University(布拉瓦特尼克计算机科学学院特拉维夫大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本研究提出仓库智能图(RIG)以提升LLM代码助手的构建和测试结构理解能力,通过确定性架构图和SPADE提取器实现结构化问题解答的准确性与效率提升。

Comments 35 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09971 2026-01-16 cs.LG 57%

An Exploratory Study to Repurpose LLMs to a Unified Architecture for Time Series Classification

一项探索性研究:将大语言模型重新利用到时间序列分类的统一架构中

Hansen He, Shuheng Li

机构 * Canyon Crest Academy(山崖顶学术院) UC San Diego(圣迭戈大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本研究探索了将大语言模型与时间序列编码器结合的混合架构,发现Inception模型在提升性能方面表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09929 2026-01-16 cs.AI 57%

Hallucination Detection and Mitigation in Large Language Models

大语言模型中的幻觉检测与缓解

Ahmad Pesaranghader, Erin Li

机构 * CIBC(加拿大帝国商业银行)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出了一种系统化的框架,通过分层架构和闭环反馈机制,提升大语言模型在金融等高风险领域的可靠性,减少幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10093 2026-01-16 cs.SE 50%

Mark My Works Autograder for Programming Courses

标记我的作品编程课程自动评分系统

Yiding Qiu, Seyed Mahdi Azimi, Artem Lensky

专题命中 其他推理 :reasoning(abstract)

AI总结 Mark My Works通过结合传统单元测试与大语言模型生成解释,为编程课程提供更详细的自动评分和教学反馈。

详情

展开后加载摘要…

URL PDF HTML 收藏