arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-25 至 2026-02-25 共收录 8 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 8 篇

2601.19001 2026-02-25 cs.CL cs.AI cs.LG 82%

FROST: Filtering Reasoning Outliers with Attention for Efficient Reasoning

FROST:利用注意力过滤异常以实现高效推理

Haozheng Luo, Zhuolin Jiang, Md Zahid Hasan, Yan Chen, Soumalya Sarkar

机构 * Department of Computer Science, Northwestern University, Evanston, IL 60208 USA(西北大学计算机科学系) RTX Technology Research Center (RTRC), East Hartford, CT 06118 USA(RTX技术研究中心) Department of Electrical and Computer Engineering, Iowa State University, Ames, IA 50011 USA(爱荷华州立大学电气与计算机工程系)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 FROST通过引入注意力机制过滤推理异常,提升推理效率和准确性,减少token使用并提高模型性能。

Comments International Conference on Learning Representations (ICLR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17645 2026-02-25 cs.CV cs.AI cs.CL cs.LG cs.MM 82%

HoloLLM: Multisensory Foundation Model for Language-Grounded Human Sensing and Reasoning

HoloLLM:面向语言基础的人感知与推理的多感官基础模型

Chuhao Zhou, Jianfei Yang

机构 * MARS Lab, Nanyang Technological University(南洋理工大学MARS实验室)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 HoloLLM通过整合LiDAR、红外、毫米波雷达和Wi-Fi等多感官数据,提升语言基础的人感知与推理能力,实验表明其在真实场景中的性能提升达30%。

Comments Camera-ready version. Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20966 2026-02-25 cs.CL 57%

Blackbird Language Matrices: A Framework to Investigate the Linguistic Competence of Language Models

黑鸟语言矩阵:一种研究语言模型语言能力的框架

Paola Merlo, Chunyang Jiang, Giuseppe Samo, Vivi Nastase

机构 * Idiap Research Institute(Idiap研究机构) University of Geneva(日内瓦大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 黑鸟语言矩阵通过结构化数据集研究语言模型的语言能力与系统性模式识别

Comments Under review, 46 pages, 5 tables, 28 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14044 2026-02-25 cs.CL 57%

Context Shapes LLMs Retrieval-Augmented Fact-Checking Effectiveness

上下文影响基于LLM的检索增强事实核查效果

Pietro Bernardelle, Stefano Civelli, Kevin Roitero, Gianluca Demartini

机构 * The University of Queensland(昆士兰大学) University of Udine(乌迪内大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本研究探讨了上下文对LLM检索增强事实核查效果的影响,发现上下文长度和证据位置显著影响验证准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05182 2026-02-25 cs.CL 57%

The Single-Multi Evolution Loop for Self-Improving Model Collaboration Systems

单一-多进化循环用于自我改进的模型协作系统

Shangbin Feng, Kishan Panaganti, Yulia Tsvetkov, Wenhao Yu

机构 * University of Washington(华盛顿大学) Tencent AI Seattle Lab(腾讯AI西雅图实验室)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出单一-多进化循环,通过模型协作与蒸馏实现自我改进,提升模型性能与效率。

Comments Code at https://github.com/BunsenFeng/moco_distill

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12007 2026-02-25 cs.IR cs.AI 57%

Diffusion Generative Recommendation with Continuous Tokens

基于连续令牌的扩散生成推荐

Haohao Qu, Shanru Lin, Yujuan Ding, Yiqi Wang, Wenqi Fan

机构 * The Hong Kong Polytechnic University(香港理工大学) City University of Hong Kong(香港城市大学) National University of Defense Technology(国防科技大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 ContRec通过整合连续令牌和扩散模型,提升基于LLM的推荐系统性能。

Comments Accepted by The ACM Web Conference (WWW 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19275 2026-02-25 cs.CR 50%

KUDA: Knowledge Unlearning by Deviating Representation for Large Language Models

KUDA: 通过偏离表示进行大语言模型的知识卸载

Ce Fang, Zhikun Zhang, Min Chen, Qing Liu, Lu Zhou, Zhe Liu, Yunjun Gao

专题命中 其他推理 :reasoning(abstract)

AI总结 KUDA通过偏离表示方法实现大语言模型的知识卸载,有效平衡知识移除与模型实用性保留。

Comments 24 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02002 2026-02-25 cs.RO 50%

LLM-Driven Corrective Robot Operation Code Generation with Static Text-Based Simulation

基于大型语言模型的纠正性机器人操作代码生成与静态文本模拟

Wenhao Wang, Yi Rong, Yanyan Li, Long Jiao, Jiawei Yuan

机构 * Department of CIS, University of Massachusetts Dartmouth(大学马萨诸塞州达特茅斯分校计算机信息科学系) Department of CSIS, California State University San Marcos(加州州立大学桑马科斯分校计算机科学与信息系统系)

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出了一种基于LLM的纠正性机器人操作代码生成框架,利用静态文本模拟提升代码生成的可靠性,无需依赖动态执行环境。

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏