arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-13 至 2026-02-13 共收录 9 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 9 篇

2602.11530 2026-02-13 cs.LG cs.AR 85%

PASCAL: A Phase-Aware Scheduling Algorithm for Serving Reasoning-based Large Language Models

PASCAL:一种面向推理型大语言模型的服务调度算法

Eunyeong Cho, Jehyeon Bang, Ranggi Hwang, Minsoo Rhu

机构 * KAIST(韩国科学技术院)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.LG

AI总结 PASCAL通过优先处理推理阶段和控制回答阶段的令牌节奏,有效降低了推理型大语言模型的TTFT并保持服务等级目标。

Comments Accepted for publication at the 32nd IEEE International Symposium on High-Performance Computer Architecture (HPCA-32), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12013 2026-02-13 cs.AI 79%

InjectRBP: Steering Large Language Model Reasoning Behavior via Pattern Injection

InjectRBP: 通过模式注入引导大语言模型推理行为

Xiuping Wu, Zhao Yu, Yuxin Cheng, Ngai Wong, Liangjun Ke, Tapas Mishra, Konstantinos V. Katsikopoulos

机构 * Xi'an Jiaotong University(西安交通大学) University of Southampton(南安普顿大学) University of Hongkong(香港大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 InjectRBP通过注入行为模式提升大语言模型推理能力,无需参数更新,实验显示在多种推理任务中性能提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11455 2026-02-13 cs.AI 79%

Credit Where It is Due: Cross-Modality Connectivity Drives Precise Reinforcement Learning for MLLM Reasoning

应得之 credit:跨模态连接驱动精确强化学习用于 MLLM 推理

Zhengbo Jiao, Shaobo Wang, Zifan Zhang, Wei Wang, Bing Zhao, Hu Wei, Linfeng Zhang

机构 * AI DATA, Alibaba Group Holding Limited(阿里数据,阿里巴巴集团控股有限公司) EPIC Lab, SJTU(EPIC实验室,上海交通大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 通过跨模态连接驱动精确强化学习,提升多模态大语言模型的推理能力,仅引入1.2%开销即超越基线模型。

Comments 20pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12064 2026-02-13 cs.DB 78%

DIVER: A Robust Text-to-SQL System with Dynamic Interactive Value Linking and Evidence Reasoning

DIVER: 一种具有动态交互值链接和证据推理的鲁棒文本到SQL系统

Yafeng Nan, Haifeng Sun, Zirui Zhuang, Qi Qi, Guojun Chu, Jianxin Liao, Dan Pei, Jingyu Wang

专题命中 其他推理 :reasoning(title,abstract)

AI总结 DIVER通过动态交互值链接和证据推理,提升文本到SQL系统的鲁棒性,实验显示其在执行准确率和验证效率分数上均有显著提升。

Comments Accepted by SIGMOD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12108 2026-02-13 cs.AI 57%

The Pensieve Paradigm: Stateful Language Models Mastering Their Own Context

Pensieve范式:具备状态的语言模型掌握自身上下文

Xiaoyuan Liu, Tian Liang, Dongyang Ma, Deyu Zhou, Haitao Mi, Pinjia He, Yan Wang

机构 * Tencent AI Lab(腾讯人工智能实验室) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 StateLM 通过内部推理循环和记忆工具,使语言模型具备状态管理能力,从而在长文档问答、聊天记忆和深度研究任务中取得显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11651 2026-02-13 cs.CR cs.AI 57%

DMind-3: A Sovereign Edge--Local--Cloud AI System with Controlled Deliberation and Correction-Based Tuning for Safe, Low-Latency Transaction Execution

DMind-3:一种主权边缘-本地-云AI系统,具备受控推理与基于纠正的调优,用于安全低延迟交易执行

Enhao Huang, Frank Li, Tony Lin, Lowes Yang

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 DMind-3通过边缘-本地-云三层架构,结合受控推理与纠正调优,实现安全低延迟的交易执行,提升金融执行的可靠性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11241 2026-02-13 cs.CV cs.LG 57%

Active Zero: Self-Evolving Vision-Language Models through Active Environment Exploration

主动零:通过主动环境探索实现自我进化的视觉-语言模型

Jinghan He, Junfeng Fang, Feng Xiong, Zijun Yao, Fei Shen, Haiyun Guo, Jinqiao Wang, Tat-Seng Chua

机构 * Foundation Model Research Center, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所基础模型研究中心) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) National University of Singapore(新加坡国立大学) Wuhan AI Research(武汉人工智能研究所) Tsinghua University(清华大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 Active-Zero通过主动环境探索实现视觉-语言模型的自我进化,提升推理和理解任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03192 2026-02-13 cs.CL 57%

MemRL: Self-Evolving Agents via Runtime Reinforcement Learning on Episodic Memory

MemRL: 通过运行时强化学习在事件记忆上实现自我进化代理

Shengtao Zhang, Jiaqian Wang, Ruiwen Zhou, Junwei Liao, Yuchen Feng, Zhuo Li, Yujie Zheng, Weinan Zhang, Ying Wen, Zhiyu Li, Feiyu Xiong, Yutao Qi, Bo Tang, Muning Wen

机构 * Shanghai Jiao Tong University, Shanghai, China(上海交通大学) Xidian University, Xi'an, China(西安电子科技大学) National University of Singapore, Singapore(新加坡国立大学) Shanghai Innovation Institute, Shanghai, China(上海创新研究院) MemTensor (Shanghai) Technology Co., Ltd., Shanghai, China(MemTensor(上海)科技有限公司) University of Science and Technology of China, Hefei, China(中国科学技术大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 MemRL通过运行时强化学习在事件记忆上实现自我进化,解决稳定性与可塑性矛盾,实现持续改进。

Comments 41 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11223 2026-02-13 cs.SE cs.HC 50%

Patient Digital Twins for Chronic Care: Technical Hurdles, Lessons Learned, and the Road Ahead

慢性病护理中的患者数字双胞胎:技术障碍、经验教训与未来之路

Micheal P. Papazoglou, Bernd J. Krämer, Mira Raheem, Amal Elgammal

专题命中 其他推理 :reasoning(abstract)

AI总结 本文探讨了患者医疗数字双胞胎在慢性病护理中的技术挑战与未来发展方向,提出了基于本体驱动建模和联邦分析的实施方法,并强调了标准对齐、隐私治理和多模态推理等关键技术。

Comments Feature Article, Patient Medical Digital Twins, Under Review in IEEE SOftware

详情

展开后加载摘要…

URL PDF HTML 收藏