arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-01-16 至 2026-01-16 共收录 10 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 10 篇

2601.10342 2026-01-16 cs.AI 79%

C-GRASP: Clinically-Grounded Reasoning for Affective Signal Processing

C-GRASP:基于临床的感知信号处理推理

Cheng Lin Cheng, Ting Chuan Lin, Chai Kai Chang

机构 * Department of Physics National Central University(物理系国立中央大学) Center for Education National Central University(教育中心国立中央大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 C-GRASP通过临床基础推理提升情感信号处理的准确性与临床一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10222 2026-01-16 cs.AI 79%

Compartmentalised Agentic Reasoning for Clinical NLI

临床自然语言推理中的 compartmentalised agentic 推理

Maël Jullien, Lei Xu, Marco Valentino, André Freitas

机构 * Department of Computer Science, University of Manchester, UK(曼彻斯特大学计算机科学系) National Biomarker Centre, CRUK-MI, University of Manchester, UK(曼彻斯特大学国家生物标记中心) Idiap Research Institute, Switzerland(日内瓦IDIAP研究所) School of Computer Science, University of Sheffield, UK(谢菲尔德大学计算机科学系) École Polytechnique Fédérale de Lausanne (EPFL), Switzerland(洛桑联邦理工学院(EPFL))

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 CARENLI 通过 compartmentalisation 和验证提升临床自然语言推理的准确率,从 23% 提高到 57%

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10148 2026-01-16 cs.AI 70%

DecisionLLM: Large Language Models for Long Sequence Decision Exploration

DecisionLLM: 用于长序列决策探索的大型语言模型

Xiaowei Lv, Zhilin Zhang, Yijun Li, Yusen Huo, Siyuan Ju, Xuyan Li, Chunxiang Hong, Tianyu Wang, Yongcai Wang, Peng Sun, Chuan Yu, Jian Xu, Bo Zheng

机构 * Renmin University of China, Beijing China(中国人民大学) Alibaba Group, Beijing, China(阿里巴巴集团)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 DecisionLLM基于Transformer架构,通过将轨迹视为独立模态,解决LLMs在连续值解释上的不足,实现长序列决策任务的高性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09858 2026-01-16 cs.CL cs.AI cs.LG 67%

OUTLINEFORGE: Hierarchical Reinforcement Learning with Explicit States for Scientific Writing

OUTLINEFORGE: 基于显式状态的分层强化学习用于科学写作

Yilin Bao, Ziyao He, Zayden Yang

机构 * UC San Diego(圣迭戈大学) Ohio State University(俄亥俄州立大学)

专题命中 规划推理 :planning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 OUTLINEFORGE通过分层强化学习和显式状态管理,提升科学写作的全局结构和引用一致性,改进文档规划和事实准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11788 2026-01-16 cs.CL cs.AI 62%

WebRollback: Enhancing Web Agents with Explicit Rollback Mechanisms

WebRollback: 通过显式回滚机制增强网络代理

Zhisong Zhang, Tianqing Fang, Kaixin Ma, Wenhao Yu, Hongming Zhang, Haitao Mi, Dong Yu

机构 * City University of Hong Kong(香港城市大学) Tencent AI Lab(腾讯人工智能实验室)

专题命中 规划推理 :planning(abstract);分类 cs.CL、cs.AI

AI总结 通过显式回滚机制提升网络代理的导航效率与灵活性

Comments EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09770 2026-01-16 cs.AI 57%

GUI-Eyes: Tool-Augmented Perception for Visual Grounding in GUI Agents

GUI-Eyes: 用于GUI代理视觉接地的工具增强感知

Chen Chen, Jiawei Shao, Dakuan Lu, Haoyi Hu, Xiangcheng Liu, Hantao Yao, Wu Liu

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 GUI-Eyes通过分阶段策略推理和细粒度奖励反馈实现工具感知主动感知,显著提升GUI代理的接地准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09755 2026-01-16 cs.NE cs.AI cs.RO 57%

Heterogeneous computing platform for real-time robotics

异构计算平台用于实时机器人

Jakub Fil, Yulia Sandamirskaya, Hector Gonzalez, Loïc Azzalin, Stefan Glüge, Lukas Friedenstab, Friedrich Wolf, Tim Rosmeisl, Matthias Lohrmann, Mahmoud Akl, Khaleel Khan, Leonie Wolf, Kristin Richter, Holm Puder, Mazhar Ali Bari, Xuan Choo, Noha Alharthi, Michael Hopkins, Mansoor Hanif Christian Mayr, Jens Struckmeier, Steve Furber

机构 * WAIYS GmbH(WAIYS公司) Zurich University of Applied Sciences(苏黎世应用科学大学) SpiNNcloud Systems GmbH(SpiNNcloud系统公司) TU Dresden(德累斯顿技术大学) Applied Brain Research(应用脑科研) NEOM The University of Manchester(曼彻斯特大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出一种异构计算平台,结合神经形态计算硬件与AI计算集群,用于实时机器人感知与交互任务,提升机器人自主性和智能水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09100 2026-01-16 cs.AI 57%

DScheLLM: Enabling Dynamic Scheduling through a Fine-Tuned Dual-System Large language Model

DScheLLM:通过微调双系统大语言模型实现动态调度

Lixiang Zhang, Chenggong Zhao, Qing Gao, Xiaoke Zhao, Gengyi Bai, Jinhu Lv

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 DScheLLM通过微调双系统大语言模型,首次在动态环境中应用大语言模型解决作业车间调度问题,展示其在智能调度优化中的潜力。

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10123 2026-01-16 cs.MA 50%

Fairness Driven Multi-Agent Path Finding Problem

基于公平性的多智能体路径寻找问题

Aditi Anand, Dildar Ali, Suman Banerjee

专题命中 规划推理 :planning(abstract)

AI总结 本文提出基于公平性的多智能体路径寻找问题解决方案,针对理性与非理性智能体分别设计机制和启发式方法,确保激励相容与个体理性。

Comments This paper has been accepted in the 18th International Conference on Agents and Artificial Intelligence (ICCART 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20412 2026-01-16 cs.CR 50%

MindGuard: Intrinsic Decision Inspection for Securing LLM Agents Against Metadata Poisoning

MindGuard:内在决策检查用于保护LLM代理免受元数据中毒攻击

Zhiqiang Wang, Haohua Du, Guanquan Shi, Junyang Zhang, HaoRan Cheng, Yunhao Yao, Kaiwen Guo, Xiang-Yang Li

专题命中 规划推理 :reasoning(abstract)

AI总结 MindGuard通过决策依赖图检测和归因LLM代理中的元数据中毒攻击,实现高精度的污染调用检测与溯源。

详情

展开后加载摘要…

URL PDF HTML 收藏