arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-09-17 至 2025-09-17 共收录 7 信号源:cs.CL, cs.AI, cs.LG

1. 复杂问题求解 7 篇

2509.13237 2025-09-17 cs.LG cs.AI 81%

Metacognitive Reuse: Turning Recurring LLM Reasoning Into Concise Behaviors

Aniket Didolkar, Nicolas Ballas, Sanjeev Arora, Anirudh Goyal

机构 * Meta Mila-Quebec AI Institute, University of Montreal(魁北克AI研究所,蒙特利尔大学) Princeton University(普林斯顿大学) Mila--Quebec AI Institute, Université de Montréal(魁北克AI研究所,蒙特利尔大学)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments 18 pages, 9 Figures, 5 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11067 2025-09-17 cs.AI cs.HC cs.MA 74%

Agentic Lybic: Multi-Agent Execution System with Tiered Reasoning and Orchestration

Liangxuan Guo, Bin Zhu, Qingqian Tao, Kangning Liu, Xun Zhao, Xianzhe Qin, Jin Gao, Guangfu Hao

机构 * Lybic

专题命中 复杂问题求解 :reasoning(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13081 2025-09-17 cs.CL cs.AI 62%

Shaping Explanations: Semantic Reward Modeling with Encoder-Only Transformers for GRPO

Francesco Pappone, Ruggero Marino Lazzaroni, Federico Califano, Niccolò Gentile, Roberto Marras

机构 * AI Sparks(AI火花) University of Graz(格拉茨大学) Foyer Group(Foyer集团) Onepix Academy(Onepix学院)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10596 2025-09-17 cs.AI cs.LG q-bio.NC 62%

Overcoming classic challenges for artificial neural networks by providing incentives and practice

Kazuki Irie, Brenden M. Lake

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI、cs.LG

Comments In press at Nature Machine Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13310 2025-09-17 cs.CL 57%

Scaling Agents via Continual Pre-training

Liangcai Su, Zhen Zhang, Guangyu Li, Zhuo Chen, Chenxi Wang, Maojia Song, Xinyu Wang, Kuan Li, Jialong Wu, Xuanzhong Chen, Zile Qiao, Zhongwang Zhang, Huifeng Yin, Shihao Cai, Runnan Fang, Zhengwei Tao, Wenbiao Yin, Chenxiong Qian, Yong Jiang, Pengjun Xie, Fei Huang, Jingren Zhou

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

Comments https://tongyi-agent.github.io/blog/introducing-tongyi-deep-research/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12867 2025-09-17 cs.LG cs.CV 57%

Tool-R1: Sample-Efficient Reinforcement Learning for Agentic Tool Use

Yabo Zhang, Yihan Zeng, Qingyun Li, Zhen Hu, Kavin Han, Wangmeng Zuo

机构 * Harbin Institute of Technology(哈尔滨工业大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12810 2025-09-17 cs.AI 57%

H$^2$R: Hierarchical Hindsight Reflection for Multi-Task LLM Agents

Shicheng Ye, Chao Yu, Kaiqiang Ke, Chengdong Xu, Yinqi Wei

机构 * Sun Yat-sen University(中山大学) The University of Sydney(悉尼大学)

专题命中 复杂问题求解 :planning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏