arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 45515 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11120 篇

2601.12842 2026-01-21 cs.AI cs.LG 81%

SCULPT: Constraint-Guided Pruned MCTS that Carves Efficient Paths for Mathematical Reasoning

SCULPT:基于约束的剪枝MCTS,为数学推理 carve 高效路径

Qitong Fang, Haotian Li, Xu Wang

机构 * Jilin Jianzhu University(吉林建筑大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 SCULPT通过引入约束引导的剪枝MCTS方法,提升数学推理的效率和准确性,同时保持稳定性。

Comments 11 pages, 3 figures. Equal contribution: Qitong Fang and Haotian Li. Corresponding authors: Qitong Fang (fangqitong@student.jlju.edu.cn), Haotian Li (lihaotian@student.jlju.edu.cn), Xu Wang (wangxu@jlju.edu.cn)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12269 2026-01-21 cs.CL cs.AI 81%

Simulated Annealing Enhances Theory-of-Mind Reasoning in Autoregressive Language Models

退火模拟增强语言模型的理论思维推理

Xucong Hu, Jian-Qiao Zhu

机构 * Department of Psychology and Behavioral Sciences, Zhejiang University(浙江大学心理学与行为科学系) Department of Psychology, The University of Hong Kong(香港大学心理学系)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 通过退火模拟提升自回归语言模型的理论思维推理能力,无需额外训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06534 2026-01-19 cs.AI cs.LG 81%

Beneficial Reasoning Behaviors in Agentic Search and Effective Post-training to Obtain Them

代理搜索中的有益推理行为及有效训练以获得这些行为

Jiahe Jin, Abhijay Paladugu, Chenyan Xiong

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出行为引导方法,通过预训练使代理搜索模型具备信息验证、权威评估等有益推理行为,从而在强化学习前提升任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08185 2026-01-14 cond-mat.mtrl-sci cs.AI cs.LG cs.MA physics.comp-ph 81%

Autonomous Materials Exploration by Integrating Automated Phase Identification and AI-Assisted Human Reasoning

通过整合自动化相识别和AI辅助的人类推理实现自主材料探索

Ming-Chiang Chang, Maximilian Amsler, Duncan R. Sutherland, Sebastian Ament, Katie R. Gann, Lan Zhou, Louisa M. Smieska, Arthur R. Woll, John M. Gregoire, Carla P. Gomes, R. Bruce van Dover, Michael O. Thompson

机构 * Department of Materials Science and Engineering, Cornell University, Ithaca, NY 14853, United States(材料科学与工程系,康奈尔大学,Ithaca, NY 14853, United States) Department of Computer Science, Cornell University, Ithaca, NY 14853, United States(计算机科学系,康奈尔大学,Ithaca, NY 14853, United States) Joint Center for Artificial Photosynthesis, California Institute of Technology, Pasadena, CA 91125(人工光合作研究中心,加州理工学院,Pasadena, CA 91125) Cornell High Energy Synchrotron Source, Cornell University, Ithaca, NY 14850, United States(康奈尔高能同步辐射源,康奈尔大学,Ithaca, NY 14850, United States)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 通过整合自动化相识别和AI辅助的人类推理,实现自主材料探索,提升材料合成效率和发现新材料的能力。

Comments Main manuscript: 21 pages(including references), 6 figures. Supplementary Information: 12 pages, 9 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02962 2026-01-14 cs.CL cs.AI cs.IR 81%

RAG-R1: Incentivizing the Search and Reasoning Capabilities of LLMs through Multi-query Parallelism

RAG-R1:通过多查询并行性激励大语言模型的搜索与推理能力

Zhiwen Tan, Jiaming Huang, Qintong Wu, Hongxuan Zhang, Chenyi Zhuang, Jinjie Gu

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 RAG-R1通过多查询并行性提升大语言模型的搜索与推理能力,实验显示其在问答基准中性能优于基线方法,推理效率提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07782 2026-01-13 cs.CL cs.AI cs.IR 81%

Beyond Single-Shot: Multi-step Tool Retrieval via Query Planning

超越单次检索:通过查询规划实现多步工具检索

Wei Fang, James Glass

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出TOOLQP框架,通过迭代查询规划解决多步工具检索问题,实现更高效的检索和执行能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07296 2026-01-13 cs.AI cs.CL 81%

LRAS: Advanced Legal Reasoning with Agentic Search

LRAS: 基于代理搜索的先进法律推理

Yujin Zhou, Chuxue Cao, Jinluan Yang, Lijun Wu, Conghui He, Sirui Han, Yike Guo

机构 * Hong Kong University of Science and Technology(香港科技大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 LRAS通过整合反思模仿学习和难度感知强化学习,使大推理模型能够识别知识边界并处理法律推理的复杂性,从而在法律领域取得显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14211 2026-01-08 cs.CL cs.AI 81%

LiteStage: Latency-aware Layer Skipping for Multi-stage Reasoning

LiteStage: 低延迟层跳过用于多阶段推理

Beomseok Kang, Jiwon Song, Jae-Joon Kim

机构 * Seoul National University(首尔国立大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 LiteStage通过低延迟层跳过框架提升多阶段推理效率,有效解决阶段间跳过敏感性和冗余输出问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00003 2026-01-05 cs.AI cs.CL 81%

Reasoning in Action: MCTS-Driven Knowledge Retrieval for Large Language Models

行动中的推理:基于MCTS的知识检索用于大语言模型

Shuqi Liu, Bowei He, Chen Ma, Linqi Song

机构 * City University of Hong Kong(香港城市大学) City University of Hong Kong Shenzhen Research Institute(香港城市大学深圳研究院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种基于MCTS的知识检索方法,通过增强LLM与对话逻辑结构的对齐,提升多轮对话中的推理能力和响应多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.13461 2025-12-30 cs.LG cs.AI cs.CV cs.NE q-bio.NC 81%

Active Predictive Coding: A Unified Neural Framework for Learning Hierarchical World Models for Perception and Planning

主动预测编码:一种统一的神经框架,用于学习感知与规划的分层世界模型

Rajesh P. N. Rao, Dimitrios C. Gklezakos, Vishwas Sathish

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出主动预测编码框架,通过分层世界模型解决人工智能中感知与规划的两大核心问题。

Comments 15 pages, 10 figures, 2 supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19864 2025-12-29 cs.CL cs.AI 81%

HARMON-E: Hierarchical Agentic Reasoning for Multimodal Oncology Notes to Extract Structured Data

HARMON-E:多模态肿瘤病历的分层代理推理以提取结构化数据

Shashi Kant Gupta, Arijeet Pramanik, Jerrin John Thomas, Regina Schwind, Lauren Wiener, Avi Raju, Jeremy Kornbluth, Yanshan Wang, Zhaohui Su, Hrituraj Singh

机构 * Triomics University of Pittsburgh(匹兹堡大学) Ontada

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 HARMON-E通过分层代理推理框架,实现对多模态肿瘤病历的结构化数据提取,达到高精度和大规模应用。

Comments 39 Pages, Supplementary Included

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17912 2025-12-23 cs.CL cs.AI 81%

Graph-O1 : Monte Carlo Tree Search with Reinforcement Learning for Text-Attributed Graph Reasoning

Graph-O1:基于强化学习的蒙特卡洛树搜索用于文本属性图推理

Lihui Liu

机构 * Wayne State University(韦恩州立大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 Graph-O1通过整合蒙特卡洛树搜索与强化学习,实现文本属性图的分步交互推理,提升问答任务的准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15663 2025-12-18 cs.AI cs.CL 81%

Explaining the Reasoning of Large Language Models Using Attribution Graphs

通过归因图解释大语言模型的推理过程

Chase Walker, Rickard Ewetz

机构 * University of Florida(佛罗里达大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 CAGE框架通过归因图解释大语言模型的推理过程,提升上下文归因的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01270 2025-12-12 cs.AI cs.LG cs.RO 81%

Multi-Robot Path Planning Combining Heuristics and Multi-Agent Reinforcement Learning

结合启发式方法和多智能体强化学习的多机器人路径规划

Shaoming Peng

机构 * School of Artificial Intelligence University of Chinese Academy of Sciences(人工智能学院 中国科学院大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出MAPPOHR方法,结合启发式搜索与多智能体强化学习,提升多机器人路径规划效率与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08996 2025-12-11 cs.CV cs.AI cs.LG 81%

Demo: Generative AI helps Radiotherapy Planning with User Preference

演示:生成式AI助力放疗计划制定与用户偏好

Riqiang Gao, Simon Arberet, Martin Kraus, Han Liu, Wilko FAR Verbakel, Dorin Comaniciu, Florin-Cristian Ghesu, Ali Kamen

机构 * Digital Technology and Innovation, Siemens Healthineers(西门子医疗数字化技术与创新部) Varian Medical Systems, Siemens Healthineers(Varian医疗系统,西门子医疗)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 生成式AI通过用户自定义偏好提升放疗计划的灵活性与个性化,优于现有方法在适应性和计划质量上

Comments Best paper in GenAI4Health at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20993 2025-12-09 cs.LG cs.AI 81%

Subgoal Graph-Augmented Planning for LLM-Guided Open-World Reinforcement Learning

子目标图增强的规划用于LLM引导的开放世界强化学习

Shanwei Fan, Bin Zhang, Zhiwei Xu, Yingxuan Teng, Siqi Dai, Lin Cheng, Guoliang Fan

机构 * The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(认知与决策智能复杂系统重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) School of Artificial Intelligence, Shandong University(山东大学人工智能学院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出SGA-ACR框架,通过整合环境特定的子目标图和多LLM规划流程,解决LLM在开放世界强化学习中的规划-执行对齐问题,提升子目标的可行性和可验证性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01592 2025-12-08 cs.CL cs.AI 81%

AURA: A Diagnostic Framework for Tracking User Satisfaction of Interactive Planning Agents

AURA:一个用于跟踪交互式规划代理用户满意度的诊断框架

Takyoung Kim, Janvijay Singh, Shuhaib Mehri, Emre Can Acikgoz, Sagnik Mukherjee, Nimet Beyza Bozdag, Sumuk Shashidhar, Gokhan Tur, Dilek Hakkani-Tür

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI

AI总结 AURA提出一个诊断框架,用于跟踪交互式规划代理的用户满意度,通过评估代理行为阶段和中间行为来提升用户体验。

Comments NeurIPS 2025 MTI-LLM Workshop. Full version is under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06981 2025-12-02 cs.AI cs.LG 81%

Deep RL Needs Deep Behavior Analysis: Exploring Implicit Planning by Model-Free Agents in Open-Ended Environments

深度强化学习需要深度行为分析:通过无模型智能体在开放性环境中探索隐式规划

Riley Simmons-Edler, Ryan P. Badman, Felix Baastad Berg, Raymond Chua, John J. Vastola, Joshua Lunger, William Qian, Kanaka Rajan

机构 * Department of Neurobiology, Harvard Medical School(哈佛医学院神经生物学系) Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University(哈佛大学自然与人工智能研究学院) Department of Mathematics, NTNU(NTNU数学系) School of Computer Science, McGill University & Mila(麦吉尔大学计算机科学学院及Mila) Department of Computer Science, University of Toronto(多伦多大学计算机科学系) Biophysics Graduate Program, Harvard University(哈佛大学生物物理学研究生项目)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文通过ForageWorld环境研究DRL智能体的行为,发现无模型智能体可通过涌现动态展现规划行为,提出通用分析框架用于研究复杂智能体的学习动态。

Comments Published at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04741 2025-12-02 cs.AI cs.CL cs.HC 81%

Question Answering for Decisionmaking in Green Building Design: A Multimodal Data Reasoning Method Driven by Large Language Models

绿色建筑设计中的决策制定问答:一种由大语言模型驱动的多模态数据推理方法

Yihui Li, Xiaoyue Yan, Hao Zhou, Borong Lin

机构 * School of Architecture(建筑学院) Tsinghua University(清华大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本研究提出GreenQA,一种由大语言模型驱动的多模态数据推理方法,用于提升绿色建筑设计决策效率。

Comments Published at Association for Computer Aided Design in Architecture (ACADIA) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23136 2025-12-01 cs.CL cs.AI 81%

Multi-chain Graph Refinement and Selection for Reliable Reasoning in Large Language Models

多链图细化与选择用于大语言模型中的可靠推理

Yujiao Yang, Jing Lian, Linhui Li

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 MGRS通过多链图细化与选择提升大语言模型的推理能力与效率,实现更高准确率和更快速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21928 2025-12-01 cs.LG cs.AI 81%

Prompted Policy Search: Reinforcement Learning through Linguistic and Numerical Reasoning in LLMs

提示策略搜索:通过语言和数值推理在大语言模型中进行强化学习

Yifan Zhou, Sachin Grover, Mohamed El Mistiri, Kamalesh Kalirathnam, Pratyush Kerhalkar, Swaroop Mishra, Neelesh Kumar, Sanket Gaurav, Oya Aran, Heni Ben Amor

机构 * Interactive Robotics Lab, Arizona State University(亚利桑那州立大学交互机器人实验室) Research & Development, Procter & Gamble(普罗cter与 gamble 研究与发展)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 ProPS通过结合语言和数值推理,在大语言模型中实现高效的强化学习,展示了在多个任务中超越传统算法的性能。

Comments In The Thirty-ninth Annual Conference on Neural Information Processing Systems

Journal ref Advances in Neural Information Processing Systems (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21706 2025-12-01 cs.CL cs.AI 81%

A General Highly Accurate Online Planning Method Integrating Large Language Models into Nested Rollout Policy Adaptation for Dialogue Tasks

一种整合大语言模型的通用高精度在线规划方法用于对话任务的嵌套回滚策略适应

Hui Wang, Fafa Zhang, Xiaoyu Zhang, Chaoxu Mu

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出NRPA-GD方法,利用大语言模型实现无需训练的对话策略规划,通过嵌套回滚策略适应在目标导向对话任务中取得优异表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16274 2025-11-26 cs.LG cs.AI cs.DC cs.PF 81%

STAlloc: Enhancing Memory Efficiency in Large-Scale Model Training with Spatio-Temporal Planning

STAlloc:通过时空规划提升大规模模型训练的内存效率

Zixiao Huang, Junhao Hu, Hao Lin, Chunyang Zhu, Yueran Tang, Quanlu Zhang, Zhen Guo, Zhenhua Li, Shengen Yan, Zhenhua Zhu, Guohao Dai, Yu Wang

机构 * Tsinghua University(清华大学) Infinigence AI Shanghai Jiao Tong University(上海交通大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 STAlloc通过结合离线规划与在线分配,有效减少大规模模型训练中的内存碎片化,提升训练效率和吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18313 2025-11-25 cs.CL cs.DB cs.IR cs.LG 81%

Path-Constrained Retrieval: A Structural Approach to Reliable LLM Agent Reasoning Through Graph-Scoped Semantic Search

路径约束检索:一种通过图域语义搜索实现可靠LLM代理推理的结构方法

Joseph Oladokun

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.LG

AI总结 路径约束检索通过结合结构图约束与语义搜索,提升LLM代理推理的可靠性和一致性。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10459 2025-11-19 cs.CL cs.AI cs.CY 81%

LocalBench: Benchmarking LLMs on County-Level Local Knowledge and Reasoning

Zihan Gao, Yifei Xu, Jacob Thebault-Spieker

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10705 2025-11-17 cs.AI cs.CL 81%

Co-EPG: A Framework for Co-Evolution of Planning and Grounding in Autonomous GUI Agents

Yuan Zhao, Hualei Zhu, Tingyu Jiang, Shen Li, Xiaohang Xu, Hao Henry Wang

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02390 2025-11-14 cs.CL cs.AI 81%

CoAT: Chain-of-Associated-Thoughts Framework for Enhancing Large Language Models Reasoning

Jianfeng Pan, Senyou Deng, Shaomang Huang

机构 * Security Technology Inc.(360安全技术公司)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 18 pages, 10 figures, Accepted by EMNLP 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16874 2025-11-13 cs.CL cs.AI 81%

MARS: Multi-Agent Adaptive Reasoning with Socratic Guidance for Automated Prompt Optimization

Jian Zhang, Zhangqi Wang, Haiping Zhu, Kangda Cheng, Kai He, Bo Li, Qika Lin, Jun Liu, Erik Cambria

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08732 2025-11-13 cs.RO cs.AI cs.LG 81%

Intuitive Programming, Adaptive Task Planning, and Dynamic Role Allocation in Human-Robot Collaboration

Marta Lagomarsino, Elena Merlo, Andrea Pupa, Timo Birr, Franziska Krebs, Cristian Secchi, Tamim Asfour, Arash Ajoudani

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

Comments Published in the Annual Review of Control, Robotics, and Autonomous Systems, Volume 9; copyright 2026 the author(s), CC BY 4.0, https://www.annualreviews.org

Journal ref Annual Review of Control, Robotics, and Autonomous Systems (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08043 2025-11-12 cs.LG cs.CL 81%

DynaAct: Large Language Model Reasoning with Dynamic Action Spaces

Xueliang Zhao, Wei Wu, Jian Guan, Qintong Li, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Ant Group(蚂蚁集团)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.LG

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏