arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 45335 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11088 篇

2604.12076 2026-04-15 cs.CL cs.AI cs.CY 90%

Narrative over Numbers: The Identifiable Victim Effect and its Amplification Under Alignment and Reasoning in Large Language Models

数字之外的叙事:可识别受害者效应及其在对齐和推理中的放大

Syed Rifat Raiyan

机构 * Systems and Software Lab (SSL), Department of Computer Science and Engineering(系统与软件实验室(SSL),计算机科学与工程系)

专题命中 规划推理 :CoT(summary_cn,abstract);reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 研究探讨了大语言模型中可识别受害者效应的普遍存在及其受对齐训练的影响,发现指令调优模型表现出极端效应,而推理专精模型则逆转了该效应,且标准CoT提示放大了该效应。

Comments Under review, 49 pages, 20 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23773 2026-05-22 cs.AI cs.CL cs.LG cs.RO 90%

General Agentic Planning Through Simulative Reasoning with World Models

通过世界模型的模拟推理实现通用代理规划

Mingkai Deng, Jinyu Hou, Zhiting Hu, Eric Xing

机构 * Institute of Foundation Models (IFM)(基础模型研究所) Carnegie Mellon University(卡内基梅隆大学) UC San Diego(南加州大学)

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出通过模拟推理实现通用代理规划,利用世界模型进行未来状态预测,提升决策能力,通过SiRA架构在不同任务中取得更高任务完成率。

Comments Winner of Berkeley LLM Agents Hackathon (Fundamentals Track); code available at https://github.com/sailing-lab/sira

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18553 2024-08-01 cs.IR 90%

REAPER: Reasoning based Retrieval Planning for Complex RAG Systems

Ashutosh Joshi, Sheikh Muhammad Sarwar, Samarth Varshney, Sreyashi Nag, Shrivats Agrawal, Juhi Naik

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);chain-of-thought(abstract);CoT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10775 2026-04-14 cs.CL cs.GT cs.LG 90%

LLMs for Game Theory: Entropy-Guided In-Context Learning and Adaptive CoT Reasoning

大型语言模型用于博弈论:基于熵的上下文学习与自适应推理

Tommaso Felice Banfi, Sashenka Gamage

专题命中 规划推理 :reasoning(title,abstract);CoT(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.LG

AI总结 本文提出一种基于LLM的框架,通过熵引导的链式推理和自适应上下文检索,提升离散博弈任务的推理能力,实验显示其显著提高决策质量。

Comments Published at the AAAI 2026 Bridge: Logical and Symbolic Reasoning in Language Models (OpenReview)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24014 2026-01-01 cs.CL cs.AI 90%

iCLP: Large Language Model Reasoning with Implicit Cognition Latent Planning

iCLP: 基于隐式认知潜在规划的大语言模型推理

Sijia Chen, Di Niu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) University of Alberta(阿尔伯塔大学)

专题命中 规划推理 :planning(title,abstract);reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 iCLP通过隐式认知潜在规划提升大语言模型的推理准确性和效率,实现跨领域泛化与可解释性。

Comments 9 pages, 6 figures. The source code is publicly available at https://github.com/AgenticFinLab/latent-planning

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01319 2026-08-04 cs.AI 新提交 90%

Cognitive Demand Steering for Adaptive Meta-Reasoning in Large Language Models

大语言模型自适应元推理的认知需求引导

John Scoville, Shengzhuang Chen, Yejin Bang, Stefan Winzeck, Jonathan Richard Schwarz

机构 * Thomson Reuters Foundational Research(汤森路透基础研究部) Imperial College London(帝国理工学院)

专题命中 规划推理 :CoT(summary_cn,abstract);reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 该研究提出无需训练的元推理框架CDS,通过认知量表刻画需求,在三类大模型和六个基准上较直接调用、标准CoT分别提升21.9%、9%准确率,难数学编码任务增益显著。

Comments 21 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08992 2026-05-14 cs.LG 90%

Constraints-of-Thought: A Framework for Constrained Reasoning in Language-Model-Guided Search

思维约束:一种在语言模型引导搜索中进行约束推理的框架

Kamel Alrashedy, Vriksha Srihari, Zulfiqar Zaidi, Ridam Srivastava, Pradyumna Tambwekar, Matthew Gombolay

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);planning(abstract)

AI总结 本文提出Const-o-T框架,通过约束推理提升语言模型在多步骤任务中的规划效率和决策可靠性,适用于风险游戏、CAD代码生成和算术推理等复杂领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06040 2026-05-08 cs.AI cs.CL 90%

Novelty-based Tree-of-Thought Search for LLM Reasoning and Planning

基于新颖性的树状思维搜索用于大语言模型推理与规划

Leon Hamm, Zlatan Ajanovic

机构 * RWTH Aachen(亚琛工业大学)

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 本文提出基于新颖性的树状思维搜索方法,通过引入新颖性概念优化语言领域推理与规划任务,减少搜索范围和token成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21611 2026-01-30 cs.IR cs.AI cs.CL 90%

Thinking Broad, Acting Fast: Latent Reasoning Distillation from Multi-Perspective Chain-of-Thought for E-Commerce Relevance

深度思考,快速行动:多视角链式推理的潜在推理蒸馏用于电子商务相关性

Baopu Qiu, Hao Chen, Yuanrong Wu, Changtong Zan, Chao Wei, Weiru Zhang, Xiaoyi Zeng

机构 * Alibaba International Digital Commerce Group(阿里巴巴国际数字商业集团) Zhejiang University(浙江大学)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL、cs.AI

AI总结 本文提出多视角链式推理蒸馏方法,通过改进的教师模型和轻量级学生模型提升电子商务搜索相关性建模的准确性和效率。

Comments 12 pages, 6 figures, Accepted by WWW2026 industry track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20586 2025-12-24 cs.AI cs.CL cs.HC 90%

Automated stereotactic radiosurgery planning using a human-in-the-loop reasoning large language model agent

利用人类在回路的推理大型语言模型代理进行自动化立体定向放射手术计划

Humza Nusrat, Luke Francisco, Bing Luo, Hassan Bagher-Ebadian, Joshua Kim, Karen Chin-Snyder, Salim Siddiqui, Mira Shah, Eric Mellon, Mohammad Ghassemi, Anthony Doemer, Benjamin Movsas, Kundan Thind

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 本文提出利用人类在回路的推理大型语言模型代理进行自动化立体定向放射手术计划,通过对比推理模型与非推理模型,展示了推理模型在剂量优化和计划行为上的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18817 2025-10-22 cs.CL cs.AI 90%

Fine-Tuned Thoughts: Leveraging Chain-of-Thought Reasoning for Industrial Asset Health Monitoring

Shuxin Lin, Dhaval Patel, Christodoulos Constantinides

机构 * IBM Research(IBM研究院)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments Accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16815 2025-09-19 cs.CV cs.AI cs.LG cs.RO 90%

ThinkAct: Vision-Language-Action Reasoning via Reinforced Visual Latent Planning

Chi-Pin Huang, Yueh-Hua Wu, Min-Hung Chen, Yu-Chiang Frank Wang, Fu-En Yang

机构 * NVIDIA National Taiwan University(国立台湾大学)

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);self-correction(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2025. Project page: https://jasper0314-huang.github.io/thinkact-vla/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12521 2025-02-19 cs.AI cs.LG 90%

Inference-Time Computations for LLM Reasoning and Planning: A Benchmark and Insights

Shubham Parashar, Blake Olson, Sambhav Khurana, Eric Li, Hongyi Ling, James Caverlee, Shuiwang Ji

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);logical reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09666 2024-12-16 cs.AI cs.CL 90%

Systematic Analysis of LLM Contributions to Planning: Solver, Verifier, Heuristic

Haoming Li, Zhaoliang Chen, Songyuan Liu, Yiming Lu, Fei Liu

专题命中 规划推理 :planning(title,abstract);verifier(title,abstract);reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00658 2024-10-16 cs.AI cs.CL 90%

Learning Planning-based Reasoning by Trajectories Collection and Process Reward Synthesizing

Fangkai Jiao, Chengwei Qin, Zhengyuan Liu, Nancy F. Chen, Shafiq Joty

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);logical reasoning(abstract);分类 cs.CL、cs.AI

Comments 17 pages, 9 figures. EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15099 2024-07-03 cs.CL cs.CY cs.LG cs.SI 90%

Moderating New Waves of Online Hate with Chain-of-Thought Reasoning in Large Language Models

Nishant Vishwamitra, Keyan Guo, Farhan Tajwar Romit, Isabelle Ondracek, Long Cheng, Ziming Zhao, Hongxin Hu

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL、cs.LG

Comments To Appear in the 45th IEEE Symposium on Security and Privacy, May 20-23, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01461 2025-06-03 cs.LG cs.AI cs.CL 89%

Marco-o1 v2: Towards Widening The Distillation Bottleneck for Reasoning Models

Huifeng Yin, Yu Zhao, Minghao Wu, Xuanfan Ni, Bo Zeng, Hao Wang, Tianqi Shi, Liangying Shao, Chenyang Lyu, Longyue Wang, Weihua Luo, Kaifu Zhang

机构 * Alibaba International Digital Commerce(阿里巴巴国际数字商业集团) Tsinghua University(清华大学) Monash University(墨尔本大学)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);planning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16360 2026-06-16 cs.CL cs.AI 新提交 89%

Tyler: Typed Latent Reasoning for Language Models -- When to Think, What to Compute, and How Much to Allocate

Tyler: 语言模型的类型化潜在推理——何时思考、计算什么以及分配多少

Hanyu Lin, Min Cai, Jiawei Wen, Haodi Zhang

机构 * Shenzhen University(深圳大学) University of Alberta(阿尔伯塔大学)

专题命中 规划推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);planning(abstract)

AI总结 提出Tyler框架,通过类型化潜在推理模块和预算感知策略,在自回归解码中动态选择文本生成或潜在计算,显著提升推理准确率并降低遗忘。

Comments website: https://typed-latent-reasoning.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17368 2026-03-19 cs.AI 89%

Towards Safer Large Reasoning Models by Promoting Safety Decision-Making before Chain-of-Thought Generation

通过在链式思考生成前促进安全决策来构建更安全的大推理模型

Jianan Chen, Zhifang Zhang, Shuo He, Linan Yue, Lei Feng, Minling Zhang

机构 * Southeast University, China(东南大学,中国) The University of Queensland, Australia(昆士兰大学,澳大利亚) Nanyang Technological University, Singapore(南洋理工大学,新加坡)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.AI

AI总结 本文提出在链式思考生成前促进安全决策的方法,提升大推理模型的安全性同时保持推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07148 2026-03-10 cs.LG 89%

Agentic Planning with Reasoning for Image Styling via Offline RL

基于推理的图像风格化代理规划 via 离线强化学习

Subhojyoti Mukherjee, Stefano Petrangeli, Branislav Kveton, Trung Bui, Franck Dernoncourt, Arko Mukherjee

机构 * Adobe Research(Adobe研究)

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);chain-of-thought(abstract);分类 cs.LG

AI总结 本文提出基于推理的代理规划框架,通过结构化规划和工具链提升图像风格化效果,采用合成数据生成和离线强化学习方法,验证在视觉质量和指令遵循上的优越性。

Comments 85 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08182 2026-01-30 cs.LG 89%

CTRLS: Chain-of-Thought Reasoning via Latent State-Transition

CTRLS: 通过潜在状态转移进行链式推理

Junda Wu, Yuxin Xiong, Xintong Li, Sheldon Yu, Zhengmian Hu, Tong Yu, Rui Wang, Xiang Chen, Jingbo Shang, Julian McAuley

机构 * University of California, San Diego(加州大学圣地亚哥分校) Adobe Research(Adobe研究)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.LG

AI总结 CTRLS通过建模潜在状态转移的马尔可夫决策过程,利用分布式强化学习提升大语言模型的推理能力与探索效率。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18211 2025-12-23 cs.RO cs.AI 89%

LLaViDA: A Large Language Vision Driving Assistant for Explicit Reasoning and Enhanced Trajectory Planning

LLaViDA: 一种用于显式推理和增强轨迹规划的大型语言视觉驾驶助手

Yudong Liu, Spencer Hallyburton, Jiwoo Kim, Yueqian Lin, Yiming Li, Qinsi Wang, Hui Ye, Jingwei Sun, Miroslav Pajic, Yiran Chen, Hai Li

机构 * Duke University(杜克大学) Georgia State University(佐治亚州立大学) University of Florida(佛罗里达大学)

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 LLaViDA通过视觉-语言模型实现显式推理和轨迹规划,提升自动驾驶的轨迹规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05813 2025-11-18 cs.CL 89%

MAPLE: Multi-Agent Adaptive Planning with Long-Term Memory for Table Reasoning

Ye Bai, Minghan Wang, Thuy-Trang Vu

机构 * Department of Data Science & AI, Monash University(数据科学与人工智能系,墨尔本大学)

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);chain-of-thought(abstract);分类 cs.CL

Comments 27 pages, 11 figures, ALTA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10925 2025-11-17 cs.AI 89%

Multi-Agent Legal Verifier Systems for Data Transfer Planning

Ha-Thanh Nguyen, Wachara Fungwacharakorn, Ken Satoh

机构 * Center of Juris-Informatics, Joint Support-Center for Data Science Research, ROIS, Tokyo, Japan(司法信息中心、数据科学研究联合支持中心、ROIS、东京、日本) Research and Development Center for Large Language Models, NII, ROIS, Tokyo, Japan(大语言模型研究与开发中心、日本信息机构、ROIS、东京、日本)

专题命中 规划推理 :planning(title,abstract);verifier(title,abstract);reasoning(abstract);分类 cs.AI

Comments Presented at NeLaMKRR@KR, 2025 (arXiv:2511.09575)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05375 2025-11-10 cs.AI 89%

Reasoning Is All You Need for Urban Planning AI

Sijie Yang, Jiatong Li, Filip Biljecki

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);CoT(abstract);分类 cs.AI

Comments Submitted to AAAI 2026 Workshop AI4UP

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17336 2025-11-04 cs.CR cs.AI 89%

PPMI: Privacy-Preserving LLM Interaction with Socratic Chain-of-Thought Reasoning and Homomorphically Encrypted Vector Databases

Yubeen Bae, Minchan Kim, Jaejin Lee, Sangbum Kim, Jaehyung Kim, Yejin Choi, Niloofar Mireshghallah

机构 * Seoul National University(首尔国立大学) Stanford University(斯坦福大学) NVIDIA(英伟达) University of Washington(华盛顿大学)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.AI

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16156 2025-10-21 eess.AS cs.AI cs.MM 89%

AsyncVoice Agent: Real-Time Explanation for LLM Planning and Reasoning

Yueqian Lin, Zhengmian Hu, Jayakumar Subramanian, Qinsi Wang, Nikos Vlassis, Hai "Helen" Li, Yiran Chen

机构 * Duke University(杜克大学) Adobe Research(Adobe研究)

专题命中 规划推理 :reasoning(title,abstract);planning(title);chain-of-thought(abstract);CoT(abstract)

Comments Accepted to the IEEE ASRU 2025 Demo Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12067 2025-10-15 cs.AI 89%

HiCoTraj:Zero-Shot Demographic Reasoning via Hierarchical Chain-of-Thought Prompting from Trajectory

Junyi Xie, Yuankun Jiao, Jina Kim, Yao-Yi Chiang, Lingyi Zhao, Khurram Shafique

机构 * University of Minnesota(明尼苏达大学) Novateur Research Solutions(Novateur研究解决方案)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(title,abstract);planning(abstract);分类 cs.AI

Comments accepted by The 1st ACM SIGSPATIAL International Workshop on Generative and Agentic AI for Multi-Modality Space-Time Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01106 2025-09-12 cs.AI cs.CV cs.RO 89%

Robix: A Unified Model for Robot Interaction, Reasoning and Planning

Huang Fang, Mengxi Zhang, Heng Dong, Wei Li, Zixuan Wang, Qifeng Zhang, Xueyun Tian, Yucheng Hu, Hang Li

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);chain-of-thought(abstract);分类 cs.AI

Comments Tech report. Project page: https://robix-seed.github.io/robix/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23678 2025-07-01 cs.HC cs.AI 89%

Interactive Reasoning: Visualizing and Controlling Chain-of-Thought Reasoning in Large Language Models

Rock Yuren Pang, K. J. Kevin Feng, Shangbin Feng, Chu Li, Weijia Shi, Yulia Tsvetkov, Jeffrey Heer, Katharina Reinecke

机构 * University of Washington(华盛顿大学)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏