arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11047 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11047 篇

2608.18921 2026-08-20 cs.CL cs.AI 新提交 76%

SMTrap: Cost-Effective DoS Attacks Against Large Reasoning Models via SMT Conflict Guidance

SMTrap:基于SMT冲突引导的针对大型推理模型的高性价比DoS攻击

Jian Yang, Zhenqi Feng, Zhaoyang Yu, Zhaoxin Fan, Kejian Wu, Xiaofeng Wang, Zheng Zhu, Jianjun Huang, Wei You, Bin Liang

专题命中 规划推理 :reasoning(title);分类 cs.CL、cs.AI

AI总结 本研究提出基于SMT冲突引导的轻量级CPU框架SMTrap,无需模型查询或GPU即可生成高影响力CSP查询,实现强于基线数倍的LRM-DoS攻击,还展示了对应的缓解工具

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04452 2026-08-06 cs.CV cs.AI cs.CL 新提交 76%

Q-CueGraph: Query-Conditioned Visual Evidence Graphs for Multimodal Reasoning

Q-CueGraph:用于多模态推理的查询条件化视觉证据图

Pengcheng Pan, Xinfang Zhang

专题命中 规划推理 :reasoning(title);分类 cs.CL、cs.AI

AI总结 Q-CueGraph是一种用于多模态推理的查询条件化视觉证据图,它为冻结读取器生成受预算约束的坐标级观测,在多个基准测试中显著提升了推理性能,尤其适用于证据可定位、问题能区分位置且分辨率受限的场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00339 2026-08-04 cs.AI cs.CL 新提交 76%

Bayesian and Motivated Reasoning in AI Agents

AI智能体中的贝叶斯推理与动机推理

Eddie Yang

专题命中 规划推理 :reasoning(title);分类 cs.CL、cs.AI

AI总结 该研究发现AI智能体的结论受先验信念影响,相同数值数据因框架不同会得出不同结论,揭示了委托其决策存在依赖未指定先验的风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26182 2026-07-22 cs.CV cs.AI cs.LG 版本更新 76%

Lifting Embodied World Models for Planning and Control

提升具身世界模型用于规划与控制

Alex N. Wang, Trevor Darrell, Pavel Izmailov, Yutong Bai, Amir Bar

机构 * Computer Science, New York University(纽约大学计算机科学系) BAIR, UC Berkeley(伯克利大学BAIR)

专题命中 规划推理 :planning(title);分类 cs.AI、cs.LG

AI总结 本文提出一种轻量级策略,将高层动作映射到低层关节动作序列,结合冻结的世界模型,实现预测未来观察的提升世界模型,有效降低规划复杂度。

Comments Accepted to ECCV2026. Edited policy masking

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30627 2026-06-30 cs.LG cs.AI stat.ML 76%

Pessimism's Paradox: Conservative Offline Training Amplifies Reward Hacking During Online Adaptation in Reasoning Models

悲观的悖论:保守离线训练加剧推理模型在线适应中的奖励黑客行为

Subramanyam Sahoo, Aman Chadha, Vinija Jain, Divya Chaudhary

机构 * Horizon Research Apple Meta

专题命中 规划推理 :reasoning(title);分类 cs.AI、cs.LG

AI总结 研究发现,离线训练中越保守的DPO(高β)会压缩策略熵,降低响应多样性,反而加速在线优化中奖励模型的利用,导致更严重的奖励黑客行为。

Comments Accepted in ICML 2026 workshop on Decision-Making from Offline Datasets to Online Adaptation: Black-Box Optimization to Reinforcement Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21470 2026-06-01 cs.LG cs.AI 76%

Agent JIT Compilation for Latency-Optimizing Web Agent Planning and Scheduling

面向延迟优化的Web Agent规划与调度的Agent即时编译

Caleb Winston, Ron Yifeng Wang, Azalia Mirhoseini, Christos Kozyrakis

机构 * Stanford University(斯坦福大学)

专题命中 规划推理 :planning(title);分类 cs.AI、cs.LG

AI总结 提出Agent即时编译系统,通过JIT-Planner生成代码计划、JIT-Scheduler探索并行化策略及不变式工具协议,显著降低延迟并提高准确性。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29458 2026-05-29 cs.CL cs.AI 76%

Adaptive Interviewing for Persona Simulation in LLMs: Evidence-Grounded Reasoning Improves Decision Alignment

面向LLM人格模拟的自适应访谈:基于证据的推理提升决策对齐

Ruoxi Su, Yuhan Liu, Jingyu Hu

机构 * University of Cambridge(剑桥大学) Independent Researcher(独立研究员)

专题命中 规划推理 :reasoning(title);分类 cs.CL、cs.AI

AI总结 提出自适应访谈框架,通过结构化三阶段对话收集人格相关信息,并基于访谈记录评估LLM在道德困境场景中模拟个体决策的能力,发现基于后续追问的证据推理能显著提升预测准确性。

Comments 20 pages, 2 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15315 2026-05-18 cs.AI cs.CL 76%

Context Pruning for Coding Agents via Multi-Rubric Latent Reasoning

通过多标准潜在推理进行编码代理的上下文剪枝

Jingjing Wang, Xiwen Chen, Wenhui Zhu, Huayu Li, Zhengxiao He, Feiyang Cai, Ana S. Carreon-Rascon, Xuanzhao Dong, Feng Luo

机构 * Clemson University(克莱姆森大学) Morgan Stanley(摩根大通) Arizona State University(亚利桑那州立大学) University of Arizona(亚利桑那大学)

专题命中 规划推理 :reasoning(title);分类 cs.CL、cs.AI

AI总结 本文提出LaMR框架,通过分解代码相关性为语义证据和依赖支持两个维度,利用多任务CRF模型提升编码代理的上下文剪枝效果,实验表明其在多个基准测试中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11225 2026-05-13 cs.AI cs.LG cs.MA 76%

PIVOT: Bridging Planning and Execution in LLM Agents via Trajectory Refinement

PIVOT:通过轨迹细化弥合LLM代理中的规划与执行

Tuo Zhang, Alin-Ionut Popa, Yan Xu, Rui Song, Dimitrios Dimitriadis

专题命中 规划推理 :planning(title);分类 cs.AI、cs.LG

AI总结 PIVOT通过自监督框架迭代优化轨迹,解决LLM代理规划与执行不一致问题,实验证明其在约束满足和计算效率上的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18839 2026-04-22 cs.LG cs.AI 76%

One Step Forward and K Steps Back: Better Reasoning with Denoising Recursion Models

向前一步,向后退几步:通过去噪递归模型更好地推理

Chris Cameron, Wangzheng Wang, Nikita Ivanov, Ashmita Bhattacharyya, Didier Chételat, Yingxue Zhang

机构 * Huawei Technologies(华为技术有限公司) University of Toronto(多伦多大学) University of Waterloo(滑铁卢大学)

专题命中 规划推理 :reasoning(title);分类 cs.AI、cs.LG

AI总结 本文提出去噪递归模型,通过多步递归去噪提升推理能力,优于传统递归模型,在ARC-AGI任务中表现更佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16585 2026-04-21 cs.LG cs.AI 76%

The Global Neural World Model: Spatially Grounded Discrete Topologies for Action-Conditioned Planning

全局神经世界模型:用于动作条件规划的空间接地离散拓扑

Noureddine Kermiche

机构 * Western Digital Corporation(西部数据公司)

专题命中 规划推理 :planning(title);分类 cs.AI、cs.LG

AI总结 本文提出全局神经世界模型,通过平衡的连续熵约束实现拓扑量化,采用连续动作条件联合嵌入预测架构,将环境映射到离散2D网格,防止流形漂移,通过最大熵探索学习通用过渡动态。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11905 2026-01-21 cs.AI cs.LG math.ST stat.TH 76%

LIBRA: Language Model Informed Bandit Recourse Algorithm for Personalized Treatment Planning

LIBRA:基于语言模型的带状 recourse 算法用于个性化治疗计划

Junyu Cao, Ruijiang Gao, Esmaeil Keyvanshokooh, Jianhao Ma

机构 * McCombs School of Business, University of Texas at Austin(德克萨斯大学奥斯汀分校麦克斯韦商学院) Naveen Jindal School of Management, University of Texas at Dallas(德克萨斯大学达拉斯分校奈文·金达管理学院) Mays Business School, Texas A&M University(德克萨斯农工大学梅斯商学院) Wharton School, University of Pennsylvania(宾夕法尼亚大学沃顿商学院)

专题命中 规划推理 :planning(title);分类 cs.AI、cs.LG

AI总结 LIBRA 是一种结合大语言模型和带状学习的算法,用于在个性化治疗中实现更高效的决策和鲁棒性。

Comments 50 pages. Previous version with human-AI collaboration: arXiv:2410.14640

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15756 2025-12-19 cs.LG cs.AI 76%

ReactorFold: Generative discovery of nuclear reactor cores via emergent physical reasoning

ReactorFold:通过涌现物理推理生成核反应堆核心

Yoonpyo Lee

专题命中 规划推理 :reasoning(title);分类 cs.AI、cs.LG

AI总结 ReactorFold通过生成框架和涌现物理推理,实现了核反应堆核心设计的创新发现,突破传统设计限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21249 2025-10-08 cs.LG cs.AI 76%

Capacity-Aware Planning and Scheduling in Budget-Constrained Multi-Agent MDPs: A Meta-RL Approach

Manav Vora, Ilan Shomorony, Melkior Ornik

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划推理 :planning(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01006 2025-10-02 cs.AI cs.LG 76%

Integrating AI and Ensemble Forecasting: Explainable Materials Planning with Scorecards and Trend Insights for a Large-Scale Manufacturer

Saravanan Venkatachalam

专题命中 规划推理 :planning(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07163 2025-09-10 cs.IR cs.CL cs.LG 76%

Beyond Sequential Reranking: Reranker-Guided Search Improves Reasoning Intensive Retrieval

Haike Xu, Tong Chen

机构 * Massachusetts Institute of Technology(麻省理工学院) University of Washington(华盛顿大学)

专题命中 规划推理 :reasoning(title);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06953 2025-09-09 cs.RO cs.AI cs.CV cs.LG cs.SY eess.SY 76%

Deep Reactive Policy: Learning Reactive Manipulator Motion Planning for Dynamic Environments

Jiahui Yang, Jason Jingzhou Liu, Yulong Li, Youssef Khaky, Kenneth Shaw, Deepak Pathak

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划推理 :planning(title);分类 cs.AI、cs.LG

Comments Website at \url{deep-reactive-policy.com}

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03118 2025-09-04 cs.LG cs.AI cs.MA 76%

A Hierarchical Deep Reinforcement Learning Framework for Traffic Signal Control with Predictable Cycle Planning

Hankang Gu, Yuli Zhang, Chengming Wang, Ruiyuan Jiang, Ziheng Qiao, Pengfei Fan, Dongyao Jia

机构 * School of Advanced Technology, Xi’an Jiaotong-Liverpool University(先进技术学院,西安交通大学利物浦大学)

专题命中 规划推理 :planning(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00842 2025-07-28 cs.CL cs.AI 76%

Toward Structured Knowledge Reasoning: Contrastive Retrieval-Augmented Generation on Experience

Jiawei Gu, Ziting Xian, Yuanzhen Xie, Ye Liu, Enjie Liu, Ruichao Zhong, Mochi Gao, Yunzhi Tan, Bo Hu, Zang Li

专题命中 规划推理 :reasoning(title);分类 cs.CL、cs.AI

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11092 2025-07-22 cs.CL cs.AI cs.HC 76%

Dynamic Context Tuning for Retrieval-Augmented Generation: Enhancing Multi-Turn Planning and Tool Adaptation

Jubin Abhishek Soni, Amit Anand, Rajesh Kumar Pandey, Aniket Abhishek Soni

专题命中 规划推理 :planning(title);分类 cs.CL、cs.AI

Comments We are withdrawing the submission in order to thoroughly revise the work

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15876 2025-05-29 cs.CV cs.AI cs.LG 76%

End-to-End Breast Cancer Radiotherapy Planning via LMMs with Consistency Embedding

Kwanyoung Kim, Yujin Oh, Sangjoon Park, Hwa Kyung Byun, Joongyo Lee, Jin Sung Kim, Yong Bae Kim, Jong Chul Ye

机构 * Samsung Research(三星研究院) Center for Advanced Medical Computing and Analysis (CAMCA)(先进医学计算与分析中心) Massachusetts General Hospital (MGH) and Harvard Medical School(麻省总医院和哈佛医学院) Yonsei University College of Medicine(延世大学医学院) Yonsei University(延世大学) Institute for Innovation in Digital Healthcare(数字医疗创新研究所) Yongin Severance Hospital(Yongin Severance医院) Gachon University Gil Hospital(高仁大学Gil医院) Oncosoft Inc(Oncosoft公司) Graduate School of AI, Korea Advanced Institute of Science and Technology (KAIST)(人工智能研究生院,韩国科学技术院)

专题命中 规划推理 :planning(title);分类 cs.AI、cs.LG

Comments Accepted for Medical Image Analysis 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.12555 2025-05-20 cs.HC cs.AI cs.CL 76%

PlanFitting: Personalized Exercise Planning with Large Language Model-driven Conversational Agent

Donghoon Shin, Gary Hsieh, Young-Ho Kim

机构 * University of Washington(华盛顿大学) NAVER AI Lab(NAVER人工智能实验室)

专题命中 规划推理 :planning(title);分类 cs.CL、cs.AI

Comments 17 pages including reference. Accepted to ACM CUI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08927 2025-03-06 cs.AI cs.CL 76%

VerilogCoder: Autonomous Verilog Coding Agents with Graph-based Planning and Abstract Syntax Tree (AST)-based Waveform Tracing Tool

Chia-Tung Ho, Haoxing Ren, Brucek Khailany

专题命中 规划推理 :planning(title);分类 cs.CL、cs.AI

Comments main paper 7 pages, reference 1 page, it is the version that accepted by AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00751 2025-03-04 cs.CL cs.AI 76%

RAPID: Efficient Retrieval-Augmented Long Text Generation with Writing Planning and Information Discovery

Hongchao Gu, Dexun Li, Kuicai Dong, Hao Zhang, Hang Lv, Hao Wang, Defu Lian, Yong Liu, Enhong Chen

专题命中 规划推理 :planning(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04399 2025-02-10 cs.LG cs.AI cs.SY eess.SY 76%

Online Location Planning for AI-Defined Vehicles: Optimizing Joint Tasks of Order Serving and Spatio-Temporal Heterogeneous Model Fine-Tuning

Bokeng Zheng, Bo Rao, Tianxiang Zhu, Chee Wei Tan, Jingpu Duan, Zhi Zhou, Xu Chen, Xiaoxi Zhang

专题命中 规划推理 :planning(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00254 2025-01-03 cs.AI cs.CL 76%

Automatically Planning Optimal Parallel Strategy for Large Language Models

Zongbiao Li, Xiezhao Li, Yinghao Cui, Yijun Chen, Zhixuan Gu, Yuxuan Liu, Wenbo Zhu, Fei Jia, Ke Liu, Qifeng Li, Junyao Zhan, Jiangtao Zhou, Chenxi Zhang, Qike Liu

专题命中 规划推理 :planning(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06025 2024-10-29 cs.AI cs.CL 76%

Doing Experiments and Revising Rules with Natural Language and Probabilistic Reasoning

Wasu Top Piriyakulkij, Cassidy Langenfeld, Tuan Anh Le, Kevin Ellis

专题命中 规划推理 :reasoning(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10896 2024-10-22 cs.LG cs.AI cs.CE 76%

AT-MoE: Adaptive Task-planning Mixture of Experts via LoRA Approach

Xurui Li, Juanjuan Yao

专题命中 规划推理 :planning(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07569 2024-09-05 cs.RO cs.AI cs.LG 76%

Can Vehicle Motion Planning Generalize to Realistic Long-tail Scenarios?

Marcel Hallgarten, Julian Zapata, Martin Stoll, Katrin Renz, Andreas Zell

专题命中 规划推理 :planning(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21041 2024-08-01 cs.CL cs.AI cs.SI 76%

They Look Like Each Other: Case-based Reasoning for Explainable Depression Detection on Twitter using Large Language Models

Mohammad Saeid Mahdavinejad, Peyman Adibi, Amirhassan Monadjemi, Pascal Hitzler

专题命中 规划推理 :reasoning(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏