arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-01-12 至 2026-01-12 共收录 18 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 18 篇

2601.05455 2026-01-12 cs.AI cs.LG 86%

ART: Adaptive Reasoning Trees for Explainable Claim Verification

ART:可解释性声明验证的自适应推理树

Sahil Wadhwa, Himanshu Kumar, Guanqun Yang, Abbaas Alif Mohamed Nishar, Pranab Mohanty, Swapnil Shinde, Yue Wu

机构 * Capital One Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG

AI总结 ART通过自适应推理树提升声明验证的可解释性和可靠性,通过分层论证结构和法官LLM裁决实现透明且可挑战的决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11314 2026-01-12 cs.MA cs.AI 83%

Simulating Multi-Stakeholder Decision-Making with Generative Agents in Urban Planning

用生成代理模拟城市规划中的多利益相关者决策

Jin Gao, Hanyong Xu, Luc Dao

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);分类 cs.AI

AI总结 本研究通过多生成代理系统模拟城市规划中的多利益相关者决策,探讨人口因素对集体决策的影响,并提升决策的公平性和效率。

Journal ref Advances in Transdisciplinary Engineering, Vol. 76, pp. 40-49, IOS Press, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03811 2026-01-12 cs.AI 79%

Rethinking Supply Chain Planning: A Generative Paradigm

重新思考供应链规划:一种生成范式

Jiaheng Yin, Yongzhi Qi, Jianshen Zhang, Dongyang Geng, Zhengyu Chen, Hao Hu, Wei Qi, Zuo-Jun Max Shen

机构 * Tsinghua University, Beijing, China(清华大学) JD.com, Beijing, China(京东) Faculty of Engineering and Faculty of Business and Economics, The University of Hong Kong, China(香港大学工程学院和商学院) College of Engineering, University of California, Berkeley, CA, USA(加州大学伯克利分校工程学院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种基于生成式人工智能的供应链规划范式,通过智能代理框架提升规划准确性与库存率,实现动态需求下的适应性协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01022 2026-01-12 cs.AI cs.MA cs.RO 79%

Symbolic Planning and Multi-Agent Path Finding in Extremely Dense Environments with Unassigned Agents

符号规划与在极度密集环境中无分配代理的多智能体路径寻找

Bo Fu, Zhe Chen, Rahul Chandan, Alex Barbosa, Michael Caldara, Joey Durham, Federico Pecora

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出五种基于搜索的算法,用于解决在极度密集环境中无分配代理的多智能体路径寻找问题,通过图搜索方法高效生成重新排列计划。

Comments AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06931 2026-01-12 cs.RO 78%

Non-Prehensile Tool-Object Manipulation by Integrating LLM-Based Planning and Manoeuvrability-Driven Controls

通过整合基于大语言模型的规划和机动性驱动的控制实现非抓取工具-物体 manipulation

Hoi-Yin Lee, Peng Zhou, Anqing Duan, Wanyu Ma, Chenguang Yang, David Navarro-Alarcon

机构 * organization= Department of Mechanical Engineering, The Hong Kong Polytechnic University , addressline= KLN, Hong Kong organization= School of Advanced Engineering, The Great Bay University , addressline= Dongguan, China organization= Department of Robotics, Mohamed Bin Zayed University of Artificial Intelligence , addressline= Abu Dhabi, UAE organization= Department of Surgery, The Chinese University of Hong Kong , addressline= NT, Hong Kong organization= Department of Computer Science, University of Liverpool , addressline= Liverpool, UK

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出了一种结合大语言模型和机动性驱动控制的方法,用于实现非抓取工具-物体 manipulation任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04285 2026-01-12 cs.AI cs.HC cs.LG cs.MA 73%

A Future Capabilities Agent for Tactical Air Traffic Control

战术空交通管制中的未来能力代理

Paul Kent, George De Ath, Martin Layton, Allen Hart, Richard Everson, Ben Carvell

机构 * University of Exeter(埃克塞特大学) NATS(英国航空交通服务提供商)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Agent Mallard,一种基于规则的前瞻性规划代理,用于战术空交通管制,通过嵌入随机数字双胞胎实现安全冲突解决,并在简化场景中展示与专家推理一致的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16769 2026-01-12 cs.AI cs.CL 73%

See or Say Graphs: Agent-Driven Scalable Graph Structure Understanding with Vision-Language Models

见或说图:基于视觉语言模型的 agent 驱动可扩展图结构理解

Shuo Han, Yukun Cao, Zezhong Ding, Zengyi Gao, S Kevin Zhou, Xike Xie

机构 * University of Science and Technology of China(中国科学技术大学) Data Darkness Lab, MIRACLE Center, USTC(数据黑暗实验室,MIRACLE中心,USTC) MIRACLE Center, Suzhou Institute for Advance Research, USTC(MIRACLE中心,苏州先进研究所,USTC)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.CL、cs.AI

AI总结 GraphVista 是一种基于视觉语言模型的 agent 驱动框架,通过分层图检索和模态协调机制,实现大规模图结构理解的可扩展性和性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02196 2026-01-12 cs.LG 70%

ACDZero: MCTS Agent for Mastering Automated Cyber Defense

ACDZero:用于掌握自动化网络防御的MCTS代理

Yu Li, Sizhe Tang, Rongqian Chen, Fei Xu Yu, Guangyu Jiang, Mahdi Imani, Nathaniel D. Bastian, Tian Lan

机构 * Dept of ECE, George Washington University(电子工程系,乔治华盛顿大学) Dept of ECE, Northeastern University(电子工程系,东北大学) Dept of EECS, United States Military Academy(电子工程与科学系,美国军事学院)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.LG

AI总结 ACDZero通过基于MCTS的规划策略和图神经网络实现高效自动化网络防御,提升防御奖励和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21674 2026-01-12 cs.DB cs.AI 70%

QueryGym: Step-by-Step Interaction with Relational Databases

QueryGym: 关系数据库中的分步交互

Haritha Ananthakrishnan, Harsha Kokel, Kelsey Sikes, Debarun Bhattacharjya, Michael Katz, Shirin Sohrabi, Kavitha Srinivas

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 QueryGym通过提供关系数据库分步交互环境,促进LLM查询规划代理的透明评估与错误修复研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05465 2026-01-12 cs.AI 70%

PRISMA: Reinforcement Learning Guided Two-Stage Policy Optimization in Multi-Agent Architecture for Open-Domain Multi-Hop Question Answering

PRISMA:基于强化学习的多智能体架构中两阶段策略优化

Yu Liu, Wenxiao Zhang, Cong Cao, Wenxuan Lu, Fangfang Yuan, Diandian Guo, Kun Peng, Qiang Sun, Kaiyan Zhang, Yanbing Liu, Jin B. Hong, Bowen Zhou, Zhiyuan Ma

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 PRISMA通过两阶段组相对策略优化,结合推理引导协作,解决多跳问答中的检索崩溃和学习不稳定问题,实现高性能和稳定部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05356 2026-01-12 cs.RO cs.AI cs.MA q-bio.QM 70%

PRISM: Protocol Refinement through Intelligent Simulation Modeling

通过智能仿真建模实现协议优化:PRISM

Brian Hsu, Priyanka V Setty, Rory M Butler, Ryan Lewis, Casey Stone, Rebecca Weinberg, Thomas Brettin, Rick Stevens, Ian Foster, Arvind Ramanathan

机构 * Argonne National Laboratory(阿贡国家实验室)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 PRISM通过智能仿真建模实现实验协议的自动化设计、验证和执行,结合语言模型代理、数字孪生验证和机器人执行,提供端到端的实验流程解决方案。

Comments 43 pages, 8 figures, submitted to RSC Digital Discovery. Equal contribution: B. Hsu, P.V. Setty, R.M. Butler. Corresponding author: A. Ramanathan

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05293 2026-01-12 cs.CR cs.AI 70%

A Survey of Agentic AI and Cybersecurity: Challenges, Opportunities and Use-case Prototypes

代理AI与网络安全的综述:挑战、机遇与用例原型

Sahaya Jestus Lazer, Kshitiz Aryal, Maanak Gupta, Elisa Bertino

机构 * Tennessee Tech University(田纳西科技大学) University of Nebraska Omaha(内布拉斯加大学奥马哈分校) Purdue University(普渡大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文综述了代理AI在网络安全中的应用,探讨了其在防御和攻击方面的双重用途,分析了系统性风险,并展示了三个实际用例以说明其在网络安全中的行为和影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05376 2026-01-12 cs.AI cs.CL 62%

The Persona Paradox: Medical Personas as Behavioral Priors in Clinical Language Models

医疗人设悖论:临床语言模型中的行为先验

Tassallah Abdullahi, Shrestha Ghosh, Hamish S Fraser, Daniel León Tramontini, Adeel Abbasi, Ghada Bourjeily, Carsten Eickhoff, Ritambhara Singh

机构 * Brown University(布朗大学) University of Tuebingen(图宾根大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 研究揭示医疗人设在临床语言模型中产生上下文依赖的性能权衡,显示其在重症护理任务中提升表现,但在初级护理中降低性能,且互动风格影响风险倾向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06021 2026-01-12 cs.CL 57%

Chaining the Evidence: Robust Reinforcement Learning for Deep Search Agents with Citation-Aware Rubric Rewards

证据链的构建:基于引用感知的鲁棒深度搜索代理强化学习

Jiajie Zhang, Xin Lv, Ling Feng, Lei Hou, Juanzi Li

机构 * Tsinghua University(清华大学) Zhipu AI(智谱AI)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出引用感知评分框架和组相对策略优化方法,用于提升深度搜索代理的鲁棒性和推理质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05478 2026-01-12 cs.CL 57%

The Facade of Truth: Uncovering and Mitigating LLM Susceptibility to Deceptive Evidence

真相的 facade:揭示并缓解 LLM 对欺骗性证据的易感性

Herun Wan, Jiaying Wu, Minnan Luo, Fanxiao Li, Zhi Zeng, Min-Yen Kan

机构 * Xi’an Jiaotong University(西安交通大学) National University of Singapore(新加坡国立大学) Yunnan University(云南大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出 MisBelief 框架揭示 LLM 对复杂欺骗性证据的脆弱性,并提出 DIS 机制缓解这一问题,提升模型对误导性证据的抵御能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05445 2026-01-12 cs.CR cs.LG 57%

Knowledge-Driven Multi-Turn Jailbreaking on Large Language Models

基于知识的多轮对抗攻击大语言模型

Songze Li, Ruishi He, Xiaojun Jia, Jun Wang, Zhihui Fu

机构 * Southeast University(东南大学) Nanyang Technological University(南洋理工大学) OPPO Research Institute(OPPO研究院)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 Mastermind通过动态知识库和分层规划架构,实现对大语言模型的高效多轮对抗攻击,显著提升攻击效果和防御韧性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05887 2026-01-12 cs.CR 50%

Cybersecurity AI: A Game-Theoretic AI for Guiding Attack and Defense

网络空间AI:一种基于博弈论的AI用于引导攻击与防御

Víctor Mayoral-Vilches, María Sanz-Gómez, Francesco Balassone, Stefan Rass, Lidia Salas-Espejo, Benjamin Jablonski, Luis Javier Navarrete-Lozano, Maite del Mundo de Torres, Cristóbal R. J. Veas Chavez

专题命中 规划推理 :reasoning(abstract)

AI总结 本文提出G-CTR,一种基于博弈论的AI指导层,通过生成摘要引导攻击与防御行为,提升网络安全测试效率与成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05606 2026-01-12 cs.MA 50%

Conformity Dynamics in LLM Multi-Agent Systems: The Roles of Topology and Self-Social Weighting

LLM多智能体系统中的从众动力学:拓扑结构与自我-社会权重的作用

Chen Han, Jin Tan, Bohan Yu, Wenzhen Zheng, Xijin Tang

专题命中 规划推理 :reasoning(abstract)

AI总结 本文研究了LLM多智能体系统中网络拓扑和自我-社会权重对集体决策效率、鲁棒性及失败模式的影响。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏