arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-01-23 至 2026-01-23 共收录 13 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 13 篇

2601.01910 2026-01-23 cs.AI 83%

MMP-A*: Multimodal Perception Enhanced Incremental Heuristic Search on Path Planning

MMP-A*:多模态感知增强的路径规划增量启发式搜索

Minh Hieu Ha, Khanh Ly Ta, Hung Phan, Tung Doan, Tung Dao, Dao Tran, Huynh Thi Thanh Binh

机构 * Hanoi University of Science and Technology(河内科学技术大学) Vingroup Big Data Research Center(VinGroup大数据研究中心) FPT Software AI Center(FPT软件AI中心)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);分类 cs.AI

AI总结 MMP-A*通过融合视觉语言模型的空间感知与自适应衰减机制,提升路径规划的几何精度与计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11833 2026-01-23 cs.AI 79%

Thought of Search: Planning with Language Models Through The Lens of Efficiency

思考搜索:通过效率的视角进行语言模型规划

Michael Katz, Harsha Kokel, Kavitha Srinivas, Shirin Sohrabi

机构 * David S. Hippocampus Department of Computer Science(戴维·S·海马科斯学院计算机科学系) Cranberry-Lemon University(Cranberry-Lemon大学) IBM Research(IBM研究院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种高效且保持正确性和完备性的LLM规划方法,通过解决四个代表性搜索问题展示其有效性,并呼吁研究社区关注效率与正确性的平衡。

Comments Accepted at NeurIPS 2024, https://papers.nips.cc/paper_files/paper/2024/hash/fa080fe0f218871faec1d8ba20e491d5-Abstract-Conference.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09049 2026-01-23 cs.AI cs.CV cs.RO 77%

VIKI-R: Coordinating Embodied Multi-Agent Cooperation via Reinforcement Learning

VIKI-R: 通过强化学习协调具身多智能体合作

Li Kang, Xiufeng Song, Heng Zhou, Yiran Qin, Jie Yang, Xiaohong Liu, Philip Torr, Lei Bai, Zhenfei Yin

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract);planning(abstract);分类 cs.AI

AI总结 VIKI-R通过强化学习协调多智能体合作,提出分层基准VIKI-Bench,显著提升多智能体视觉驱动合作性能。

Comments Accepted by NeurIPS 2025 Track on Datasets and Benchmarks. Project page: https://faceong.github.io/VIKI-R/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17915 2026-01-23 cs.MA 71%

DISPATCH -- Decentralized Informed Spatial Planning and Assignment of Tasks for Cooperative Heterogeneous Agents

DISPATCH -- 分布式知情空间规划与任务分配以实现协作异构代理

Yao Liu, Sampad Mohanty, Elizabeth Ondula, Bhaskar Krishnamachari

专题命中 规划推理 :planning(title)

AI总结 DISPATCH提出两种算法,通过整合公平性和效率,在分布式环境下实现异构代理任务分配的公平与效率平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15533 2026-01-23 cs.AI 70%

From Generative Engines to Actionable Simulators: The Imperative of Physical Grounding in World Models

从生成引擎到可操作模拟器:世界模型中物理基础的必要性

Zhikang Chen, Tingting Zhu

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出将世界模型重新定义为可操作模拟器,强调因果结构和约束意识,以提升医疗决策中的反事实推理和长期预见能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15743 2026-01-23 cond-mat.mtrl-sci 67%

Materealize: a multi-agent deliberation system for end-to-end material design and synthesis

Materealize: 一种用于端到端材料设计与合成的多智能体协商系统

Seongmin Kim, Jaehwan Choi, Kunik Jang, Junkil Park, Varinia Bernales, Alán Aspuru-Guzik, Yousung Jung

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 Materealize通过多智能体协商系统实现端到端无机材料设计与合成,结合工具精度与推理整合,提升计算发现与实验实现的衔接。

Comments 30 pages main text, 8 main figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05882 2026-01-23 cs.CL cs.AI cs.LG 67%

Collaborate, Deliberate, Evaluate: How LLM Alignment Affects Coordinated Multi-Agent Outcomes

协作、审议、评估:LLM对齐如何影响协调的多智能体结果

Abhijnan Nath, Carine Graff, Nikhil Krishnaswamy

机构 * Natural Language (SIGNAL) Lab Colorado State University Fort Collins, CO USA Natural Language (SIGNAL) Lab Colorado State University

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文研究了LLM对齐方法如何影响多智能体协作效果,通过干预代理促进审议式决策,发现鲁棒性方法在支持正确任务结果方面表现更优。

Comments This submission is a new version of arXiv:2509.05882v1. with a substantially revised experimental pipeline and new metrics. In particular, collaborator agents are now instantiated independently via separate API calls, rather than generated autoregressively by a single agent. All experimental results are new. Accepted as an extended abstract at AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15703 2026-01-23 cs.AI cs.CL 62%

Agentic Uncertainty Quantification

代理不确定性量化

Jiaxin Zhang, Prafulla Kumar Choubey, Kung-Hsiang Huang, Caiming Xiong, Chien-Sheng Wu

机构 * Salesforce AI Research(Salesforce人工智能研究)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出双过程代理UQ框架,通过不确定性感知记忆与反思机制,实现主动双向控制信号,提升代理在长周期推理中的可靠性和性能。

Comments 36 pages, 9 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15296 2026-01-23 cs.CL cs.AI 62%

Entropy-Tree: Tree-Based Decoding with Entropy-Guided Exploration

熵树:基于熵引导的树状解码

Longxuan Wei, Yubo Zhang, Zijiao Zhang, Zhihu Wang, Shiwan Zhao, Tianyu Huang, Huiting Zhao, Chenfei Liu, Shenao Zhang, Junchi Yan

机构 * Shanghai Jiaotong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Huawei Technologies Ltd.(华为技术有限公司) Nankai University(南开大学) Nanyang Technological University(南洋理工大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 熵树通过利用熵信号指导分支决策,提升解码效率和不确定性估计的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11298 2026-01-23 cs.NI cs.AI cs.CL 62%

Integrating Language Models for Enhanced Network State Monitoring in DRL-Based SFC Provisioning

在基于深度强化学习的SFC配置中整合语言模型以增强网络状态监控

Parisa Fard Moshiri, Murat Arda Onsu, Poonam Lohan, Burak Kantarci, Emil Janulewicz

机构 * University of Ottawa(渥太华大学) Ciena(Ciena公司)

专题命中 规划推理 :planning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出将深度强化学习与BERT结合,以提升基于DRL的SFC配置中网络状态监控的效率和准确性。

Comments 6 pages, 5 figures, submitted to 30th IEEE International Symposium on Computers and Communications (ISCC) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04037 2026-01-23 cs.AI 57%

Evolving in Tasks: Empowering the Multi-modality Large Language Model as the Computer Use Agent

任务演化:使多模态大语言模型成为计算机使用代理

Yuhao Cheng, Liang Tang, Shuxian Li, Yukang Huo, Tiaonan Duan, Kaer Huang, Yanzhe Jing, Yiqiang Yan

机构 * Lenovo Research(联想研究) China Agricultural University(中国农业大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出自演化代理(SEA),通过数据生成、强化学习和模型增强三个创新,使7B参数模型在计算机使用任务中超越同类模型并接近更大规模模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08620 2026-01-23 cs.LG 57%

CT-PatchTST: Channel-Time Patch Time-Series Transformer for Long-Term Renewable Energy Forecasting

CT-PatchTST:用于长周期可再生能源预测的通道-时间补丁时间序列变压器

Kuan Lu, Menghao Huo, Yuxiao Li, Qiang Zhu, Zhenrui Chen

机构 * School of Electrical and Computer Engineering(电气与计算机工程学院) Cornell University(康奈尔大学) Department of Electrical and Computer Engineering(电气与计算机工程系) Northeastern University(东北大学) Fu Foundation School of Engineering and Applied Science(富兰克林基金会工程与应用科学学院) Columbia University in the City of New York(纽约市哥伦比亚大学) School of Engineering(工程学院) Santa Clara University(圣克拉拉大学) Department of Mechanical and Aerospace Engineering(机械与航空航天工程系) University of Houston(休斯顿大学)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 CT-PatchTST通过捕捉时间依赖性和跨通道相关性,提升风能和太阳能的长周期预测精度,优化能源存储调度,增强电网稳定性与响应性。

Comments Published in: 2025 10th International Conference on Computer and Information Processing Technology (ISCIPT)

Journal ref 2025 10th International Conference on Computer and Information Processing Technology (ISCIPT), pp. 86-95

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15486 2026-01-23 cs.RO 50%

A Universal Large Language Model -- Drone Command and Control Interface

通用大型语言模型——无人机指挥与控制接口

Javier N. Ramos-Silva, Peter J. Burke

专题命中 规划推理 :planning(abstract)

AI总结 本文提出了一种通用的无人机控制接口,通过MCP协议实现LLM与无人机的无缝集成,提供实时导航和飞行控制能力。

详情

展开后加载摘要…

URL PDF HTML 收藏