arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11120 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11120 篇

2603.16475 2026-06-05 cs.AI 57%

Breaking the Chain: A Causal Analysis of LLM Faithfulness to Intermediate Structures

打破链条:对LLM对中间结构忠实性的因果分析

Oleg Somov, Mikhail Chaichuk, Gleb Ershov, Karim Vafin, Mikhail Seleznyov, Alexander Panchenko, Elena Tutubalina

机构 * AIRI MIPT(莫斯科国立交通大学) HSE University(高等经济大学) Avito AI Lab(Avito人工智能实验室) Skoltech(斯克里普钦科技学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 研究探讨了在模式引导推理(SGR)管道中,LLM对中间结构的忠实性,发现尽管模型在自身中间结构上自洽,但对干预的响应不足,当将最终决策的推导委托给外部工具时,这种不稳定性显著降低。

Comments 20 pages, 4 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09923 2026-06-05 cs.AI 57%

CaMeLs Can Use Computers Too: System-level Security for Computer Use Agents

CaMeLs Can Use Computers Too: System-level Security for Computer Use Agents

Hanna Foerster, Tom Blanchard, Kristina Nikolić, Ilia Shumailov, Cheng Zhang, Robert Mullins, Nicolas Papernot, Florian Tramèr, Yiren Zhao

机构 * University of Cambridge(剑桥大学) University of Toronto & Vector Institute(多伦多大学及向量研究所) ETH Zurich(苏黎世联邦理工学院) AI Security Company(人工智能安全公司)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出了一种系统级安全方法,用于计算机使用代理(CUAs),通过单次规划和NOVA框架在动态UI状态下提供控制流完整性保障,同时在保持性能的同时提升安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22067 2026-06-05 cs.AI 57%

Semantic Partial Grounding via LLMs

通过大语言模型实现语义部分 grounding

Giuseppe Canonaco, Alberto Pozanco, Daniel Borrajo

机构 * Department of Computer Science, University of Cambridge(剑桥大学计算机科学系)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出SPG-LLM,利用大语言模型分析领域和问题文件,提前识别可能不相关的对象、动作和谓词,从而减少grounding任务的规模,提升grounding效率并在某些领域实现更优的计划成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05843 2026-06-05 cs.CL 57%

OdysseyArena: Benchmarking Large Language Models For Long-Horizon, Active and Inductive Interactions

OdysseyArena: 为长视界、主动和归纳交互评估大型语言模型

Hang Yan, Fangzhi Xu, Qiushi Sun, Jinyang Wu, Zixian Huang, Muye Huang, Jingyang Gong, Zichen Ding, Kanzhi Cheng, Yian Wang, Xinyu Che, Zeyi Sun, Jian Zhang, Zhangyue Yin, Haoran Luo, Ben Kao, Qika Lin

机构 * National University of Singapore(新加坡国立大学)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 本文提出OdysseyArena,通过长视界、主动和归纳交互评估大型语言模型,提供120个任务测量归纳效率和长视界发现,并通过OdysseyArena-Challenge测试极端交互视界下的模型稳定性,揭示前沿模型在复杂环境中的归纳能力瓶颈。

Comments 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11618 2026-06-05 cs.LG 57%

Optimal CO2 storage management considering safety constraints in multi-stakeholder multi-site CCS projects: a Markov game perspective

考虑安全约束的多利益相关者多地点碳捕集与封存项目最优存储管理:从马尔可夫博弈视角

Jungang Chen, Seyyed A. Hosseini

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 本文基于马尔可夫博弈方法,研究多利益相关者多地点碳捕集与封存项目中不同联盟结构对利益相关者目标的影响,提出一种考虑安全约束的多智能体强化学习框架,以实现多利益相关者的最优存储管理。

Comments 58 pages

Journal ref Int. J. Greenh. Gas Control 149 (2026) 104683

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15231 2026-06-05 cs.AI 57%

CangLing-KnowFlow: A Unified Knowledge-and-Flow-fused Agent for Comprehensive Remote Sensing Applications

CangLing-KnowFlow: 一个统一的知识与流程融合代理用于综合遥感应用

Zhengchao Chen, Haoran Wang, Jing Yao, Jianshe Zhang, Pedram Ghamisi, Jun Zhou, Peter M. Atkinson, Bing Zhang

机构 * State Key Laboratory of Remote Sensing and Digital Earth, Aerospace Information Research Institute, Chinese Academy of Sciences(遥感与数字地球国家重点实验室,航天信息研究所,中国科学院) Beijing Tiandi Shijie Technology Co., Ltd.(北京天帝世纪科技有限公司) Faculty of Science and Technology, Lancaster University(兰卡斯特大学科学与技术学院) Faculty of Electrical and Computer Engineering, University of Iceland(冰岛大学电气与计算机工程学院) Helmholtz-Zentrum Dresden-Rossendorf(德累斯顿-罗斯托克亥姆霍尔茨中心) School of Information and Communication Technology, Griffith University(格里菲斯大学信息与通信技术学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出CangLing-KnowFlow,一个融合知识与流程的统一智能代理框架,通过整合过程知识库、动态工作流调整和进化记忆模块,解决遥感数据处理中任务特定、缺乏统一框架的问题,并在KnowFlow-Bench基准测试中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04967 2026-06-04 cs.SE cs.AI 57%

From Prompt to Process: a Process Taxonomy and Comparative Assessment of Frameworks Supporting AI Software Development Agents

从提示到流程:支持AI软件开发智能体的框架流程分类与比较评估

Sanderson Oliveira de Macedo

机构 * Federal Institute of Goias(戈亚斯联邦理工学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 提出六维流程分类法,对六个AI软件开发框架进行评分比较,揭示流程深度与可移植性之间的结构性权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25649 2026-06-04 cs.LG 57%

Towards interpretable AI with quantum annealing feature selection

迈向可解释的人工智能:基于量子退火的特征选择

Francesco Aldo Venturelli, Emanuele Costa, Sikha O K, Bruno Juliá-Díaz, Miguel A. González Ballester, Alba Cervera-Lierta

机构 * BCN Medtech, Universitat Pompeu Fabra, Barcelona, Spain(BCN医疗科技,庞培法布拉大学,巴塞罗那,西班牙) Barcelona Supercomputing Center (BSC)(巴塞罗那超级计算中心(BSC)) Departament de Física Quàntica i Astrofísica, Facultat de Física, Universitat de Barcelona(巴塞罗那大学物理量子与天体物理系,物理系) Institut de Ciències del Cosmos, Universitat de Barcelona, ICCUB(巴塞罗那大学宇宙科学研究所,ICCUB) ICREA, Barcelona, Spain(ICREA,巴塞罗那,西班牙)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 提出一种利用量子退火选择最具代表性特征图的方法,以解释卷积神经网络的图像分类预测,相比GradCAM和GradCAM++提升了类别解缠和解释质量。

Comments Text improvement and extra tests in v2. 15 pages, 10 figures, 1 table, including appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03239 2026-06-03 cs.CL 57%

ARBOR: Online Process Rewards via a Reusable Rubric Buffer for Search Agents

ARBOR: 通过可复用评分标准缓冲区的在线过程奖励用于搜索智能体

Zheng Liu, Longxiang Zhang, Xintong Wang, Zhiang Xu, Shaoxiong Zhan, Xin Shan, Wen Huang, Tao Dai, Shu-Tao Xia, Chengfu Huo, Liang Ding

机构 * Tsinghua University(清华大学) Alibaba Group(阿里巴巴集团) Peking University(北京大学) Shenzhen University(深圳大学)

专题命中 规划推理 :verifier(abstract);分类 cs.CL

AI总结 针对基于LLM的搜索智能体训练中结果奖励缺乏过程监督的问题,提出ARBOR框架,通过维护跨查询共享的评分标准记忆库,利用对比轨迹生成局部草案并整合为通用评分标准,以稀疏成对判断提供过程级梯度,在四个多跳QA基准上优于GRPO和DAPO基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03197 2026-06-03 cs.CL 57%

MemTrain: Self-Supervised Context Memory Training

MemTrain:自监督上下文记忆训练

Ziheng Li, Xingrun Xing, Haoqing Wang, Zhi-Hong Deng, Yehui Tang

机构 * State Key Laboratory of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(通用人工智能国家重点实验室,智能科学与技术学院,北京大学) Samsung Research, Beijing, China(三星研究院,北京,中国)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 提出自监督框架MemTrain,通过两个耦合代理任务(端到端掩码重建和中间记忆召回)利用无标签维基百科语料增强LLM代理的上下文记忆能力,显著提升下游长文本推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02983 2026-06-03 cs.CL 57%

A Locally Deployed RAG-Based Academic Advising System for Course Selection

基于本地部署RAG的课程选择学术咨询系统

Feng Li, Yoritaka Iwata

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 提出一种本地部署的RAG学术咨询系统,利用大语言模型和结构化课程大纲检索,以隐私保护方式支持课程选择、先修课程理解和个性化学习规划。

Comments to be published in Elsevier's Procedia Computer. Sci. (KES 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24008 2026-06-03 cs.AI 57%

SPARK: Search Personalization via Agent-Driven Retrieval and Knowledge-sharing

SPARK:通过智能体驱动的检索和知识共享实现搜索个性化

Gaurab Chhetri, Subasish Das, Tausif Islam Chowdhury

机构 * Texas State University(德克萨斯州立大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出SPARK框架,利用基于角色的多智能体LLM协作实现动态个性化搜索,通过协调器激活相关专家智能体,结合记忆和推理模块,从分布式行为中涌现个性化特性。

Comments This is the author's preprint. Accepted to WEB&GRAPH 2026 (co-located with WSDM 2026), Boise, Idaho, USA, Feb 26, 2026. Final version will appear in WSDM 2026 Companion Proceedings. Conf: https://wsdm-conference.org/2026/ Workshop: https://aiimlab.org/events/WSDM_2026_WEB_and_GRAPH_2026_Workshop_on_Web_and_Graphs_Responsible_Intelligence_and_Social_Media.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17220 2026-06-03 cs.MA cs.AI 57%

Dynamics of Cognitive Heterogeneity: Investigating Behavioral Biases in Multi-Stage Supply Chains with LLM-Based Simulation

认知异质性动力学:基于大语言模型模拟的多阶段供应链中行为偏差研究

Jiuyun Jiang, Yuecheng Hong, Bo Yang, Jin Yang, Guangxin Jiang, Xiaomeng Guo, Guang Xiao

机构 * Harbin Institute of Technology(哈尔滨工业大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文通过引入大语言模型模拟多阶段供应链,基于分层推理框架分析认知异质性对智能体交互的影响,发现信息共享可缓解短视和自利行为导致的系统效率低下。

Comments Accepted to the Main Conference of ACL 2026. 18 pages, 8 figures in total (9 pages, 7 figures for the main text)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10387 2026-06-03 cs.DB cs.AI 57%

Test-Time Optimization of Physical Query Plans with LLMs

基于LLM的物理查询计划测试时优化

Mehmet Hamza Erol, Xiangpeng Hao, Federico Bianchi, Ciro Greco, Jacopo Tagliabue, James Zou

机构 * Stanford University(斯坦福大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) TogetherAI Bauplan

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出DBPlanBench框架,利用LLM在测试时通过语义推理和进化搜索优化物理查询计划,在OLAP查询中实现1.05-1.12倍中位数加速,并支持小规模到大规模的迁移。

Comments Code is available at: https://github.com/BauplanLabs/DBPLANBENCH

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02304 2026-06-02 cs.CL 57%

Unified Context Evolution for LLM Agents

统一上下文演化:面向LLM智能体

Zixuan Zhu, Yitong Hu, Yong Dai, Junfeng Fang, Chunyang Jiang, Senkang Hu, Yuzhi Zhao

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 提出统一上下文演化(UCE)框架,通过将智能体经验外部化为四种类型的可演化上下文单元(ECU),实现跨任务的知识积累与动态调度,在ALFWorld和WebShop上显著提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02001 2026-06-02 cs.CL 57%

Scaling Agentic Capabilities via Grounded Interaction Synthesis

通过基于交互合成扩展智能体能力

Wenhang Shi, Jinhao Dong, Yiren Chen, Zhe Zhao, Shuqing Bian, Wei Lu, Xiaoyong Du

机构 * Renmin University of China(中国人民大学) Peking University(北京大学) Tencent(腾讯)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 提出GAIS框架,通过两阶段接地机制(协议锚定环境和结构引导规划)自动生成多样化的环境和复杂任务,显著提升智能体在BFCL、τ²-Bench和ACEBench上的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01813 2026-06-02 cs.CL 57%

Cost-Aware Diffusion Draft Trees for Speculative Decoding

用于推测解码的成本感知扩散草稿树

Shuai Zhang, Huachuan Qiu, Hongliang He, Yong Dai

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 提出CaDDTree方法,通过联合优化树结构和节点预算直接最大化令牌吞吐量,并证明在凸验证成本下吞吐量函数是单峰的,从而无需离线预算搜索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01667 2026-06-02 cs.LG 57%

ATLAS: Agentic Test-time Learning-to-Allocate Scaling

ATLAS: 智能体测试时学习分配缩放

Peijia Qin, Qi Cao, Pengtao Xie

机构 * University of California, San Diego(加州大学圣迭戈分校)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 提出ATLAS框架,让LLM编排器通过单一

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01610 2026-06-02 cs.AI 57%

Revisiting Ripple Effects in Knowledge Editing through Pressure-Aware Joint Neighborhood Optimization

重新审视知识编辑中的涟漪效应:通过压力感知联合邻域优化

Haoben Huang, Shuxin Liu, Ou Wu, Di Gao

机构 * Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(杭州高等研究院,中国科学院大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 针对大语言模型单次编辑引发的涟漪效应,提出联合邻域优化框架,通过压力感知协调和语义预执行门控联合优化可编辑侧与保留侧的耦合压力,在RippleEdits上传播与保留指标提升至少7.0%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01312 2026-06-02 eess.SP cs.AI cs.NI 57%

A Communication-Centric 6G-LLM Architecture for Scalable Tactical Autonomous Defense Vehicle Networks

面向可扩展战术自主防御车辆网络的以通信为中心的6G-LLM架构

Kiran Khurshid, Shumaila Javaid, Nasir Saeed

机构 * Department of Computer and Software Engineering, National University of Sciences and Technology (NUST), Islamabad, Pakistan(计算机与软件工程系,国家科学与技术大学(NUST),伊斯兰堡,巴基斯坦) Department of Control Science and Engineering, College of Electronics and Information Engineering, Tongji University and National Key Laboratory of Autonomous Intelligent Unmanned Systems, Tongji University, China(控制科学与工程系,电子与信息工程学院,同济大学,以及自主智能无人机系统国家重点实验室,同济大学,中国) Department of Electrical and Communication Engineering, UAE University, Al-Ain 15551, UAE(电子与通信工程系,阿联酋大学,阿恩15551,阿联酋)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出一种以通信为中心的分层架构,通过集成边缘辅助大语言模型推理与6G语义通信,在战术自主防御车辆网络中实现协调效率提升、通信开销降低和延迟韧性增强。

Comments 10 pages, accepted in IEEE Network Magazine

Journal ref K. Khurshid, S. Javaid and N. Saeed, "A Communication-Centric 6G-LLM Architecture for Scalable Tactical Autonomous Defense Vehicle Networks," in IEEE Network, Early access, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01230 2026-06-02 cs.AI 57%

HomeFlow: A Data Flywheel for Smart Home Agent Training with Verifiable Simulation

HomeFlow: 面向智能家居智能体训练的可验证数据飞轮

Yi Gu, Huacan Wang, Shuo Zhang, Yuqing Hou, Lei Xue, Weipeng Ming, Chen Liu, Fangzhou Yu, Kuan Li, Ronghao Chen, Sen Hu, Xiaofeng Mou, Yi Xu

机构 * Midea Group(美的集团) Beijing University of Posts and Telecommunications(北京邮电大学) Donghua University(东华大学) Peking University(北京大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出HomeFlow,一种通过统一仿真环境HomeEnv、程序化家居生成HomeMaker、蓝图编译用户意图、MCTS-Flow合成可验证轨迹,并结合监督微调和逐步RLVE优化智能体的可验证数据飞轮方法,在SmartHome-Bench上达到84.60%和87.03%的任务成功率,其中8B模型超越GPT-5.5 1.23个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01199 2026-06-02 cs.AI 57%

Can LLM Agents Sustain Long-Horizon Organizational Dynamics?

LLM智能体能否维持长期组织动态?

Xuancheng Zhu, Yang Yue, Shuaibing Wan, Zihan Dou, Xiaohan Zhang, Yongrui Liu, Guoshun Nan

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 提出TaskWeave分层智能体框架,通过记忆中心的协调机制(规划-分解-诊断-对齐循环和依赖感知追踪记忆)实现长期组织模拟,实验表明该框架能维持连贯的组织动态并产生可靠的人工制品。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01091 2026-06-02 cs.CL 57%

Deep Research as Rubric for Reinforcement Learning

深度研究作为强化学习的评估准则

Wangyi Mei, Zhouhong Gu, Zhenhan Bai, Yin Cai, Lefan Zhang, Zhenxin Ding, Bo Chen, Yan Gao, Yi Wu, Yao Hu, Jiaqing Liang, Deqing Yang

机构 * Fudan University(复旦大学) Xiaohongshu Inc.(小红书公司) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 提出DR-rubric框架,通过两阶段过程(迭代多轮智能体搜索构建准则,然后蒸馏为可验证约束用于GRPO策略优化)为开放式推理和长文本生成任务生成细粒度奖励信号,实验表明该方法在多个基准上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01015 2026-06-02 cs.RO cs.AI cs.NI cs.SY eess.SY 57%

AI-IoT-Robotics Integration: Survey of Frameworks, Emerging Trends, and the Path Toward Connected Robotics

AI-IoT-机器人集成:框架、新兴趋势及迈向互联机器人的路径综述

Ranulfo Bezerra, Satoshi Tadokoro, Kazunori Ohno

机构 * Tohoku University(东大大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文综述了人工智能、物联网和机器人三者融合的现状,提出了模块化系统架构,并强调了小语言模型(SLM)和大型语言模型(LLM)在分布式认知与自主决策中的作用,为下一代互联机器人和物理AI生态系统提供了概念和技术路线图。

Comments 15 pages, 3 figures, 3 tables. Published in IEEE Internet of Things Journal

Journal ref IEEE Internet of Things Journal, vol. 13, no. 10, pp. 20398-20412, 15 May15, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00765 2026-06-02 cs.AI 57%

FALAT: Tracing Failures in LLM Agent Trajectories via Dependency-Guided Search

FALAT: 通过依赖引导搜索追踪LLM智能体轨迹中的失败

Md Nakhla Rafi, Md Ahasanuzzaman, Dong Jae Kim, Zhijie Wang, Tse-Hsun Chen

机构 * SPEAR Lab(SPEAR实验室) Concordia University(康科德大学) DePaul University(德保罗大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出FALAT框架,通过依赖引导搜索方法,在LLM智能体轨迹中识别导致失败的关键步骤和责任智能体。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00590 2026-06-02 cs.IR cs.AI 57%

Critic-R: Improving Agentic Search using Instruction-tuned Retrievers with Natural Language Introspective Feedback

Critic-R:使用具有自然语言内省反馈的指令调优检索器改进智能搜索

Md Zarif Ul Alam, Alireza Salemi, Hamed Zamani

机构 * Center for Intelligent Information Retrieval(智能信息检索中心) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出Critic-R框架,通过引入评论模型评估智能体内省推理轨迹,实现检索模型与推理代理之间的反馈闭环,无需人工标注即可优化检索质量与下游答案准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00572 2026-06-02 cs.LG 57%

Spatiotemporal Multi-Task Graph Transformer for Trip-Level Transit Prediction

时空多任务图Transformer用于行程级公交预测

Oluwaleke Yusuf, Adil Rasheed, Frank Lindseth

机构 * Department of Engineering Cybernetics, Norwegian University of Science and Technology (NTNU)(工程 cybernetics 部,挪威科学与技术大学(NTNU)) Department of Computer Science, Norwegian University of Science and Technology (NTNU)(计算机科学部,挪威科学与技术大学(NTNU))

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 提出SMT-GraphFormer,一种将行程级公交预测建模为序列到序列问题的时空多任务图Transformer,通过图嵌入、上下文编码器和多门专家混合模块,在挪威特隆赫姆公交数据上优于停靠级基线方法。

Comments 25 pages, 7 figures, 11 tables, including appendix. Code available at https://github.com/Outsiders17711/SMTGraphFormer

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01797 2026-06-02 cs.AI 57%

Neural Decision-Propagation for Answer Set Programming

面向回答集编程的神经决策传播

Thomas Eiter, Katsumi Inoue, Sota Moriyama

机构 * Vienna University of Technology (TU Wien)(维也纳技术大学( TU Wien)) National Institute of Informatics(日本信息处理学会) The Graduate University for Advanced Studies, SOKENDAI(高级研究大学,SOKENDAI)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出决策传播(DProp)方法及其可微扩展神经决策传播(NDProp),通过交替假决策和真传播高效计算稳定模型,提升神经符号推理的可扩展性和准确性。

Comments This is the full version (with appendix) of a paper appearing at the 35th International Joint Conference on Artificial Intelligence (IJCAI-ECAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00523 2026-06-02 cs.CL 57%

ProactiveLLM: Learning Active Interaction for Streaming Large Language Models

ProactiveLLM: 学习流式大语言模型的主动交互

Junlong Tong, Yao Zhang, Anhao Zhao, Yingqi Fan, Yunpu Ma, Xiaoyu Shen

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 提出ProactiveLLM,利用模型内生状态指导交互决策,通过掩码流式建模和同步特权自蒸馏实现主动交互,减少延迟并保持质量。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00315 2026-06-02 cs.AI cond-mat.mtrl-sci 57%

Coupling Language Models with Physics-based Simulation for Synthesis of Inorganic Materials

将语言模型与基于物理的模拟相结合用于无机材料的合成

Edward W. Staley, Tom Arbaugh, Michael Pekala, Alexander New, Christopher D. Stiles, Nam Q. Le, Gregory Bassen, Wyatt Bunstine, Tyrel McQueen

机构 * Johns Hopkins Applied Physics Laboratory(约翰霍普金斯应用物理实验室) Johns Hopkins University(约翰霍普金斯大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 提出一种结合热力学数据库与简化动力学模型的混合框架,评估大语言模型在无机材料合成规划中的表现,以铌氧体系为例证明其能生成更可行的合成策略。

Comments Accepted to the AI for Accelerated Materials Design (AI4Mat) Workshop at Neurips 2025

详情

展开后加载摘要…

URL PDF HTML 收藏