arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-11-25 至 2025-11-25 共收录 29 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 29 篇

2511.19155 2025-11-25 cs.AI 85%

EEG-VLM: A Hierarchical Vision-Language Model with Multi-Level Feature Alignment and Visually Enhanced Language-Guided Reasoning for EEG Image-Based Sleep Stage Prediction

EEG-VLM:一种具有多级特征对齐和视觉增强语言引导推理的分层视觉-语言模型,用于基于EEG图像的睡眠阶段预测

Xihe Qiu, Gengchen Ma, Haoyu Wang, Chen Zhan, Xiaoyu Tan, Shuo Li

机构 * School of Electronic and Electrical Engineering, Shanghai University of Engineering Science(上海工程技术大学电子与电气工程学院) Department of Control Science and Engineering, College of Electronics and Information Engineering, Tongji University(同济大学电子信息工程学院控制科学与工程系) Tencent Youtu Lab(腾讯云视觉实验室) Case Western Reserve University(凯斯西储大学)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

AI总结 EEG-VLM通过多级特征对齐和视觉增强语言引导推理,提升基于EEG图像的睡眠阶段分类的准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08068 2025-11-25 cs.AI 84%

A Roadmap to Guide the Integration of LLMs in Hierarchical Planning

引导大型语言模型在分层规划中整合的路线图

Israel Puerta-Merino, Carlos Núñez-Molina, Pablo Mesejo, Juan Fernández-Olivares

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);分类 cs.AI

AI总结 本文提出了一条引导大型语言模型在分层规划中整合的路线图,通过分类整合方法和建立基准测试,探索LLMs在分层规划中的应用潜力。

Comments 5 pages, 0 figures, to be published in the AAAI Workshop on Planning in the Era of LLMs ( https://llmforplanning.github.io )

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18171 2025-11-25 cs.AI 83%

BPMN to PDDL: Translating Business Workflows for AI Planning

BPMN到PDDL:为AI规划翻译业务流程

Jasper Nie, Christian Muise, Victoria Armstrong

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);分类 cs.AI

AI总结 本研究提出将BPMN 2.0转换为PDDL的框架,支持核心业务流程构造,并通过非确定性规划器生成和评估执行轨迹,为AI规划提供基础。

Comments 8 pages, 3 figures. Code and generated PDDL outputs available at https://github.com/QuMuLab/bpmn-to-pddl-translation

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17986 2025-11-25 cs.CV cs.AI 83%

Plan-X: Instruct Video Generation via Semantic Planning

Plan-X: 通过语义规划指导视频生成

Lun Huang, You Xie, Hongyi Xu, Tianpei Gu, Chenxu Zhang, Guoxian Song, Zenan Li, Xiaochen Zhao, Linjie Luo, Guillermo Sapiro

机构 * Duke University(杜克大学) Princeton University(普林斯顿大学) ByteDance Intelligent Creation(字节跳动智能创作) Apple(苹果公司)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);分类 cs.AI

AI总结 Plan-X通过语义规划框架减少视频生成中的视觉幻觉,实现与多模态上下文一致的精细指令对齐生成。

Comments The project page is at https://byteaigc.github.io/Plan-X

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17506 2025-11-25 cs.NI cs.AI 83%

AURA: Adaptive Unified Reasoning and Automation with LLM-Guided MARL for NextG Cellular Networks

AURA: 一种基于LLM引导的多智能体强化学习的自适应统一推理与自动化方法用于NextG蜂窝网络

Narjes Nourzad, Mingyu Zong, Bhaskar Krishnamachari

专题命中 规划推理 :reasoning(title,abstract);planning(abstract);分类 cs.AI

AI总结 AURA结合LLM推理与MARL适应性,通过信任机制平衡局部学习与外部输入,提升NextG网络的实时管理和动态流量处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18230 2025-11-25 cs.CR 82%

Think Fast: Real-Time IoT Intrusion Reasoning Using IDS and LLMs at the Edge Gateway

Think Fast: 在边缘网关使用IDS和LLMs实现实时物联网入侵推理

Saeid Jamshidi, Amin Nikanjam, Negar Shahabi, Kawser Wazed Nafi, Foutse Khomh, Samira Keivanpour, Rolando Herrero

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract)

AI总结 本文提出一种在边缘网关使用IDS和LLMs实现实时物联网入侵检测的框架,通过整合轻量级ML模型和预训练大语言模型,提升检测准确性、语义可解释性和操作效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18313 2025-11-25 cs.CL cs.DB cs.IR cs.LG 81%

Path-Constrained Retrieval: A Structural Approach to Reliable LLM Agent Reasoning Through Graph-Scoped Semantic Search

路径约束检索:一种通过图域语义搜索实现可靠LLM代理推理的结构方法

Joseph Oladokun

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.LG

AI总结 路径约束检索通过结合结构图约束与语义搜索,提升LLM代理推理的可靠性和一致性。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19055 2025-11-25 eess.SY cs.AI cs.SY math.OC 79%

Large Language Model-Assisted Planning of Electric Vehicle Charging Infrastructure with Real-World Case Study

基于大语言模型的电动汽车充电基础设施规划与现实案例研究

Xinda Zheng, Canchen Jiang, Hao Wang

机构 * Department of Data Science and AI, Faculty of Information Technology, Monash University(数据科学与人工智能系,信息科技学院,莫纳什大学) Monash Energy Institute, Monash University(莫纳什能源研究所,莫纳什大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出利用大语言模型优化电动汽车充电基础设施规划,通过空间-时间需求动态建模和分布式优化算法,实现实用案例中总成本降低30%。

Journal ref Sustainable Energy Technologies and Assessments, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18749 2025-11-25 cs.CL cs.CY cs.IR 79%

Large Language Models Require Curated Context for Reliable Political Fact-Checking -- Even with Reasoning and Web Search

大语言模型需要经过筛选的上下文才能可靠地进行政治事实核查——即使有推理和网络搜索

Matthew R. DeVerna, Kai-Cheng Yang, Harry Yaojun Yan, Filippo Menczer

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 大语言模型需通过筛选的上下文提升政治事实核查的可靠性,定制RAG系统显著提升宏F1指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11043 2025-11-25 cs.AI cs.RO 79%

Autonomous Vehicle Path Planning by Searching With Differentiable Simulation

通过可微模拟进行自动驾驶路径规划

Asen Nachkov, Jan-Nico Zaech, Danda Pani Paudel, Xi Wang, Luc Van Gool

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出DSS框架,利用可微模拟器Waymax进行路径规划,通过梯度下降优化动作序列,提升自动驾驶的跟踪和路径规划精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15668 2025-11-25 cs.AI cs.FL 79%

Preprint: Exploring Inevitable Waypoints for Unsolvability Explanation in Hybrid Planning Problems

预印本:探索不可回避的路径点以解释混合规划问题中的不可解性

Mir Md Sajid Sarwar, Rajarshi Ray

机构 * School of Mathematical and Computational Sciences, Indian Association for the Cultivation of Science, Kolkata(数学与计算科学学院,印度科学培养协会,科希马)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种基于最长公共子序列问题的新型方法,用于识别混合规划问题中的不可回避路径点,从而解释其不可解性。

Journal ref ACM Transactions on Embedded Computing Systems, Volume 24, Issue 6, Article No.: 163, Year: 09 Oct0ber 2025, Pages 1 - 20

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18296 2025-11-25 cs.AI 79%

Deep Learning Decision Support System for Open-Pit Mining Optimisation: GPU-Accelerated Planning Under Geological Uncertainty

基于深度学习的露天矿优化决策支持系统:在地质不确定性下的GPU加速规划

Iman Rahimi

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本研究提出了一种基于深度学习的决策支持系统,利用变分自编码器和混合元启发式算法,在地质不确定性下实现GPU加速的露天矿优化规划。

Comments 67 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18393 2025-11-25 cs.CL 77%

Towards Robust and Fair Next Visit Diagnosis Prediction under Noisy Clinical Notes with Large Language Models

基于大型语言模型的噪声临床笔记下的稳健与公平下次就诊诊断预测

Heejoon Koo

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

AI总结 本文提出基于大型语言模型的稳健与公平下次就诊诊断预测方法,通过标签缩减和分层推理策略提升预测鲁棒性和公平性。

Comments Accepted by the Association for the Advancement of Artificial Intelligence (AAAI) 2026 1st Workshop on Safe, Ethical, Certified, Uncertainty-aware, Robust, and Explainable AI for Health (SECURE-AI4H)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18743 2025-11-25 cs.CL cs.AI 73%

RhinoInsight: Improving Deep Research through Control Mechanisms for Model Behavior and Context

RhinoInsight: 通过模型行为和上下文的控制机制提升深度研究

Yu Lei, Shuzheng Si, Wei Wang, Yifei Wu, Gang Chen, Fanchao Qi, Maosong Sun

机构 * DeepLang AI Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学) Beijing University of Posts and Telecommunications(北京邮电大学) Beijing Jiaotong University(北京交通大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.CL、cs.AI

AI总结 RhinoInsight通过引入可验证检查表和证据审计两种控制机制,提升深度研究任务的鲁棒性和可追溯性,同时保持在深度搜索任务中的竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18270 2025-11-25 cs.RO 67%

Skypilot: Fine-Tuning LLM with Physical Grounding for AAV Coverage Search

Skypilot: 通过物理现实 grounding 提升 LLM 在 AAV 覆盖搜索中的微调

Zhongkai Chen, Yihao Sun, Chao Yan, Han Zhou, Xiaojia Xiang, Jie Jiang

机构 * College of Intelligence Science and Technology, National University of Defense Technology(智能科学与技术学院,国防科技大学) College of Automation Engineering, Nanjing University of Aeronautics and Astronautics(自动化工程学院,南京航空航天大学) China Academy of Launch Vehicle Technology(中国运载火箭技术研究院)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 Skypilot通过结合MCTS和物理感知奖励函数,提升LLM在AAV覆盖搜索中的微调效果,实现高效且高质量的决策与路径规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18262 2025-11-25 cs.CV 67%

MammothModa2: A Unified AR-Diffusion Framework for Multimodal Understanding and Generation

MammothModa2: 一种用于多模态理解和生成的统一AR-扩散框架

Tao Shen, Xin Wan, Taicai Chen, Rui Zhang, Junwen Pan, Dawei Lu, Fanding Lei, Zhilin Lu, Yunfei Yang, Chen Cheng, Qi She, Chang Liu, Zhenbang Sun

机构 * ByteDance(字节跳动)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 MammothModa2通过统一的AR-扩散框架实现多模态理解和生成,结合自回归语义规划与扩散生成,取得文本到图像和指令编辑的优异表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18653 2025-11-25 cs.CR cs.AI cs.LG 62%

FHE-Agent: Automating CKKS Configuration for Practical Encrypted Inference via an LLM-Guided Agentic Framework

FHE-Agent:通过LLM引导的代理框架自动化CKKS配置以实现实用的加密推断

Nuo Xu, Zhaoting Gong, Ran Ran, Jinwei Tang, Wujie Wen, Caiwen Ding

机构 * University of Minnesota -- Twin Cities(明尼苏达大学-双城分校) North Carolina State University(北卡罗来纳州立大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 FHE-Agent通过LLM引导的代理框架自动化CKKS配置,提升加密推断的精度与效率

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18084 2025-11-25 cs.LG cs.AI 62%

The Alignment Paradox of Medical Large Language Models in Infertility Care: Decoupling Algorithmic Improvement from Clinical Decision-making Quality

医学大语言模型在不孕症护理中的对齐悖论:解耦算法改进与临床决策质量

Dou Liu, Ying Long, Sophia Zuoqiu, Kaipeng Xie, Runze Yang, Di Liu, Kang Li, Yiting Lin, Hanyi Liu, Rong Yin, Tian Tang

机构 * Department of Obstetrics and Gynecology, West China Second University Hospital(妇产科部门,西昌第二大学医院) Reproductive Medical Center, Department of Obstetrics and Gynecology, West China Second University Hospital(生殖医学中心,妇产科部门,西昌第二大学医院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本研究发现,尽管GRPO在算法准确性上表现最佳,但临床医生更偏好SFT模型,因其推理更清晰且治疗可行性更高,揭示了算法改进与临床信任之间的对齐悖论。

Comments 22 pages 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03265 2025-11-25 cs.LG cs.AI 62%

MindCraft: How Concept Trees Take Shape In Deep Models

MindCraft: 深度模型中概念树如何形成

Bowei Tian, Yexiao He, Wanghao Ye, Ziyao Wang, Meng Liu, Ang Li

机构 * University of Maryland, College Park(马里兰大学 College Park 分校)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 MindCraft通过概念树框架揭示深度模型中概念的层次结构和分离过程,为可解释AI提供新的分析方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18165 2025-11-25 cs.SE cs.AI 61%

Towards a General Framework for HTN Modeling with LLMs

迈向基于LLM的HTN建模通用框架

Israel Puerta-Merino, Carlos Núñez-Molina, Pablo Mesejo, Juan Fernández-Olivares

专题命中 规划推理 :planning(abstract,comments);分类 cs.AI

AI总结 本文提出L2HP框架,用于改进LLM在分层规划建模中的能力,通过实验发现分层规划的建模难度显著高于自动规划。

Comments 10 pages, 5 figures, to be published in the Workshop on Planning in the Era of LLMs ( LM4Plan - https://llmforplanning.github.io ) and the Workshop on Hierarchical Planning ( HPlan - https://icaps25.icaps-conference.org/program/workshops/hplan/ ), both in the International Conference on Automated Planning and Scheduling (ICAPS) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19083 2025-11-25 cs.CL 57%

A Multi-Agent LLM Framework for Multi-Domain Low-Resource In-Context NER via Knowledge Retrieval, Disambiguation and Reflective Analysis

面向多领域低资源情境命名实体识别的多智能体LLM框架:通过知识检索、消歧和反思分析

Wenxuan Mu, Jinzhong Ning, Di Zhao, Yijia Zhang

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 KDR-Agent通过知识检索、消歧和反思分析,提升多领域低资源情境下命名实体识别的性能

Comments This paper has been accepted by AAAI 2026 (Main Technical Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18619 2025-11-25 cs.CL 57%

Prompt Optimization as a State-Space Search Problem

提示优化作为状态空间搜索问题

Maanas Taneja

机构 * University of Minnesota(明尼苏达大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 将提示优化视为状态空间搜索问题,通过束搜索和随机游走算法改进提示性能,验证了优化作为搜索问题的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23518 2025-11-25 cs.AI 57%

TRAP: Targeted Redirecting of Agentic Preferences

TRAP:面向目标的代理偏好重定向

Hangoo Kang, Jehyeok Yeon, Gagandeep Singh

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 TRAP通过语义引导的跨模态操纵,诱导代理AI系统产生一致的选择偏见,揭示了语义层面的安全漏洞。

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15524 2025-11-25 cs.AI cs.IR econ.EM stat.AP 57%

The Challenge of Using LLMs to Simulate Human Behavior: A Causal Inference Perspective

使用大型语言模型模拟人类行为的挑战:因果推断视角

George Gui, Olivier Toubia

机构 * Columbia Business School(哥伦比亚商学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文从因果推断视角探讨了使用LLM模拟人类行为的挑战,指出模糊提示策略导致混淆问题,并提出通过去盲化策略提升模型性能和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17678 2025-11-25 cs.CY cs.AI cs.HC 57%

Chatbots to strengthen democracy: An interdisciplinary seminar to train identifying argumentation techniques of science denial

聊天机器人强化民主:跨学科研讨会训练识别科学否认论技巧

Ingo Siegert, Jan Nehring, Aranxa Márquez Ampudia, Matthias Busch, Stefan Hillmann

机构 * Mobile Dialog Systems, Otto-von-Guericke-University Magdeburg, Germany(移动对话系统,马格德堡奥托·冯·格里克大学) German Research Centre for Artificial Intelligence, Berlin(德国人工智能研究中心) Usability Lab, TU Berlin, Germany(可用性实验室,柏林技术大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出通过跨学科研讨会训练学生利用AI聊天机器人识别科学否认论技巧,以提高公众对虚假信息的抵抗力。

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17627 2025-11-25 q-bio.PE cs.LG 57%

An Ecologically-Informed Deep Learning Framework for Interpretable and Validatable Habitat Mapping

一种基于生态学的深度学习框架用于可解释和可验证的栖息地制图

Iván Felipe Benavides-Martínez, Cristiam Victoriano Portilla-Cabrera, Katherine E. Mills, Claire Enterline, José Garcés-Vargas, Andrew J. Allyn, Auroop R Ganguly

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 本文提出ECOSAIC框架,通过可解释的潜在表示实现底栖生境的自动分类,揭示16种生境并展示其环境与物种需求的生态关联。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19033 2025-11-25 cs.CV 50%

ReEXplore: Improving MLLMs for Embodied Exploration with Contextualized Retrospective Experience Replay

ReEXplore: 通过上下文化回顾经验回放提升具身探索的MLLMs

Gengyuan Zhang, Mingcong Ding, Jingpei Wu, Ruotong Liao, Volker Tresp

机构 * LMU Munich(慕尼黑大学) Munich Center for Machine Learning(慕尼黑机器学习中心) TU Munich(慕尼黑技术大学)

专题命中 规划推理 :reasoning(abstract)

AI总结 ReEXplore通过回顾经验回放和分层前沿选择,提升MLLMs在具身探索中的效率和性能。

Comments 8 main pages plus 13 pages Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18114 2025-11-25 cs.CR 50%

ASTRA: Agentic Steerability and Risk Assessment Framework

ASTRA:代理可引导性与风险评估框架

Itay Hazan, Yael Mathov, Guy Shtar, Ron Bitton, Itsik Mantin

专题命中 规划推理 :planning(abstract)

AI总结 ASTRA框架通过模拟多种AI代理并测试其对新型攻击的防御能力,评估LLM在构建安全代理中的有效性,推动更安全的AI系统发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17730 2025-11-25 eess.SY cs.SY 50%

Safety and Risk Pathways in Cooperative Generative Multi-Agent Systems: A Telecom Perspective

合作生成多智能体系统的安全性和风险路径:电信视角

Zeinab Nezami, Shehr Bano, Abdelaziz Salama, Maryam Hafeez, Syed Ali Raza Zaidi

专题命中 规划推理 :planning(abstract)

AI总结 本文从电信视角探讨生成多智能体系统中的安全性和风险路径,提出模块化安全评估框架,揭示智能体多样性对系统稳定性的影响,并展示通过模拟验证的改进与持续存在的漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏