arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-09 至 2025-12-09 共收录 25 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 25 篇

2509.20616 2025-12-09 cs.LG cs.SY eess.SY 88%

Training Task Reasoning LLM Agents for Multi-turn Task Planning via Single-turn Reinforcement Learning

通过单次强化学习训练多轮任务规划的LLM代理

Hanjiang Hu, Changliu Liu, Na Li, Yebin Wang

机构 * Carnegie Mellon University(卡内基梅隆大学) Harvard University(哈佛大学) Mitsubishi Electric Research Laboratories (MERL)(三菱电机研究实验室(MERL))

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);分类 cs.LG

AI总结 本文通过单次强化学习训练LLM代理进行多轮任务规划,利用GRPO实现高效策略优化,实验显示其在复杂任务规划中的表现优于大参数基线模型。

Comments Accepted by IEEE Control Systems Letters (L-CSS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01912 2025-12-09 cs.MA cs.AI cs.LG 86%

EvoMem: Improving Multi-Agent Planning with Dual-Evolving Memory

EvoMem:通过双进化记忆提升多智能体规划

Wenzhe Fan, Ning Yan, Masood Mortazavi

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) Futurewei Technologies(未来科技)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);verifier(abstract);分类 cs.AI、cs.LG

AI总结 EvoMem通过双进化记忆机制提升多智能体规划,利用约束记忆和查询反馈记忆模块优化约束跟踪与错误修正,实现旅行、会议和日历任务的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08595 2025-12-09 cs.CL cs.AI 82%

Chopping Trees: Semantic Similarity Based Dynamic Pruning for Tree-of-Thought Reasoning

砍树:基于语义相似性的动态剪枝用于树状思维推理

Joongho Kim, Xirui Huang, Zarreen Reza, Gabriel Grand

机构 * Massachusetts Institute of Technology (MIT)(麻省理工学院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 SSDP通过动态剪枝技术提升树状思维推理效率,实现2.3倍速度提升且保持高准确性。

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop on Efficient Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20993 2025-12-09 cs.LG cs.AI 81%

Subgoal Graph-Augmented Planning for LLM-Guided Open-World Reinforcement Learning

子目标图增强的规划用于LLM引导的开放世界强化学习

Shanwei Fan, Bin Zhang, Zhiwei Xu, Yingxuan Teng, Siqi Dai, Lin Cheng, Guoliang Fan

机构 * The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(认知与决策智能复杂系统重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) School of Artificial Intelligence, Shandong University(山东大学人工智能学院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出SGA-ACR框架,通过整合环境特定的子目标图和多LLM规划流程,解决LLM在开放世界强化学习中的规划-执行对齐问题,提升子目标的可行性和可验证性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10320 2025-12-09 cs.RO cs.AI 79%

MeshA*: Efficient Path Planning With Motion Primitives

MeshA*:基于运动原语的高效路径规划

Marat Agranovskiy, Konstantin Yakovlev

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 MeshA*通过在网格单元格上搜索并拟合运动原语序列,实现高效路径规划,同时保证完整性和最优性,运行时间显著优于传统方法。

Comments Accepted to AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06258 2025-12-09 cs.CV 78%

Knowing the Answer Isn't Enough: Fixing Reasoning Path Failures in LVLMs

知道答案还不够:修复大型视觉-语言模型中的推理路径失败

Chaoyang Wang, Yangfan He, Yiyang Zhou, Yixuan Wang, Jiaqi Liu, Peng Xia, Zhengzhong Tu, Mohit Bansal, Huaxiu Yao

机构 * UNC-Chapel Hill(北卡罗来纳大学教堂山分校) Texas A&M University(德克萨斯农工大学)

专题命中 规划推理 :reasoning(title,abstract)

AI总结 PSO通过优化推理路径选择,提升大型视觉-语言模型的推理准确性和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06867 2025-12-09 cs.AI 74%

Do Persona-Infused LLMs Affect Performance in a Strategic Reasoning Game?

带有个性特征的LLM是否会影响战略推理游戏中的表现?

John Licato, Stephen Steinle, Brayden Hollis

机构 * Bellini College of Artificial Intelligence, Cybersecurity and Computing(人工智能、网络安全与计算学院) University of South Florida(佛罗里达州立大学) Information Directorate(信息 Directorate) Air Force Research Library(空军研究图书馆)

专题命中 规划推理 :reasoning(title);分类 cs.AI

AI总结 本研究探讨了个性提示对战略推理游戏表现的影响,提出了一种基于心理测量原理的启发式生成方法,通过中介过程提升启发式策略的可靠性。

Comments Accepted at IJCNLP-AACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04441 2025-12-09 cs.CV 67%

MindDrive: An All-in-One Framework Bridging World Models and Vision-Language Model for End-to-End Autonomous Driving

MindDrive: 一个整合世界模型和视觉-语言模型的全功能框架,用于端到端自动驾驶

Bin Sun, Yaoguang Cao, Yan Wang, Rui Wang, Jiachen Shang, Xiejie Feng, Jiayi Lu, Jia Shi, Shichun Yang, Xiaoyu Yan, Ziying Song

机构 * School of Transportation Science and Engineering, Beihang University(北京航空航天大学交通科学与工程学院) State Key Laboratory of Intelligent Transportation System, Beihang University(北京航空航天大学智能交通系统国家重点实验室) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新院) Contemporary Amperex Technology Co., Limited (CATL)(当代电动车技术有限公司(CATL)) Research Institute of Aero-Engine, Beihang University(北京航空航天大学航空发动机研究院) School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院) China Automotive Engineering Research Institute Co., Ltd.(中国汽车工程研究院股份有限公司)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 MindDrive通过整合世界模型和视觉-语言模型,提出了一种端到端自动驾驶框架,实现高质量轨迹生成与多目标决策推理,提升自动驾驶的安全性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07314 2025-12-09 cs.AI cs.LG 62%

M-STAR: Multi-Scale Spatiotemporal Autoregression for Human Mobility Modeling

M-STAR:多尺度时空自回归模型用于人类移动性建模

Yuxiao Luo, Songming Zhang, Sijie Ruan, Siran Chen, Kang Liu, Yang Xu, Yu Zheng, Ling Yin

机构 * Department of Land Surveying and Geo-informatics, The Hong Kong Polytechnic University(土地测量与地理信息学系,香港理工大学) Shenzhen Institutes of Advanced Technology (SIAT), Chinese Academy of Sciences(深圳先进技术研究所,中国科学院) Faculty of Computer Science and Control Engineering, Shenzhen University of Advanced Technology(计算机科学与控制工程学院,深圳先进技术大学) School of Computer Science and Technology, Beijing Institute of Technology(计算机科学与技术学院,北京理工大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

AI总结 M-STAR通过多尺度时空自回归模型提升人类移动性长期轨迹生成的保真度和效率

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01268 2025-12-09 cs.CL cs.LG 62%

Deep Learning and Machine Learning, Advancing Big Data Analytics and Management: Unveiling AI's Potential Through Tools, Techniques, and Applications

深度学习与机器学习:推动大数据分析与管理,通过工具、技术和应用揭示人工智能的潜力

Pohsun Feng, Ziqian Bi, Yizhu Wen, Xuanhe Pan, Benji Peng, Ming Liu, Jiawei Xu, Keyu Chen, Junyu Liu, Caitlyn Heqi Yin, Sen Zhang, Jinlang Wang, Qian Niu, Ming Li, Tianyang Wang, Xinyuan Song, Zekun Jiang

机构 * National Taiwan Normal University(国立台湾师范大学) Indiana University(印第安纳大学) University of Hawaii(夏威夷大学) Kyoto University(京都大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) Georgia Institute of Technology(佐治亚理工学院) Rutgers University(罗格斯大学) Purdue University(普渡大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Emory University(埃默里大学) Sichuan University(四川大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 本文探讨深度学习与机器学习在大数据分析中的应用,通过工具和技术揭示AI潜力,强调伦理与公平性,推动各领域创新。

Comments This book contains 155 pages and 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06259 2025-12-09 cs.SD cs.AI cs.LG 62%

Who Will Top the Charts? Multimodal Music Popularity Prediction via Adaptive Fusion of Modality Experts and Temporal Engagement Modeling

谁会登顶排行榜?通过适应性融合模态专家和时间参与建模的多模态音乐流行度预测

Yash Choudhary, Preeti Rao, Pushpak Bhattacharyya

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

AI总结 GAMENet通过融合多模态数据和时间参与建模,提升了音乐流行度预测的准确性。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06990 2025-12-09 cs.AI cs.CV eess.IV 57%

Utilizing Multi-Agent Reinforcement Learning with Encoder-Decoder Architecture Agents to Identify Optimal Resection Location in Glioblastoma Multiforme Patients

利用基于编码器-解码器架构的多智能体强化学习识别胶母细胞瘤患者的最优切除位置

Krishna Arun, Moinak Bhattachrya, Paras Goel

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本研究利用多智能体强化学习与编码器-解码器架构,通过诊断和治疗计划优化,提高胶母细胞瘤患者生存率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05397 2025-12-09 cs.HC cs.AI 57%

Simulating Life Paths with Digital Twins: AI-Generated Future Selves Influence Decision-Making and Expand Human Choice

用数字双胞胎模拟人生路径:AI生成的未来自我影响决策并拓展人类选择

Rachel Poonsiriwong, Chayapatr Archiwaranguprok, Constanze Albrecht, Peggy Yin, Nattavudh Powdthavee, Hal Hershfield, Monchai Lertsutthiwong, Kavin Winson, Pat Pataranutaporn

机构 * MIT Media Lab(MIT媒体实验室) Stanford University(斯坦福大学) Nanyang Technological University(南洋理工大学) University of California, Los Angeles(加州大学洛杉矶分校) KASIKORN Labs(KASIKORN实验室)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本研究利用AI生成的未来自我虚拟形象,通过模拟人生路径拓展人类选择,发现平衡呈现和新增选项能有效影响决策,提升自主性认知。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03072 2025-12-09 cs.AI cs.LO 57%

Beyond the Black Box: A Cognitive Architecture for Explainable and Aligned AI

超越黑箱:可解释和对齐的AI认知架构

Hu Keyi

机构 * Tongji University(同济大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出'权重计算主义'认知架构,通过分解认知为逻辑原子和基本操作,实现可解释、普遍和可追溯的价值对齐,为通用人工智能的发展提供理论和实践基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06573 2025-12-09 cs.AI cs.MA 57%

The Effect of Belief Boxes and Open-mindedness on Persuasion

信念盒子和开放心态对说服力的影响

Onur Bilgin, Abdullah As Sami, Sriram Sai Vujjini, John Licato

机构 * Advancing Machine and Human Reasoning (AMHR) Lab, University of South Florida(先进机器与人类推理实验室,佛罗里达州立大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 研究探讨信念盒子和开放心态对智能体说服力的影响,发现开放心态影响信念变化的接受度,而信念陈述影响对对立观点的抵抗能力。

Comments Accepted at the 18th International Conference on Agents and Artificial Intelligence (ICAART 2026), Marbella, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06106 2025-12-09 cs.HC cs.AI 57%

Future You: Designing and Evaluating Multimodal AI-generated Digital Twins for Strengthening Future Self-Continuity

未来你:设计和评估多模态AI生成的数字双胞胎以加强未来自我连续性

Constanze Albrecht, Chayapatr Archiwaranguprok, Rachel Poonsiriwong, Awu Chen, Peggy Yin, Monchai Lertsutthiwong, Kavin Winson, Hal Hershfield, Pattie Maes, Pat Pataranutaporn

机构 * MIT Media Lab(MIT媒体实验室) Harvard University(哈佛大学) Stanford University(斯坦福大学) KASIKORN Labs(KASIKORN实验室)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本研究通过多模态AI生成的未来自我探索其对自我连续性、情绪和动机的影响,发现avatar效果最佳,但各模态无显著差异,互动质量是关键因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05982 2025-12-09 physics.soc-ph cs.AI cs.MA 57%

FlockVote: LLM-Empowered Agent-Based Modeling for Simulating U.S. Presidential Elections

FlockVote: 基于大语言模型的智能体建模用于模拟美国总统选举

Lingfeng Zhou, Yi Xu, Zhenyu Wang, Dequan Wang

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 FlockVote利用大语言模型构建智能体建模框架,用于模拟美国总统选举,实现高保真度的社会模拟与可解释性研究。

Comments Published as a conference paper at ICAIS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04416 2025-12-09 cs.AI cs.SE 57%

DataGovBench: Benchmarking LLM Agents for Real-World Data Governance Workflows

DataGovBench: 为现实世界数据治理工作流程评估LLM代理

Zhou Liu, Zhaoyang Han, Guochen Yan, Hao Liang, Bohan Zeng, Xing Chen, Yuanfeng Song, Wentao Zhang

机构 * Peking University(北京大学) ByteDance(字节跳动)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 DataGovBench通过150种现实任务评估LLM代理在数据治理中的表现,提出DataGovAgent框架提升复杂任务性能和调试效率。

Comments Equal contribution: Zhou Liu and Zhaoyang Han. Corresponding authors: Yuanfeng Song and Wentao Zhang

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10680 2025-12-09 cs.LG stat.ML 57%

LAD-BNet: Lag-Aware Dual-Branch Networks for Real-Time Energy Forecasting on Edge Devices

LAD-BNet:面向边缘设备实时能源预测的时滞感知双分支网络

Jean-Philippe Lignier

机构 * University of La Réunion(留尼旺大学) PIMENT Laboratory(PIMENT实验室) Physics and Mathematical Engineering for Energy, Environment and Building(能源、环境与建筑的物理与数学工程)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 LAD-BNet通过时滞感知双分支网络在边缘设备上实现高效的实时能源预测,提升预测精度并降低推断时间,适用于智能电网和建筑领域。

Comments 27 pages, in French language. 10 tables, 26 references. Submitted to Energy and AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07819 2025-12-09 cs.RO 50%

Efficient and Compliant Control Framework for Versatile Human-Humanoid Collaborative Transportation

高效且合规的协作运输人机协作控制框架

Shubham S. Kumbhar, Abhijeet M. Kulkarni, Panagiotis Artemiadis

专题命中 规划推理 :planning(abstract)

AI总结 本文提出了一种高效且合规的协作运输人机协作控制框架,通过交互线性倒立摆和动态可行步态计划实现人形机器人与人类的协同运输任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07001 2025-12-09 eess.SY cs.SY 50%

Synergies between AI Computing and Power Systems: Metrics, Scheduling, and Resilience

人工智能计算与电力系统之间的协同:指标、调度与韧性

Farzaneh Pourahmadi, Olivier Corradi, Pierre Pinson

专题命中 规划推理 :planning(abstract)

AI总结 本文提出通过标准化碳指标和协调架构,实现人工智能计算与电力系统之间的协同,提升调度效率和系统韧性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23255 2025-12-09 eess.SY cs.SY 50%

Iterative VCG-based Mechanism Fosters Cooperation in Multi-Regional Network Design

迭代基于VCG的机制促进多区域网络设计中的合作

Mingjia He, Yannik Werner, Andrea Censi, Emilio Frazzoli, Gioele Zardini

专题命中 规划推理 :planning(abstract)

AI总结 本文提出一种迭代基于VCG的机制,用于多区域网络设计,促进子网络运营商之间的合作,提升整体网络效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00843 2025-12-09 cs.CV 50%

VLM-Assisted Continual learning for Visual Question Answering in Self-Driving

基于视觉语言模型的持续学习用于自动驾驶中的视觉问答

Yuxin Lin, Mengshi Qi, Liang Liu, Huadong Ma

机构 * State Key Laboratory of Networking and Switching Technology(网络与交换技术国家重点实验室) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 规划推理 :planning(abstract)

AI总结 本文提出结合视觉语言模型与持续学习的方法,以提升自动驾驶中视觉问答系统的性能和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06674 2025-12-09 cs.CV 50%

RunawayEvil: Jailbreaking the Image-to-Video Generative Models

RunawayEvil: 对图像到视频生成模型的劫持

Songping Wang, Rufan Qian, Yueming Lyu, Qinglong Liu, Linzhuang Zou, Jie Qin, Songhua Liu, Caifeng Shan

机构 * PRLab, Nanjing University(南京大学PRLab) Meituan(美团) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划推理 :planning(abstract)

AI总结 RunawayEvil是一种针对图像到视频生成模型的多模态劫持框架,通过自我进化机制实现动态攻击策略,显著提升攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06659 2025-12-09 cs.CR 50%

The Evolution of Agentic AI in Cybersecurity: From Single LLM Reasoners to Multi-Agent Systems and Autonomous Pipelines

代理AI在网络安全中的演变:从单一LLM推理者到多代理系统和自主流水线

Vaishali Vinay

专题命中 规划推理 :reasoning(abstract)

AI总结 本文探讨了网络安全中代理AI从单一LLM到多代理系统的发展,分析了五代分类法及各代在推理深度、工具使用等维度的差异,并总结了当前面临的挑战。

Comments Accepted at ICAIC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏