arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-23 至 2025-12-23 共收录 27 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 27 篇

2512.18211 2025-12-23 cs.RO cs.AI 89%

LLaViDA: A Large Language Vision Driving Assistant for Explicit Reasoning and Enhanced Trajectory Planning

LLaViDA: 一种用于显式推理和增强轨迹规划的大型语言视觉驾驶助手

Yudong Liu, Spencer Hallyburton, Jiwoo Kim, Yueqian Lin, Yiming Li, Qinsi Wang, Hui Ye, Jingwei Sun, Miroslav Pajic, Yiran Chen, Hai Li

机构 * Duke University(杜克大学) Georgia State University(佐治亚州立大学) University of Florida(佛罗里达大学)

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 LLaViDA通过视觉-语言模型实现显式推理和轨迹规划,提升自动驾驶的轨迹规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20262 2025-12-23 cs.AI cs.CY 85%

AI reasoning effort predicts human decision time in content moderation

AI推理努力预测内容审核中的人类决策时间

Thomas Davidson

机构 * Department of Sociology(社会学系) Rutgers University–New Brunswick(罗格斯大学-新布朗斯维爾)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

AI总结 本研究发现AI推理努力与人类决策时间存在相关性,揭示了推理痕迹在提升可解释性和决策制定中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09284 2025-12-23 cs.AI cs.CL cs.LG 85%

Tree-OPO: Off-policy Monte Carlo Tree-Guided Advantage Optimization for Multistep Reasoning

Tree-OPO: 用于多步推理的逆政策蒙特卡洛树引导优势优化

Bingning Huang, Tu Nguyen, Matthieu Zimmer

专题命中 规划推理 :reasoning(title,abstract);verifier(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 Tree-OPO通过引入分阶段优势估计框架,利用MCTS生成轨迹优化策略学习,提升数学推理任务的准确性与样本效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18265 2025-12-23 cs.AI 83%

Intelligent Human-Machine Partnership for Manufacturing: Enhancing Warehouse Planning through Simulation-Driven Knowledge Graphs and LLM Collaboration

智能人机协作制造:通过仿真驱动的知识图谱与大语言模型协作提升仓库规划

Himabindu Thogaru, Saisubramaniam Gopalakrishnan, Zishan Ahmad, Anirudh Deodhar

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);分类 cs.AI

AI总结 本研究提出通过仿真驱动的知识图谱与大语言模型协作,提升制造业仓库规划的智能化水平,实现人机高效协作以优化运营决策。

Comments 13 pages, 2 figures, accepted for oral presentation at AAAI Human Machine Collaboration Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17912 2025-12-23 cs.CL cs.AI 81%

Graph-O1 : Monte Carlo Tree Search with Reinforcement Learning for Text-Attributed Graph Reasoning

Graph-O1:基于强化学习的蒙特卡洛树搜索用于文本属性图推理

Lihui Liu

机构 * Wayne State University(韦恩州立大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 Graph-O1通过整合蒙特卡洛树搜索与强化学习,实现文本属性图的分步交互推理,提升问答任务的准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18604 2025-12-23 cs.LG 79%

Trajectory Planning for UAV-Based Smart Farming Using Imitation-Based Triple Deep Q-Learning

基于模仿学习的三重深度Q学习用于无人机智能农业的轨迹规划

Wencan Mao, Quanxi Zhou, Tomas Couso Coddou, Manabu Tsukada, Yunling Liu, Yusheng Ji

机构 * National Institute of Informatics(国立信息研究所) The University of Tokyo(东京大学) Pontificia Universidad Católica de Chile(智利天主教大学) China Agricultural University(中国农业大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.LG

AI总结 本文提出基于模仿学习的三重深度Q学习算法,用于提升无人机在智能农业中的轨迹规划性能,实验显示其在杂草识别和数据收集方面均优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17629 2025-12-23 cs.LG math.OC 79%

Planning and Learning in Average Risk-aware MDPs

在平均风险感知马尔可夫决策过程中的规划与学习

Weikai Wang, Erick Delage

机构 * GERAD & HEC Montréal(GERAD与蒙特利尔HEC学院) Mila - Québec AI Institute(魁北克AI研究所)

专题命中 规划推理 :planning(title,abstract);分类 cs.LG

AI总结 本文提出了一种相对价值迭代算法和两种基于多级蒙特卡洛方法的Q学习算法,用于在平均风险感知马尔可夫决策过程中实现最优策略的收敛与识别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19354 2025-12-23 cs.CV 78%

ReasonCD: A Multimodal Reasoning Large Model for Implicit Change-of-Interest Semantic Mining

ReasonCD: 一种用于隐含兴趣语义挖掘的多模态推理大模型

Zhenyang Huang, Xiao Yu, Yi Zhang, Decheng Wang, Hang Ruan

机构 * Beijing Institute of Tracking and Telecommunications Technology(北京跟踪与电信技术研究所)

专题命中 规划推理 :reasoning(title,abstract)

AI总结 ReasonCD通过利用预训练大语言模型的推理能力,挖掘用户隐含任务意图,实现更高效的变化检测与解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19133 2025-12-23 cs.RO cs.CV 78%

WorldRFT: Latent World Model Planning with Reinforcement Fine-Tuning for Autonomous Driving

WorldRFT: 通过强化微调的潜在世界模型进行自动驾驶的规划

Pengxuan Yang, Ben Lu, Zhongpu Xia, Chao Han, Yinfeng Gao, Teng Zhang, Kun Zhan, XianPeng Lang, Yupeng Zheng, Qichao Zhang

专题命中 规划推理 :planning(title,abstract)

AI总结 WorldRFT通过强化学习微调提升自动驾驶规划性能,实现安全性和效率的双重优化。

Comments AAAI 2026, first version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18966 2025-12-23 cs.SE 78%

Scrum Sprint Planning: LLM-based and algorithmic solutions

Scrum迭代规划:基于大语言模型和算法的解决方案

Yuwon Yoon, Kevin Iwan, Madeleine Zwart, Xiaohan Qin, Hina Lee, Maria Spichkova

专题命中 规划推理 :planning(title,abstract)

AI总结 本文探讨了大语言模型在Scrum迭代规划中的应用,通过实验发现其结果质量不满足直接使用需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19360 2025-12-23 cs.IR 75%

Generative vector search to improve pathology foundation models across multimodal vision-language tasks

生成向量搜索以提升多模态视觉-语言任务中的病理基础模型

Markus Ekvall, Ludvig Bergenstråhle, Patrick Truong, Ben Murrell, Joakim Lundeberg

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract);test-time compute(abstract)

AI总结 STHLM通过生成向量搜索方法提升多模态视觉-语言任务中病理基础模型的检索性能,实现10-30%的性能提升和10倍的维度压缩

Comments 13 pages main (54 total), 2 main figures (9 total)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18619 2025-12-23 cs.AI cs.RO 74%

ChronoDreamer: Action-Conditioned World Model as an Online Simulator for Robotic Planning

ChronoDreamer:基于动作的动态世界模型作为机器人规划的在线模拟器

Zhenhao Zhou, Dan Negrut

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 规划推理 :planning(title);分类 cs.AI

AI总结 ChronoDreamer通过时空变换器和视觉-语言模型,实现基于动作的动态世界模型,用于机器人规划中的安全动作预测与碰撞检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18571 2025-12-23 cs.AI cs.CV 70%

ESearch-R1: Learning Cost-Aware MLLM Agents for Interactive Embodied Search via Reinforcement Learning

ESearch-R1: 通过强化学习学习成本感知的多模态大语言模型代理以进行交互式具身搜索

Weijie Zhou, Xuangtang Xiong, Ye Tian, Lijun Yue, Xinyu Wu, Wei Li, Chaoyang Zhao, Honghui Dong, Ming Tang, Jinqiao Wang, Zhengyou Zhang

机构 * School of Traffic and Transportation, Beijing Jiaotong University(交通与运输学院,北京交通大学) Tencent Robotics X & Futian Laboratory(腾讯机器人X与福田实验室) Foundation Model Research Center, Institute of Automation, Chinese Academy of Sciences(基础模型研究中心,中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 ESearch-R1通过强化学习方法,结合交互对话、记忆检索和导航,实现成本感知的多模态大语言模型代理,有效降低任务执行成本并提高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19453 2025-12-23 cs.RO 67%

MaP-AVR: A Meta-Action Planner for Agents Leveraging Vision Language Models and Retrieval-Augmented Generation

MaP-AVR: 一种利用视觉语言模型和检索增强生成的元动作规划器

Zhenglong Guo, Yiming Zhao, Feng Jiang, Heng Jin, Zongbao Feng, Jianbin Zhou, Siyuan Xu

机构 * Li Auto

专题命中 规划推理 :chain-of-thought(abstract);planning(abstract)

AI总结 MaP-AVR通过元动作规划和检索增强生成技术,提升机器人在复杂环境中的任务规划能力。

Comments 8 pages, 10 figures, This work was completed in December 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18254 2025-12-23 cs.CV 67%

Loom: Diffusion-Transformer for Interleaved Generation

Loom:用于交错生成的扩散-变压器

Mingcheng Ye, Jiaming Liu, Yiren Song

机构 * Beijing Institute of Technology(北京理工大学) National University of Singapore(新加坡国立大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 Loom通过统一的扩散-变压器框架实现交错生成,提供更高效和可控的长周期生成,优于现有基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11960 2025-12-23 cs.RO 67%

Human Centric General Physical Intelligence for Agile Manufacturing Automation

以人为中心的敏捷制造通用物理智能

Sandeep Kanta, Mehrdad Tavassoli, Varun Teja Chirkuri, Venkata Akhil Kumar, Santhi Bharath Punati, Praveen Damacharla, Sunny Katyara

机构 * Northeastern University(东北大学) Bmade Robotics(Bmade机器人)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 本文探讨了通过VLA模型实现通用物理智能在敏捷制造中的应用,系统回顾了最新进展并提出未来研究方向。

Comments Advanced Engineering Informatics

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18745 2025-12-23 cs.CV cs.CL cs.LG 62%

InSight-o3: Empowering Multimodal Foundation Models with Generalized Visual Search

InSight-o3: 通过通用视觉搜索增强多模态基础模型

Kaican Li, Lewei Yao, Jiannan Wu, Tiezheng Yu, Jierun Chen, Haoli Bai, Lu Hou, Lanqing Hong, Wei Zhang, Nevin L. Zhang

机构 * Hong Kong University of Science and Technology(香港科技大学) Huawei(华为)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 InSight-o3通过通用视觉搜索任务提升多模态基础模型的推理能力,解决复杂视觉信息整合问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14918 2025-12-23 cs.CL cs.LG stat.ML 62%

Reliable Decision Support with LLMs: A Framework for Evaluating Consistency in Binary Text Classification Applications

利用LLM实现可靠决策支持:一种评估二元文本分类应用一致性的框架

Fadel M. Megahed, Ying-Ju Chen, L. Allision Jones-Farmer, Younghwa Lee, Jiawei Brooke Wang, Inez M. Zwetsloot

机构 * Farmer School of Business, Miami University, Oxford, OH 45056, USA(迈阿密大学法默商学院) College of Arts and Sciences, University of Dayton, Dayton, OH 45469, USA(Dayton大学文理学院) Amsterdam Business School, University of Amsterdam, Amsterdam, The Netherlands(阿姆斯特丹大学阿姆斯特丹商学院)

专题命中 规划推理 :planning(abstract);分类 cs.CL、cs.LG

AI总结 本文提出了一种评估LLM在二元文本分类中一致性的框架,通过实验验证了不同模型在金融新闻分类中的性能,并提供了系统化的LLM选择和可靠性评估方法。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19475 2025-12-23 cs.CL 57%

A Large-Language-Model Framework for Automated Humanitarian Situation Reporting

为自动化人道主义局势报告设计的大型语言模型框架

Ivan Decostanzi, Yelena Mejova, Kyriaki Kalimeri

机构 * ISI Foundation(ISI基金会) UNICEF(联合国儿童基金会)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出了一种基于大型语言模型的自动化框架,用于生成结构化、可解释且可操作的人道主义局势报告,通过多级评估和透明引用链接提高了报告的准确性和实用性。

Comments 18 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19234 2025-12-23 cs.AI 57%

DeliveryBench: Can Agents Earn Profit in Real World?

DeliveryBench: 代理在现实世界中能否获利?

Lingjun Mao, Jiawei Ren, Kun Zhou, Jixuan Chen, Ziqiao Ma, Lianhui Qin

机构 * University of California, San Diego(加州大学圣地亚哥分校) University of Michigan(密歇根大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 DeliveryBench通过模拟现实世界中的食品配送任务,评估基于VLM的具身代理在长期规划和约束管理方面的性能,发现其与人类存在显著差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18596 2025-12-23 cs.LG 57%

EIA-SEC: Improved Actor-Critic Framework for Multi-UAV Collaborative Control in Smart Agriculture

EIA-SEC:改进的Actor-Critic框架用于智能农业多无人机协同控制

Quanxi Zhou, Wencan Mao, Yilei Liang, Manabu Tsukada, Yunling Liu, Jon Crowcroft

机构 * The University of Tokyo(东京大学) National Institute of Informatics(国家信息研究所) The University of Cambridge(剑桥大学) China Agricultural University(中国农业大学)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 EIA-SEC框架通过精英模仿和共享批评机制,提升多无人机在智能农业中的协同控制性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18425 2025-12-23 cs.LG 57%

MoE Pathfinder: Trajectory-driven Expert Pruning

MoE路径规划者:轨迹驱动的专家剪枝

Xican Yang, Yuanhe Tian, Yan Song

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 MoE路径规划者通过轨迹驱动的专家剪枝方法,提升MoE模型的计算效率和部署性能。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18202 2025-12-23 cs.AI 57%

Sophia: A Persistent Agent Framework of Artificial Life

Sophia:人工智能生命的一种持久代理框架

Mingyang Sun, Feng Hong, Weinan Zhang

机构 * Westlake University(西湖大学) Shanghai Innovation Institute(上海创新研究院) Project Cuddlepark Team(Project Cuddlepark团队) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 Sophia通过引入系统3,实现持久代理框架,使AI代理具备自我改进、身份连续性和透明行为解释能力,推动人工生命的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17913 2025-12-23 cs.DC cs.AI 57%

Byzantine Fault-Tolerant Multi-Agent System for Healthcare: A Gossip Protocol Approach to Secure Medical Message Propagation

容错多智能体系统在医疗中的应用:基于 gossip 协议的安全医疗信息传播方法

Nihir Chadderwala

机构 * Nihir Chadderwala(独立研究者)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出一种基于 gossip 协议的拜占庭容错多智能体系统,用于医疗领域,通过加密验证和共识协议保障信息安全与系统容错性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12399 2025-12-23 cs.AI 57%

A Survey of Vibe Coding with Large Language Models

基于大语言模型的Vibe编码调研

Yuyao Ge, Lingrui Mei, Zenghao Duan, Tianhao Li, Yujia Zheng, Yiwei Wang, Lexin Wang, Jiayu Yao, Tianyu Liu, Yujun Cai, Baolong Bi, Fangda Guo, Jiafeng Guo, Shenghua Liu, Xueqi Cheng

机构 * Institute of Computing Technology Chinese Academy of Sciences(中国科学院计算技术研究所) Duke University(杜克大学) University of California Merced(加州大学默塞德分校) Peking University(北京大学) University of Queensland(昆士兰大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文调研了基于大语言模型的Vibe编码方法,系统分析了其理论基础和五个开发模型,揭示了上下文工程与协作模式对成功的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09510 2025-12-23 cs.RO cs.CV 50%

ViTA-Seg: Vision Transformer for Amodal Segmentation in Robotics

ViTA-Seg:用于机器人抓取的视觉Transformer

Donato Caramia, Florian T. Pokorny, Giuseppe Triggiani, Denis Ruffino, David Naso, Paolo Roberto Massenio

机构 * Department of Electrical Learning (RPL), KTH Royal Institute of Technology, 114 28, Stockholm, Sweden, (e-mail: )

专题命中 规划推理 :planning(abstract)

AI总结 ViTA-Seg是一种用于机器人抓取的视觉Transformer框架,通过双头架构实现高效的无遮挡分割,提升机器人操作的实时性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04628 2025-12-23 cs.CE q-bio.QM 50%

Projecting Molecules into Synthesizable Chemical Spaces

将分子投影到可合成的化学空间

Shitong Luo, Wenhao Gao, Zuofan Wu, Jian Peng, Connor W. Coley, Jianzhu Ma

专题命中 规划推理 :planning(abstract)

AI总结 本文提出一种基于变压器的模型,通过后缀表示法生成可合成的化学结构,提升合成可及性和药物发现效率。

详情

展开后加载摘要…

URL PDF HTML 收藏