arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11088 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11088 篇

2511.10874 2026-02-18 cs.RO cs.MA 67%

Collaborative Multi-Robot Non-Prehensile Manipulation via Flow-Matching Co-Generation

通过流匹配共生成实现协作多机器人非抓取操作

Yorai Shaoul, Zhe Chen, Mohamed Naveed Gul Mohamed, Federico Pecora, Maxim Likhachev, Jiaoyang Li

机构 * Carnegie Mellon University(卡内基梅隆大学) Amazon Robotics(亚马逊机器人)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 本文提出一种统一框架,通过流匹配共生成与匿名多机器人运动规划,实现协作多机器人非抓取操作,提升复杂多物体环境下的操作效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14979 2026-02-17 cs.RO 67%

RynnBrain: Open Embodied Foundation Models

RynnBrain: 开放式具身基础模型

Ronghao Dang, Jiayan Guo, Bohan Hou, Sicong Leng, Kehan Li, Xin Li, Jiangpin Liu, Yunxuan Mao, Zhikai Wang, Yuqian Yuan, Minghao Zhu, Xiao Lin, Yang Bai, Qian Jiang, Yaxi Zhao, Minghua Zeng, Junlong Gao, Yuming Jiang, Jun Cen, Siteng Huang, Liuyi Wang, Wenqiao Zhang, Chengju Liu, Jianfei Yang, Shijian Lu, Deli Zhao

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 RynnBrain提出了一种开放的具身基础模型,通过统一框架强化感知、推理、规划等能力,显著优于现有模型,并能高效适应多种具身任务。

Comments Homepage: https://alibaba-damo-academy.github.io/RynnBrain.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08320 2026-02-17 cs.DB 67%

Making Databases Searchable with Deep Context

用深度上下文使数据库可搜索

Alekh Jindal, Shi Qiao, Shivani Tripathi, Niloy Debnath, Kunal Singh, Pushpanjali Nema, Sharath Prakash, Aditya Halder, Ronith PR, Sadiq Mohammed, Abdul Hameed, Karan Hanswadkar, Ayush Kshitij, Sarthak Bhatt, Rony Chatterjee, Jyoti Pandey, Christina Pavlopoulou, Ravi Shetye

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 Tursio通过整合大语言模型,构建语义知识图谱,使非专家用户能高效准确地通过自然语言查询数据库。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19457 2026-02-17 cs.CL cs.AI cs.LG cs.SE 67%

GEPA: Reflective Prompt Evolution Can Outperform Reinforcement Learning

GEPA:反思式提示进化可以超越强化学习

Lakshya A Agrawal, Shangyin Tan, Dilara Soylu, Noah Ziems, Rishi Khare, Krista Opsahl-Ong, Arnav Singhvi, Herumb Shandilya, Michael J Ryan, Meng Jiang, Christopher Potts, Koushik Sen, Alexandros G. Dimakis, Ion Stoica, Dan Klein, Matei Zaharia, Omar Khattab

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 GEPA通过自然语言反思优化提示,以更少的回放次数在多个任务中超越强化学习方法GRPO和MIPROv2。

Comments Accepted to ICLR 2026 (Oral). Code: https://github.com/gepa-ai/gepa

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20577 2026-02-16 cs.RO 67%

MeCo: Enhancing LLM-Empowered Multi-Robot Collaboration via Similar Task Memoization

MeCo:通过相似任务记忆增强基于大语言模型的多机器人协作

Baiqing Wang, Helei Cui, Bo Zhang, Xiaolong Zheng, Bin Guo, Zhiwen Yu

机构 * Northwestern Polytechnical University(西北工业大学) Beijing University of Posts and Telecommunications(北京邮电大学) Harbin Engineering University(哈尔滨工程大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 MeCo通过引入相似任务记忆化机制,有效提升多机器人协作的效率和成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11124 2026-02-12 cs.CV 67%

PhyCritic: Multimodal Critic Models for Physical AI

PhyCritic:面向物理AI的多模态批评模型

Tianyi Xiong, Shihao Wang, Guilin Liu, Yi Dong, Ming Li, Heng Huang, Jan Kautz, Zhiding Yu

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 PhyCritic通过双阶段RLVR流程优化,提升物理AI任务中的感知和推理能力,实现对物理任务的高效评估和改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04683 2026-02-12 cs.SD 67%

UniAudio 2.0: A Unified Audio Language Model with Text-Aligned Factorized Audio Tokenization

UniAudio 2.0:一种具有文本对齐因子化音频标记化的统一音频语言模型

Dongchao Yang, Yuanyuan Wang, Dading Chong, Songxiang Liu, Xixin Wu, Helen Meng

机构 * The Chinese University of Hong Kong, China(香港中文大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 UniAudio 2.0通过引入ReasoningCodec和统一自回归架构,实现了文本对齐的因子化音频标记化,提升了音频理解和生成性能,并在多种任务中展现了强大的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10490 2026-02-12 cs.IR 67%

ChainRec: An Agentic Recommender Learning to Route Tool Chains for Diverse and Evolving Interests

ChainRec: 一个用于路由工具链的代理推荐学习系统,以应对多样化和演变的兴趣

Fuchun Li, Qian Li, Xingyu Gao, Bocheng Pan, Yang Wu, Jun Zhang, Huan Yu, Jie Jiang, Jinsheng Xiao, Hailong Shi

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 ChainRec通过动态选择推理工具的代理推荐系统,提升冷启动和兴趣演变场景下的推荐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10479 2026-02-12 cs.SE 67%

From Prompt-Response to Goal-Directed Systems: The Evolution of Agentic AI Software Architecture

从提示-响应到目标导向系统:代理AI软件架构的演变

Mamdouh Alenezi

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 本文探讨了代理AI从提示-响应到目标导向系统的架构演变,提出了生产级代理的参考架构、多代理拓扑分类及企业加固检查表,强调标准化代理循环和可审计控制机制的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09849 2026-02-12 cs.RO 67%

BagelVLA: Enhancing Long-Horizon Manipulation via Interleaved Vision-Language-Action Generation

BagelVLA: 通过交错视觉-语言-动作生成增强长时程操作

Yucheng Hu, Jianke Zhang, Yuanfei Luo, Yanjiang Guo, Xiaoyu Chen, Xinshu Sun, Kun Feng, Qingzhou Lu, Sheng Chen, Yangang Zhang, Wei Li, Jianyu Chen

机构 * Tsinghua University(清华大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 BagelVLA通过整合语言规划、视觉预测和动作生成,提升复杂长时程操作任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05239 2026-02-10 cs.RO 67%

Lan-grasp: Using Large Language Models for Semantic Object Grasping and Placement

Lan-grasp:利用大语言模型进行语义物体抓取与放置

Reihaneh Mirjalili, Michael Krawez, Yannik Blei, Simone Silenzi, Florian Walter, Wolfram Burgard

机构 * Department of Computer Science and Artificial Intelligence, University of Technology Nuremberg(计算机科学与人工智能系,图恩技术大学) Department of Engineering ``Enzo Ferrari'' (DIEF), University of Modena and Reggio Emilia(恩佐·费尔拉蒂工程系(DIEF),摩德纳和雷吉奥艾米利亚大学) Technical University of Munich(慕尼黑技术大学)

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract)

AI总结 Lan-grasp利用大语言模型实现更精确的语义抓取与放置,通过结合多种模型提升抓取效果和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05552 2026-02-06 cs.RO cs.CV 67%

VLN-Pilot: Large Vision-Language Model as an Autonomous Indoor Drone Operator

VLN-Pilot: 大型视觉-语言模型作为自主室内无人机操作员

Bessie Dominguez-Dager, Sergio Suescun-Ferrandiz, Felix Escalona, Francisco Gomez-Donoso, Miguel Cazorla

机构 * University Institute for Compute Research(计算研究大学研究所) University of Alicante(阿利坎特大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 VLN-Pilot利用大型视觉-语言模型实现自主室内无人机导航,通过自然语言指令和视觉感知结合,提高飞行任务的自主性和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23646 2026-02-06 cs.CV 67%

Active Perception Agent for Omnimodal Audio-Video Understanding

多模态音频视频理解的主动感知代理

Keda Tao, Wenjie Du, Bohan Yu, Weiqiang Wang, Jian Liu, Huan Wang

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 OmniAgent通过动态规划和音频引导感知范式,实现多模态细粒度推理,无需训练即超越现有模型性能。

Comments Website:https://kd-tao.github.io/OmniAgent/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05273 2026-02-06 cs.RO 67%

Affordance-Aware Interactive Decision-Making and Execution for Ambiguous Instructions

具有包容性的交互决策与执行以应对模糊指令

Hengxuan Xu, Fengbo Lan, Zhixin Zhao, Shengjie Wang, Mengqiao Liu, Jieqian Sun, Yu Cheng, Tao Zhang

机构 * Department of Automation, Tsinghua University(清华大学自动化系) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Institute for Interdisciplinary Information Sciences, Tsinghua University(清华大学交叉信息学院) Computer Science and Engineering Department, Chinese University of Hong Kong(香港中文大学计算机科学与工程系)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 AIDE通过双流框架整合交互式探索与视觉-语言推理,实现对模糊指令的高效决策与执行,提升机器人在陌生环境中的任务规划能力。

Comments 14 pages, 10 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04118 2026-02-05 cs.LG cs.AI cs.CL 67%

Policy Learning with a Language Bottleneck

具有语言瓶颈的策略学习

Megha Srivastava, Cedric Colas, Dorsa Sadigh, Jacob Andreas

机构 * Stanford University(斯坦福大学) Massachusetts Institute of Technology(麻省理工学院) Inria(法国国家信息与自动化技术研究院)

专题命中 规划推理 :planning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 通过语言瓶颈框架,AI代理能生成可解释的策略规则,提升与人类的协作效率。

Comments Accepted to TMLR (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03622 2026-02-04 cs.CL cs.AI cs.LG 67%

Align to Structure: Aligning Large Language Models with Structural Information

对齐结构:将大型语言模型与结构信息对齐

Zae Myung Kim, Anand Ramachandran, Farideh Tavazoee, Joo-Kyung Kim, Oleg Rokhlenko, Dongyeop Kang

专题命中 规划推理 :planning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 通过整合语言学话语框架到强化学习中,结构对齐方法提升LLMs在长文本生成和摘要任务中的连贯性和结构组织能力。

Comments Accepted to AAAI 2026 AIA

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01725 2026-02-03 cs.CL cs.AI cs.LG 67%

SafePred: A Predictive Guardrail for Computer-Using Agents via World Models

SafePred: 通过世界模型为计算机使用代理构建一种预测性防护措施

Yurun Chen, Zeyi Liao, Ping Yin, Taotao Xie, Keting Yin, Shengyu Zhang

机构 * Zhejiang University, China(浙江大学) The Ohio State University, USA(俄亥俄州立大学)

专题命中 规划推理 :planning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 SafePred通过世界模型预测未来风险,构建风险到决策的循环,提升计算机使用代理的安全性和任务效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01226 2026-02-03 cs.RO cs.HC 67%

SkySim: A ROS2-based Simulation Environment for Natural Language Control of Drone Swarms using Large Language Models

SkySim: 一种基于ROS2的无人机群自然语言控制仿真环境

Aditya Shibu, Marah Saleh, Mohamed Al-Musleh, Nidhal Abdulaziz

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 SkySim通过基于ROS2的仿真框架,利用大型语言模型实现无人机群的自然语言控制,结合人工势场算法确保安全执行,验证了空间推理精度和实时碰撞避免能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22431 2026-02-03 cs.SE 67%

TreeMind: Automatically Reproducing Android Bug Reports via LLM-empowered Monte Carlo Tree Search

TreeMind: 通过LLM赋能的蒙特卡洛树搜索自动重现Android bug报告

Zhengyu Chen, Zhaoyi Meng, Wenxiang Zhao, Wansen Wang, Wenchao Huang, Jie Cui, Hong Zhong, Yan Xiong

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 TreeMind结合LLM与MCTS算法,通过语义推理和反馈导航,高效重现Android bug报告。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21504 2026-01-30 cs.RO 67%

Don't double it: Efficient Agent Prediction in Occlusions

不要双倍:遮挡中的高效代理预测

Anna Rothenhäusler, Markus Mazzola, Andreas Look, Raghu Rajan, Joschka Bödecker

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 本文提出MatchInformer方法,通过整合Hungarian匹配和分离航向与运动,提升遮挡场景下的代理预测准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20833 2026-01-29 cs.CE 67%

Idea2Story: An Automated Pipeline for Transforming Research Concepts into Complete Scientific Narratives

Idea2Story: 一种将研究概念转化为完整科学叙述的自动化流程

Tengyue Xu, Zhuoyang Qian, Gaoge Liu, Li Ling, Zhentao Zhang, Biao Wu, Shuo Zhang, Ke Lu, Wei Shi, Ziqi Wang, Zheng Feng, Yan Luo, Shu Xu, Yongjin Chen, Zhibo Feng, Zhuo Chen, Bruce Yuan, Harry Wang, Kris Chen

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 Idea2Story通过离线知识构建实现自主科学发现,提升研究效率与可靠性。

Comments 11 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17219 2026-01-27 cs.RO 67%

Advancing Improvisation in Human-Robot Construction Collaboration: Taxonomy and Research Roadmap

推动人机协同建造中的即兴能力:分类与研究路线图

David Wireko Atibila, Vineet R. Kamat, Carol C. Menassa

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 本文提出六级分类法,分析人机协同建造中即兴能力的发展现状与未来研究方向,指出技术、概念和方法学三方面障碍,建议通过增强现实、大语言模型和云系统提升人机协作水平。

Comments 73 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14506 2026-01-27 cs.RO 67%

InteLiPlan: An Interactive Lightweight LLM-Based Planner for Domestic Robot Autonomy

InteLiPlan:一种交互式轻量级基于大语言模型的规划器,用于家用机器人自主性

Kim Tien Ly, Kai Lu, Ioannis Havoutis

机构 * Middlesex University(中塞克斯大学) Oxford Robotics Institute, University of Oxford(牛津机器人研究所,牛津大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 InteLiPlan是一种基于大语言模型的轻量级交互式规划器,通过实时机载计算实现家用机器人自主性和鲁棒性的提升,成功完成95%的任务执行率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16276 2026-01-26 cs.CL cs.AI cs.GT cs.LG cs.MA 67%

GameTalk: Training LLMs for Strategic Conversation

GameTalk: 训练 LLMs 进行战略性对话

Victor Conchello Vendrell, Max Ruiz Luyten, Mihaela van der Schaar

机构 * University of Cambridge(剑桥大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 GameTalk 通过多轮互动训练 LLMs 实现战略性决策,优于传统方法,尤其在奖励塑造下表现突出。

Comments 32 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15743 2026-01-23 cond-mat.mtrl-sci 67%

Materealize: a multi-agent deliberation system for end-to-end material design and synthesis

Materealize: 一种用于端到端材料设计与合成的多智能体协商系统

Seongmin Kim, Jaehwan Choi, Kunik Jang, Junkil Park, Varinia Bernales, Alán Aspuru-Guzik, Yousung Jung

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 Materealize通过多智能体协商系统实现端到端无机材料设计与合成,结合工具精度与推理整合,提升计算发现与实验实现的衔接。

Comments 30 pages main text, 8 main figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05882 2026-01-23 cs.CL cs.AI cs.LG 67%

Collaborate, Deliberate, Evaluate: How LLM Alignment Affects Coordinated Multi-Agent Outcomes

协作、审议、评估:LLM对齐如何影响协调的多智能体结果

Abhijnan Nath, Carine Graff, Nikhil Krishnaswamy

机构 * Natural Language (SIGNAL) Lab Colorado State University Fort Collins, CO USA Natural Language (SIGNAL) Lab Colorado State University

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文研究了LLM对齐方法如何影响多智能体协作效果,通过干预代理促进审议式决策,发现鲁棒性方法在支持正确任务结果方面表现更优。

Comments This submission is a new version of arXiv:2509.05882v1. with a substantially revised experimental pipeline and new metrics. In particular, collaborator agents are now instantiated independently via separate API calls, rather than generated autoregressively by a single agent. All experimental results are new. Accepted as an extended abstract at AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15047 2026-01-22 cs.MA cs.GT 67%

Game-Theoretic Lens on LLM-based Multi-Agent Systems

基于博弈论的基于大语言模型的多智能体系统视角

Jianing Hao, Han Ding, Yuanjian Xu, Tianze Sun, Ran Chen, Wanbo Zhang, Guang Zhang, Siguang Li

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 本文通过博弈论视角,系统综述了基于大语言模型的多智能体系统,构建了理解、比较和指导未来研究的框架。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13763 2026-01-21 cs.CE 67%

TransMode-LLM: Feature-Informed Natural Language Modeling with Domain-Enhanced Prompting for Travel Behavior Modeling

TransMode-LLM: 基于领域增强提示的特征引导自然语言建模用于旅行行为建模

Meijing Zhang, Ying Xu

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 TransMode-LLM通过结合统计方法与LLM技术,利用领域增强提示提升旅行行为预测的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02121 2026-01-21 cs.DB cs.DC 67%

Batch Query Processing and Optimization for Agentic Workflows

批量查询处理与优化用于代理工作流

Junyi Shen, Noppanat Wadlom, Yao Lu

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 Halo通过统一查询优化与异构LLM服务,提升代理工作流在批量推理和在线服务中的效率,实现3.6倍速度提升和2.6倍吞吐量改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11475 2026-01-19 cs.CV 67%

Generative Scenario Rollouts for End-to-End Autonomous Driving

生成场景回放用于端到端自动驾驶

Rajeev Yasarla, Deepti Hegde, Shizhong Han, Hsin-Pai Cheng, Yunxiao Shi, Meysam Sadeghigooghari, Shweta Mahajan, Apratim Bhattacharyya, Litian Liu, Risheek Garrepalli, Thomas Svantesson, Fatih Porikli, Hong Cai

机构 * Qualcomm AI Research(高通人工智能研究)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 GeRo通过自回归回放策略,结合规划与生成,提升自动驾驶系统的长期推理和多代理规划能力。

详情

展开后加载摘要…

URL PDF HTML 收藏