arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-11 至 2025-12-11 共收录 19 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 19 篇

2512.09310 2025-12-11 cs.RO 88%

Scene-agnostic Hierarchical Bimanual Task Planning via Visual Affordance Reasoning

场景无关的双臂任务规划 via 视觉可及性推理

Kwang Bin Lee, Jiho Kang, Sung-Hee Lee

机构 * Graduate School of Culture Technology, Korea Advanced Institute of Science and Technology (KAIST)(文化科技研究生院,韩国科学技术院)

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract)

AI总结 本文提出了一种场景无关的双臂任务规划框架,通过视觉可及性推理实现双臂操作的高效规划与执行。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09679 2025-12-11 cs.SE 87%

Understanding Chain-of-Thought Effectiveness in Code Generation: An Empirical and Information-Theoretic Analysis

理解链式思维在代码生成中的有效性:一项经验性与信息论分析

Naizhu Jin, Zhong Li, Guang Yang, Tian Zhang, Qingkai Zeng

专题命中 规划推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);planning(abstract)

AI总结 本研究通过经验分析和信息论方法,揭示了链式思维在代码生成中有效性的影响因素,发现结构化CoT在提升生成质量方面表现更优,且其效果受语言系统和模型容量影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09349 2025-12-11 cs.RO 85%

COVLM-RL: Critical Object-Oriented Reasoning for Autonomous Driving Using VLM-Guided Reinforcement Learning

COVLM-RL:基于VLM引导强化学习的自动驾驶中关键对象导向推理

Lin Li, Yuxin Cai, Jianwu Fang, Jianru Xue, Chen Lv

机构 * School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与航空航天工程学院) National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, National Engineering Research Center for Visual Information and Applications, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(西安交通大学人机混合增强智能国家重点实验室、视觉信息与应用国家工程研究中心、人工智能与机器人研究院)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract)

AI总结 COVLM-RL通过结合关键对象导向推理与VLM引导强化学习,提升了自动驾驶系统的泛化能力和训练效率。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09897 2025-12-11 cs.AI cs.CL 84%

SCOPE: Language Models as One-Time Teacher for Hierarchical Planning in Text Environments

SCOPE:语言模型作为一次性教师用于文本环境中的分层规划

Haoye Lu, Pavan Seshadri, Kaheer Suleman

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);分类 cs.CL、cs.AI

AI总结 SCOPE通过一次性利用LLM生成的子目标预训练轻量级模型,实现高效文本环境分层规划,比ADaPT方法在成功率和推理效率上更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08580 2025-12-11 cs.RO cs.AI 83%

Mind to Hand: Purposeful Robotic Control via Embodied Reasoning

Mind to Hand: 通过具身推理实现目的性机器人控制

Peijun Tang, Shangjin Xie, Binyan Sun, Baifu Huang, Kuncheng Luo, Haotian Yang, Weiqi Jin, Jianan Wang

专题命中 规划推理 :reasoning(title,abstract);planning(abstract);分类 cs.AI

AI总结 Lumo-1通过具身推理实现目的性机器人控制,结合视觉语言动作模型提升机器人推理与动作协调能力。

Comments 49 pages, 25 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08996 2025-12-11 cs.CV cs.AI cs.LG 81%

Demo: Generative AI helps Radiotherapy Planning with User Preference

演示:生成式AI助力放疗计划制定与用户偏好

Riqiang Gao, Simon Arberet, Martin Kraus, Han Liu, Wilko FAR Verbakel, Dorin Comaniciu, Florin-Cristian Ghesu, Ali Kamen

机构 * Digital Technology and Innovation, Siemens Healthineers(西门子医疗数字化技术与创新部) Varian Medical Systems, Siemens Healthineers(Varian医疗系统,西门子医疗)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 生成式AI通过用户自定义偏好提升放疗计划的灵活性与个性化,优于现有方法在适应性和计划质量上

Comments Best paper in GenAI4Health at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.05664 2025-12-11 cs.RO cs.AI 80%

Altruistic Maneuver Planning for Cooperative Autonomous Vehicles Using Multi-agent Advantage Actor-Critic

为合作自主车辆的利他性动作规划使用多智能体优势Actor-Critic

Behrad Toghi, Rodolfo Valiente, Dorsa Sadigh, Ramtin Pedarsani, Yaser P. Fallah

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种多智能体优势Actor-Critic算法,用于自动驾驶车辆在混合交通环境中的利他性动作规划,以提升交通效率与安全。

Comments Accepted to 2021 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR 2021) - Workshop on Autonomous Driving: Perception, Prediction and Planning

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09864 2025-12-11 cs.CV 75%

UniUGP: Unifying Understanding, Generation, and Planing For End-to-end Autonomous Driving

UniUGP:统一理解、生成与规划以实现端到端自动驾驶

Hao Lu, Ziyang Liu, Guangfeng Jiang, Yuanfei Luo, Sheng Chen, Yangang Zhang, Ying-Cong Chen

机构 * ByteDance Seed(字节跳动种子)

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract);planning(abstract)

AI总结 UniUGP通过整合预训练视觉模型和视频生成模型,实现端到端自动驾驶中的场景推理、视频生成和轨迹规划,提升复杂场景下的性能和泛化能力。

Comments Project Page: https://seed-uniugp.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09403 2025-12-11 cs.LG 70%

Black-Box Behavioral Distillation Breaks Safety Alignment in Medical LLMs

黑盒行为蒸馏破坏医疗大语言模型的安全对齐

Sohely Jahan, Ruimin Sun

专题命中 规划推理 :reasoning(abstract);verifier(abstract);分类 cs.LG

AI总结 黑盒行为蒸馏攻击揭示医疗大语言模型的安全对齐漏洞,通过低成本手段复制模型能力并破坏安全机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09458 2025-12-11 cs.AI cs.LG 62%

Architectures for Building Agentic AI

构建代理AI的架构

Sławomir Nowaczyk

机构 * Center for Applied Intelligent Systems Research, Halmstad University, Sweden(应用智能系统研究所,哈尔姆斯塔德大学,瑞典)

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种构建代理AI的架构分类,通过组件化设计和显式控制循环提升系统可靠性。

Comments This is a preprint of a chapter accepted for publication in Generative and Agentic AI Reliability: Architectures, Challenges, and Trust for Autonomous Systems, published by Springer Nature

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09440 2025-12-11 cs.CL 57%

Knowledge-Augmented Large Language Model Agents for Explainable Financial Decision-Making

基于知识增强的大语言模型代理的可解释金融决策方法

Qingyuan Zhang, Yuxi Wang, Cancan Hua, Yulin Huang, Ning Lyu

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出基于知识增强的大语言模型代理,通过整合外部知识检索、语义表示和推理生成,提升金融决策的可解释性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09410 2025-12-11 cs.RO cs.LG cs.MA 57%

Generalizable Collaborative Search-and-Capture in Cluttered Environments via Path-Guided MAPPO and Directional Frontier Allocation

在 cluttered 环境中通过路径引导的 MAPPO 和方向性前沿分配实现可泛化的协作搜索与捕获

Jialin Ying, Zhihao Li, Zicheng Dong, Guohua Wu, Yihuan Liao

机构 * Department of Automation, Central South University, Changsha, China(自动化系,中南大学,长沙,中国)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 本文提出 PGF-MAPPO 方法,通过路径引导的 MAPPO 和方向性前沿分配,在 cluttered 环境中实现高效的协作搜索与捕获,展示了出色的泛化能力和性能优势。

Comments 7 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06653 2025-12-11 cs.AI 57%

LightSearcher: Efficient DeepSearch via Experiential Memory

LightSearcher: 通过经验记忆实现高效的深度搜索

Hengzhi Lan, Yue Yu, Li Qian, Li Peng, Jie Wu, Wei Liu, Jian Luan, Ting Bai

机构 * BaiJia AI Team, Beijing, China(北杰人工智能团队) Beijing University of Posts and Telecommunications, Beijing, China(北京邮电大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 LightSearcher通过引入经验记忆和自适应奖励机制,实现了高效深度搜索,显著提升效率并保持准确性。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17918 2025-12-11 cs.LG 57%

LLM Meeting Decision Trees on Tabular Data

基于逻辑决策树的表格数据LLM决策树

Hangting Ye, Jinmeng Li, He Zhao, Dandan Guo, Yi Chang

机构 * School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) CSIRO’s Data61(CSIRO数据61) Monash University(墨尔本大学) International Center of Future Science, Jilin University(吉林大学未来科学国际中心) Engineering Research Center of Knowledge-Driven Human-Machine Intelligence, MOE, China(知识驱动人机智能工程研究中心,教育部,中国)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出DeLTa方法,通过逻辑决策树规则中介将LLM整合到表格数据中,避免数据序列化,实现全数据学习,提升表格预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08953 2025-12-11 cs.HC cs.AI 57%

SimClinician: A Multimodal Simulation Testbed for Reliable Psychologist AI Collaboration in Mental Health Diagnosis

SimClinician: 一种多模态模拟测试平台,用于心理健康诊断中可靠的心理学家AI协作

Filippo Cenacchi, Longbing Cao, Deborah Richards

机构 * Macquarie University(麦考瑞大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 SimClinician是一种多模态模拟平台,通过整合音频、文本和目光-表情模式,帮助心理学家在心理健康诊断中与AI协作,提升诊断的准确性和交互的流畅性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09670 2025-12-11 cs.CV cs.SY eess.SY 50%

An Automated Tip-and-Cue Framework for Optimized Satellite Tasking and Visual Intelligence

一种自动化提示与提示框架用于优化卫星任务分配和视觉智能

Gil Weissman, Amir Ivry, Israel Cohen

机构 * Andrew and Erna Viterbi Faculty of Electrical and Computer Engineering, Technion-Israel Institute of Technology(安德鲁和伊尔纳·维特比电气与计算机工程学院,技术离子理工学院)

专题命中 规划推理 :planning(abstract)

AI总结 本文提出了一种自动化提示与提示框架,用于优化卫星任务分配和视觉智能,通过生成提示和任务并利用人工智能模型处理影像,提升地球观测效率。

Comments Under review at IEEE Transactions on Geoscience and Remote Sensing (TGRS). 13 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05447 2025-12-11 cs.MA 50%

Distributed scalable coupled policy algorithm for networked multi-agent reinforcement learning

分布式可扩展耦合策略算法用于网络化多智能体强化学习

Pengcheng Dai, Dongming Wang, Wenwu Yu, Wei Ren

专题命中 规划推理 :planning(abstract)

AI总结 本文提出了一种分布式可扩展耦合策略算法,用于解决网络化多智能体强化学习中的相互依赖奖励和耦合策略问题,通过几何2步采样方法实现无偏梯度估计,提升协同优化效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03166 2025-12-11 cs.CV 50%

RingMoE: Mixture-of-Modality-Experts Multi-Modal Foundation Models for Universal Remote Sensing Image Interpretation

RingMoE:面向通用遥感图像解释的多模态专家混合多模态基础模型

Hanbo Bi, Yingchao Feng, Boyuan Tong, Mengyu Wang, Haichen Yu, Yongqiang Mao, Hao Chang, Wenhui Diao, Peijin Wang, Yue Yu, Hanyang Peng, Yehong Zhang, Kun Fu, Xian Sun

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航天信息研究所) School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院) University of Chinese Academy of Sciences(中国科学院大学) Key Laboratory of Target Cognition and Application Technology(TCAT), Aerospace Information Research Institute, Chinese Academy of Sciences(目标认知与应用技术重点实验室) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Peng Cheng Laboratory, Shenzhen(鹏城实验室)

专题命中 规划推理 :planning(abstract)

AI总结 RingMoE是一种多模态专家混合模型,通过自监督学习和物理信息嵌入,提升遥感图像的多模态处理能力,实现从单模态到多模态的高效适应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08995 2025-12-11 cs.HC cs.IR 50%

PoultryTalk: A Multi-modal Retrieval-Augmented Generation (RAG) System for Intelligent Poultry Management and Decision Support

PoultryTalk: 一种用于智能家禽管理与决策支持的多模态检索增强生成(RAG)系统

Kapalik Khanal, Biswash Khatiwada, Stephen Afrifa, Ranjan Sapkota, Sanjay Shah, Frank Bai, Ramesh Bahadur Bist

专题命中 规划推理 :planning(abstract)

AI总结 PoultryTalk是一种多模态RAG系统,通过文本和图像交互为家禽管理提供实时专家指导,实现了高准确率和用户满意度。

详情

展开后加载摘要…

URL PDF HTML 收藏