arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11088 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11088 篇

2511.23055 2026-02-25 cs.AI 79%

MindPower: Enabling Theory-of-Mind Reasoning in VLM-based Embodied Agents

MindPower: 使基于视觉语言的具身智能体具备心智理论推理能力

Ruoxuan Zhang, Qiyun Zheng, Zhiyu Zhou, Ziqi Liao, Siyu Wu, Jian-Yu Jiang-Lin, Bin Wen, Hongxia Xie, Jianlong Fu, Wen-Huang Cheng

机构 * Jilin University(吉林大学) National Taiwan University(台湾大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 MindPower通过整合感知、心理推理、决策和行动,使基于视觉语言的具身智能体具备心智理论推理能力,并在决策和行动生成上超越GPT-4o。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19980 2026-02-24 cs.LG 79%

Discrete Diffusion Models Exploit Asymmetry to Solve Lookahead Planning Tasks

离散扩散模型利用不对称性解决前瞻规划任务

Itamar Trainin, Shauli Ravfogel, Omri Abend, Amir Feder

机构 * Hebrew University of Jerusalem(耶路撒冷希伯来大学) New York University(纽约大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.LG

AI总结 离散扩散模型通过反向生成机制在无需复杂遍历机制的情况下解决前瞻规划任务,相比自回归模型更高效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19633 2026-02-24 cs.AI 79%

TAPE: Tool-Guided Adaptive Planning and Constrained Execution in Language Model Agents

TAPE: 语言模型代理中的工具引导自适应规划与约束执行

Jongwon Jeong, Jungtaek Kim, Kangwook Lee

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 TAPE通过工具引导的自适应规划与约束执行方法,提升语言模型代理在复杂任务中的成功率,特别是在困难设置中表现显著优于现有框架。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19304 2026-02-24 cs.RO cs.AI cs.HC cs.MA 79%

Safe and Interpretable Multimodal Path Planning for Multi-Agent Cooperation

安全且可解释的多模态路径规划用于多智能体协作

Haojun Shi, Suyu Ye, Katherine M. Guerrerio, Jianzhi Shen, Yifan Yin, Daniel Khashabi, Chien-Ming Huang, Tianmin Shu

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 CaPE通过多模态路径规划实现安全且可解释的多智能体协作,利用视觉-语言模型和模型基于规划器确保路径调整的安全性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19040 2026-02-24 cs.IR cs.AI cs.MM 79%

Adaptive Multi-Agent Reasoning for Text-to-Video Retrieval

自适应多智能体推理用于文本到视频检索

Jiaxin Wu, Xiao-Yong Wei, Qing Li

机构 * Shenzhen University(深圳大学) The Hong Kong Polytechnic University(香港理工大学) Sichuan University(四川大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出自适应多智能体框架,通过动态协调检索、推理和查询重述智能体,提升文本到视频检索的零样本跨模态对齐与复杂查询处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09877 2026-02-24 cs.AI 79%

Synergising Human-like Responses and Machine Intelligence for Planning in Disaster Response

融合人类样响应与机器智能以应对灾害响应中的规划

Savvas Papaioannou, Panayiotis Kolios, Christos G. Panayiotou, Marios M. Polycarpou

机构 * KIOS Research and Innovation Center of Excellence(KIOS研究与创新卓越中心) Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出融合人类样响应与机器智能的框架,以提升灾害响应中复杂任务的规划效率。

Comments 2024 IEEE World Congress on Computational Intelligence (IEEE WCCI), 2024 International Joint Conference on Neural Networks (IJCNN)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23029 2026-02-20 cs.LG cs.SY eess.SY 79%

Risk-Aware Decision Making in Restless Bandits: Theory and Algorithms for Planning and Learning

在 restless bandits 中的风险意识决策:用于规划和学习的理论与算法

Nima Akbarzadeh, Yossiri Adulyasak, Erick Delage

专题命中 规划推理 :planning(title,abstract);分类 cs.LG

AI总结 本文提出了一种风险意识的 restless bandits 决策方法,结合理论与算法,用于规划和学习场景中降低风险暴露。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10992 2026-02-19 cs.LG cs.NI 79%

ReaCritic: Reasoning Transformer-based DRL Critic-model Scaling For Wireless Networks

ReaCritic: 基于推理的变压器DRL批评模型扩展用于无线网络

Feiran You, Hongyang Du

机构 * Department of Electrical and Electronic Engineering, University of Hong Kong(香港大学电子与电气工程系)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.LG

AI总结 ReaCritic通过引入基于推理的变压器结构,提升DRL在无线网络中的适应性和性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10999 2026-02-19 cs.HC cs.AI 79%

Cocoa: Co-Planning and Co-Execution with AI Agents

Cocoa:基于AI代理的协同规划与协同执行

K. J. Kevin Feng, Kevin Pu, Matt Latzke, Tal August, Pao Siangliulue, Jonathan Bragg, Daniel S. Weld, Amy X. Zhang, Joseph Chee Chang

机构 * University of Washington(华盛顿大学) University of Toronto(多伦多大学) Allen Institute for AI(人工智能研究院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 Cocoa通过协同规划与执行机制,提升人机协作灵活性,支持复杂研究任务的自主可控与高效执行。

Comments CHI 2026 paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15074 2026-02-18 cs.SD cs.AI 79%

Structure-Aware Piano Accompaniment via Style Planning and Dataset-Aligned Pattern Retrieval

通过风格规划和数据集对齐的模式检索实现结构感知的钢琴伴奏

Wanyu Zang, Yang Yu, Meng Yu

机构 * Lewis University(利维斯大学) Nexus Art Foundation(nexus艺术基金会) Governors State University(governors州大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种结构感知的钢琴伴奏生成方法,通过风格规划和数据集对齐的模式检索实现多样化的伴奏生成。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14955 2026-02-17 cs.CL cs.SE 79%

Tool-Aware Planning in Contact Center AI: Evaluating LLMs through Lineage-Guided Query Decomposition

接触中心AI中的工具感知规划:通过 lineage 引导的查询分解评估LLMs

Varun Nathan, Shreyas Guha, Ayush Kumar

专题命中 规划推理 :planning(title,abstract);分类 cs.CL

AI总结 本文提出接触中心AI中的工具感知规划框架,通过lineage引导查询分解评估LLMs,揭示工具理解的不足及简计划的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14470 2026-02-17 cs.CL 79%

HyperRAG: Reasoning N-ary Facts over Hypergraphs for Retrieval Augmented Generation

HyperRAG:基于超图的n元事实推理用于检索增强生成

Wen-Sheng Lien, Yu-Kai Chan, Hao-Lung Hsiao, Bo-Kai Ruan, Meng-Fen Chiang, Chien-An Chen, Yi-Ren Yeh, Hong-Han Shuai

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学) National Kaohsiung Normal University(国立高雄师范大学) Institute for Clarity in Documentation(文档清晰研究所) Inria Paris-Rocquencourt(巴黎-勒克努尔研究所) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 HyperRAG通过n元超图推理提升检索增强生成的准确性与效率

Comments Accepted by The ACM Web Conference 2026 (WWW '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14089 2026-02-17 cs.DB cs.AI 79%

TabTracer: Monte Carlo Tree Search for Complex Table Reasoning with Large Language Models

TabTracer:基于大语言模型的复杂表格推理的蒙特卡洛树搜索

Zhizhao Luo, Zhaojing Luo, Meihui Zhang, Rui Mao

机构 * Beijing Institute of Technology, Zhuhai(北京理工大学(珠海)) Beijing Institute of Technology(北京理工大学) Shenzhen University(深圳大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 TabTracer通过多步工具调用和显式状态跟踪,提升复杂表格推理的准确率并降低token成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14035 2026-02-17 cs.AI 79%

FloCA: Towards Faithful and Logically Consistent Flowchart Reasoning

FloCA: 向忠实且逻辑一致的流程图推理迈进

Jinzi Zou, Bolin Wang, Liang Li, Shuo Zhang, Nuo Xu, Junzhou Zhao

机构 * MoE KLINNS Lab, Xi’an Jiaotong University, Xi’an 710049, P. R. China(西安交通大学) China Mobile Group Shaanxi Co., Ltd.(中国移动集团陕西公司)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 FloCA通过结合LLM和外部工具实现流程图推理,解决现有方法在流程图拓扑表示和幻觉问题上的不足,提升对话系统的准确性和一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11839 2026-02-17 cs.AI 79%

On the Eligibility of LLMs for Counterfactual Reasoning: A Decompositional Study

关于大型语言模型用于反事实推理的资格性:一种分解性研究

Shuai Yang, Qi Yang, Luoxi Tang, Yuqiao Meng, Nancy Guo, Jeremy Blackburn, Zhaohan Xi

机构 * Shuai Yang(1 阳帅) Qi Yang(2 杨琪)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出一种分解策略,分析LLMs在反事实推理中的表现,探讨不同任务和模态对性能的影响,以提升LLM推理系统的可靠性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13691 2026-02-17 cs.AI 79%

PhGPO: Pheromone-Guided Policy Optimization for Long-Horizon Tool Planning

PhGPO:基于信息素的策略优化用于长周期工具规划

Yu Li, Guangfeng Cai, Shengtian Yang, Han Luo, Shuo Han, Xu He, Dong Li, Lei Feng

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 PhGPO通过学习历史轨迹中的信息素模式,指导策略优化以提升长周期工具规划能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13332 2026-02-17 cs.CV cs.AI 79%

MedScope: Incentivizing "Think with Videos" for Clinical Reasoning via Coarse-to-Fine Tool Calling

MedScope:通过粗到细的工具调用激励“通过视频思考”以进行临床推理

Wenjie Li, Yujie Zhang, Haoran Sun, Xingqi He, Hongcheng Gao, Chenglong Ma, Ming Hu, Guankun Wang, Shiyi Yao, Renhao Yang, Hongliang Ren, Lei Wang, Junjun He, Yankai Jiang

机构 * College of Health Science and Technology, Shanghai Jiao Tong University School of Medicine, Shanghai, China(上海交通大学医学院健康科学与技术学院) Fudan University, Shanghai, China(复旦大学) Shanghai Innovation Institute, Shanghai, China(上海创新研究院) Tsinghua University, Beijing, China(清华大学) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室) The Chinese University of Hong Kong, Hong Kong, China(香港中文大学) Ruijin Hospital, Shanghai Jiaotong University, Shanghai, China(上海交通大学瑞金医院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 MedScope通过粗到细的工具调用机制,提升临床视频推理的准确性与可信度,实现基于时间局部化视觉证据的医疗AI代理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22323 2026-02-17 cs.LG 79%

Models Under SCOPE: Scalable and Controllable Routing via Pre-hoc Reasoning

模型在SCOPE下:通过预先推理实现可扩展和可控的路由

Qi Cao, Shuhao Zhang, Ruizhe Zhou, Ruiyi Zhang, Peijia Qin, Pengtao Xie

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.LG

AI总结 SCOPE通过预先推理预测模型成本和性能,实现动态路由决策,提升准确率或降低成本

Comments We propose SCOPE, a model routing framework that predicts how accurate and how expensive each model will be before running it, allowing users to control cost-accuracy trade-offs and naturally handle new models

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12574 2026-02-16 cs.DB cs.AI 79%

Monte Carlo Tree Search with Reasoning Path Refinement for Small Language Models in Conversational Text-to-NoSQL

具有推理路径细化的蒙特卡洛树搜索用于对话文本到NoSQL

Xubang Xiong, Raymond Chi-Wing Wong, Yuanfeng Song

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出Stage-MCTS框架,通过蒙特卡洛树搜索和推理路径细化,提升小型语言模型在对话文本到NoSQL任务中的查询生成能力,实验显示其EVM准确性提升达7.93%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12055 2026-02-13 cs.AI cs.MA cs.RO 79%

Multi UAVs Preflight Planning in a Shared and Dynamic Airspace

共享动态空域中多无人机预飞行规划

Amath Sow, Mauricio Rodriguez Cesen, Fabiola Martins Campos de Oliveira, Mariusz Wzorek, Daniel de Leng, Mattias Tiger, Fredrik Heintz, Christian Esteve Rothenberg

机构 * Linköping University(林雪平大学) Universidade Estadual de Campinas(坎皮纳斯州立大学) Universidade Federal do ABC(ABC联邦大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 DTAPP-IICR通过增量迭代冲突解决方法,实现了在动态共享空域中大规模无人机预飞行规划的高效与高成功率。

Comments AAMAS 2026 accepted paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16839 2026-02-13 cs.AI 79%

Roundtable Policy: Confidence-Weighted-Consensus Aggregation Improves Multi-Agent-System Reasoning

圆桌政策:置信度加权共识聚合提升多智能体系统推理

Yu Yao, Jiayi Dong, Yang Yang, Ju Li, Yilun Du

机构 * mit(麻省理工学院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 圆桌政策通过多语言模型加权共识提升多智能体系统在复杂科学任务中的推理能力

Comments Project page: https://ai4scidisc.github.io/roundtable/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10485 2026-02-12 cs.AI 79%

Abstraction Generation for Generalized Planning with Pretrained Large Language Models

基于预训练大语言模型的通用规划抽象生成

Zhenhe Cui, Huaxiang Xia, Hangjun Shen, Kailun Luo, Yong He, Wei Liang

机构 * Hunan University of Science and Technology(湖南科技大学) Dongguan University of Technology(东莞理工学院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出利用预训练大语言模型生成通用规划的抽象,并通过自动化调试修正抽象,以提升规划效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10439 2026-02-12 cs.SD cs.AI eess.AS 79%

AudioRouter: Data Efficient Audio Understanding via RL based Dual Reasoning

AudioRouter: 通过基于强化学习的双推理实现数据高效的音频理解

Liyang Chen, Hongkai Chen, Yujun Cai, Sifan Li, Qingwen Ye, Yiwei Wang

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 AudioRouter通过强化学习双推理机制,以更少的数据训练实现LALMs在音频理解上的高效提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09517 2026-02-11 cs.CL 79%

Knowledge Integration Decay in Search-Augmented Reasoning of Large Language Models

在大语言模型的搜索增强推理中知识整合衰减

Sangwon Yu, Ik-hwan Kim, Donghun Kang, Bongkyu Hwang, Junhwa Choi, Suk-hoon Jung, Seungki Hong, Taehee Lee, Sungroh Yoon

机构 * Department of Electrical and Computer Engineering, Seoul National University, Seoul, Korea(电气与计算机工程系,首尔国立大学,韩国首尔) Interdisciplinary Program in Artificial Intelligence, Seoul National University, Seoul, Korea(人工智能交叉学科项目,首尔国立大学,韩国首尔)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本研究提出SAKE方法,通过在推理过程前后锚定检索知识,缓解大语言模型在搜索增强推理中的知识整合衰减问题,提升多跳问答和复杂推理任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09341 2026-02-11 cs.AI 79%

Auditing Multi-Agent LLM Reasoning Trees Outperforms Majority Vote and LLM-as-Judge

对多智能体大语言模型推理树进行审计优于多数投票和LLM作为裁判

Wei Yang, Shixuan Li, Heng Ping, Peiyu Zhang, Paul Bogdan, Jesse Thomason

机构 * University of Southern California, Los Angeles, CA, USA(美国南加州大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 通过构建推理树路径搜索机制,AgentAuditor在多智能体系统中实现了优于多数投票和LLM作为裁判的推理准确性提升

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11276 2026-02-11 cs.HC cs.AI 79%

Words to Describe What I'm Feeling: Exploring the Potential of AI Agents for High Subjectivity Decisions in Advance Care Planning

描述我感受的词语:探索AI代理在前瞻性医疗计划中的潜在作用

Kellie Yu Hui Sim, Pin Sym Foong, Chenyu Zhao, Melanie Yi Ning Quek, Swarangi Subodh Mehta, Kenny Tsu Wei Choo

机构 * Singapore University of Technology and Design(新加坡科技设计大学) National University of Singapore(国立新加坡大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文探讨了AI代理在前瞻性医疗计划中的应用,通过实验发现AI可作为个人倡导者,提升个体与代理之间的相互理解。

Comments Accepted at CHI 2026. 34 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15305 2026-02-10 cs.AI 79%

Coarse-to-Fine Grounded Memory for LLM Agent Planning

粗到细的 grounded memory 用于 LLM agent 计划

Wei Yang, Jinwei Xiao, Hongming Zhang, Qingyang Zhang, Yanna Wang, Bo Xu

机构 * National Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institution of Automation, Chinese Academy of Sciences(认知与决策智能复杂系统国家重点实验室,自动化研究所,中国科学院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出 Coarse-to-Fine Grounded Memory,通过 LLM 实现粗到细的记忆 grounding,以提升代理在复杂规划任务中的灵活性和适应性。

Comments Accepted to EMNLP 2025 Main Conference;27 pages,15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15782 2026-02-10 cs.LG 79%

Solving General-Utility Markov Decision Processes in the Single-Trial Regime with Online Planning

在单次试验范式中求解一般效用马尔可夫决策过程的在线规划方法

Pedro P. Santos, Alberto Sardinha, Francisco S. Melo

机构 * INESC-ID & Instituto Superior Técnico(INESC-ID与理工学院)

专题命中 规划推理 :planning(title,abstract);分类 cs.LG

AI总结 本文提出了一种在单次试验范式中求解一般效用马尔可夫决策过程的方法,通过在线规划技术提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06493 2026-02-09 cs.LG 79%

Adaptive Uncertainty-Aware Tree Search for Robust Reasoning

自适应不确定性感知树搜索用于鲁棒推理

Zeen Song, Zihao Ma, Wenwen Qiang, Changwen Zheng, Gang Hua

机构 * Institute of Software Chinese Academy of Sciences, Beijing, China(中国科学院软件研究所) University of the Chinese Academy of Sciences(中国科学院大学) Multimodal Experiences Lab, Dolby Laboratories Inc(多模态体验实验室,Dolby Laboratories Inc) Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(人工智能与机器人研究所,西安交通大学) Electronic Information Science and Technology, Central South University(电子信息科学与技术,中南大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.LG

AI总结 本文提出UATS方法,通过蒙特卡洛Dropout估计不确定性并结合强化学习控制器,以缓解外部搜索中分布外样本的不确定性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06449 2026-02-09 cs.CL 79%

Evaluating an evidence-guided reinforcement learning framework in aligning light-parameter large language models with decision-making cognition in psychiatric clinical reasoning

评估一种证据引导的强化学习框架在对齐光参数大语言模型与精神科临床推理决策认知中的作用

Xinxin Lin, Guangxin Dai, Yi Zhong, Xiang Li, Xue Xiao, Yixin Zhang, Zhengdong Wu, Yongbo Zheng, Runchuan Zhu, Ming Zhao, Huizi Yu, Shuo Wu, Jun Zhao, Lingming Hu, Yumei Wang, Ping Yin, Joey W. Y. Chan, Ngan Yin Chan, Sijing Chen, Yun Kwok Wing, Lin Lu, Xin Ma, Lizhou Fan

机构 * The Chinese University of Hong Kong, Shatin, N.T., Hong Kong SAR, China(香港中文大学) Shandong University, Jinan, China(山东大学) Peking University Sixth Hospital, Beijing, China(北京大学第六医院) Inspur Cloud Information Technology Co., Ltd., Jinan, China(Inspur 云技术有限公司) Fudan University, Shanghai, China(复旦大学) Shandong Provincial Hospital Affiliated to Shandong First Medical University, Jinan, China(山东第一医科大学附属山东省人民医院) Jilin University, Changchun, China(吉林大学) Hong Kong ICI Cloud Service Limited, Hong Kong SAR, China(香港ICI云服务有限公司) Shandong First Medical University, Jinan, China(山东第一医科大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本研究提出ClinMPO框架,通过证据引导的强化学习使轻量LLM在复杂精神病学推理任务中达到超越人类的准确率。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏