arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5021 信号源:cs.CL, cs.AI, cs.LG

1. 复杂问题求解 5021 篇

2511.14256 2025-12-11 cs.AI cs.IR 79%

PathMind: A Retrieve-Prioritize-Reason Framework for Knowledge Graph Reasoning with Large Language Models

PathMind: 一种基于大语言模型的知识图谱推理检索-优先-推理框架

Yu Liu, Xixun Lin, Yanmin Shang, Yangxi Li, Shi Wang, Yanan Cao

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

AI总结 PathMind通过检索-优先-推理框架,提升大语言模型在知识图谱推理中的准确性和可解释性,尤其在复杂推理任务中表现优异。

Comments AAAI 2026, Long Paper, Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07783 2025-12-09 cs.CL 79%

On the Interplay of Pre-Training, Mid-Training, and RL on Reasoning Language Models

在预训练、中训练和强化学习对推理语言模型的相互作用中

Charlie Zhang, Graham Neubig, Xiang Yue

机构 * Carnegie Mellon University, Language Technologies Institute(卡内基梅隆大学,语言技术研究所)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.CL

AI总结 研究探讨了预训练、中训练和强化学习在推理语言模型中的相互作用,发现RL需预训练留有余地才能提升能力,中训练提升性能,过程级奖励提高推理准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06859 2025-12-09 cs.AI 79%

JT-DA: Enhancing Data Analysis with Tool-Integrated Table Reasoning Large Language Models

JT-DA:利用工具集成的表格推理大语言模型提升数据分析

Ce Chi, Xing Wang, Zhendong Wang, Xiaofan Liu, Ce Li, Zhiyan Song, Chen Zhao, Kexin Yang, Boshen Shi, Jingjing Yang, Chao Deng, Junlan Feng

机构 * Jiutian Research, China Mobile, Beijing, China(钧天研究,中国移动,北京)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

AI总结 JT-DA-8B通过工具集成的表格推理方法,提升复杂表格分析任务的性能和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06835 2025-12-09 cs.AI 79%

Decouple to Generalize: Context-First Self-Evolving Learning for Data-Scarce Vision-Language Reasoning

解耦以泛化:面向数据稀缺的视觉语言推理的上下文优先自进化学习

Tingyu Li, Zheng Sun, Jingxuan Wei, Siyuan Li, Conghui He, Lijun Wu, Cheng Tan

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai JiaoTong University(上海交通大学) University of Chinese Academy of Sciences(中国科学院大学) Zhejiang University(浙江大学)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

AI总结 DoGe通过双解耦框架,引导模型优先从上下文学习以提升数据稀缺下的视觉语言推理能力,提出两阶段RL方法和演进课程学习流水线,有效解决传统方法的奖励黑客问题。

Comments 25 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00331 2025-12-05 cs.CL 79%

TreeRare: Syntax Tree-Guided Retrieval and Reasoning for Knowledge-Intensive Question Answering

TreeRare: 语法树引导的检索与推理用于知识密集型问答

Boyi Zhang, Zhuo Liu, Hangfeng He

机构 * University of Rochester(罗切斯特大学)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.CL

AI总结 TreeRare通过语法树引导的检索与推理方法,提升知识密集型问答任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23476 2025-12-01 cs.AI 79%

Thinking by Doing: Building Efficient World Model Reasoning in LLMs via Multi-turn Interaction

通过多轮交互构建高效的LLM世界模型推理:WMAct

Bao Shu, Yan Cai, Jianjian Sun, Chunrui Han, En Yu, Liang Zhao, Jingcheng Hu, Yinmin Zhang, Haoran Lv, Yuang Peng, Zheng Ge, Xiangyu Zhang, Daxin Jiang, Xiangyu Yue

机构 * CUHK MMLab(香港中文大学MMLab) Peking University(北京大学) StepFun Tsinghua University(清华大学)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

AI总结 WMAct通过高效交互和主动推理机制,使LLM在复杂环境中实现高效世界模型推理,提升任务解决能力和迁移性能。

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22903 2025-12-01 cs.CV cs.AI 79%

Leveraging Textual Compositional Reasoning for Robust Change Captioning

利用文本组合推理实现鲁棒的变更描述

Kyu Ri Park, Jiyoung Park, Seong Tae Kim, Hong Joo Lee, Jung Uk Kim

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

AI总结 CORTEX通过整合文本线索和组合推理,提升图像变化描述的鲁棒性与准确性。

Comments Accepted at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09222 2025-12-01 cs.CL 79%

Toward Honest Language Models for Deductive Reasoning

迈向演绎推理中的诚实语言模型

Jiarui Liu, Kaustubh Dhole, Yingheng Wang, Haoyang Wen, Sarah Zhang, Haitao Mao, Gaotang Li, Neeraj Varshney, Jingguo Liu, Xiaoman Pan

机构 * Carnegie Mellon University(卡内基梅隆大学) Amazon(亚马逊) Emory University(埃默里大学) Cornell University(康奈尔大学) UIUC(伊利诺伊大学厄巴纳-香槟分校)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.CL

AI总结 本文提出ACNCHOR方法,通过注入真实轨迹防止训练崩溃,提升语言模型在演绎推理中的诚实推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20468 2025-11-26 cs.AI 79%

DRAFT-RL: Multi-Agent Chain-of-Draft Reasoning for Reinforcement Learning-Enhanced LLMs

DRAFT-RL: 多智能体链式草稿推理用于强化学习增强的大型语言模型

Yuanhao Li, Mingshan Liu, Hongbo Wang, Yiding Zhang, Yifei Ma, Wei Tan

机构 * BUPT(北京邮电大学) HKUST(GZ)(香港科技大学(广州)) University of Bristol(布里斯托大学)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

AI总结 DRAFT-RL通过多智能体链式草稿推理提升强化学习增强的LLM在复杂推理任务中的准确性和收敛速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20519 2025-11-26 cs.CV cs.AI 79%

Metis-HOME: Hybrid Optimized Mixture-of-Experts for Multimodal Reasoning

Metis-HOME: 面向多模态推理的混合优化专家混合模型

Xiaohan Lan, Fanfan Liu, Haibo Qiu, Siqi Yang, Delian Ruan, Peng Shi, Lin Ma

机构 * Meituan(美团)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

AI总结 Metis-HOME通过混合优化专家混合模型,提升多模态推理的复杂推理能力和通用能力,解决推理与泛化之间的矛盾。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05130 2025-11-26 cs.AI 79%

Scalable and Accurate Graph Reasoning with LLM-based Multi-Agents

基于大语言模型的多智能体图推理方法

Yuwei Hu, Runlin Lei, Xinyi Huang, Zhewei Wei, Yongchao Liu

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

AI总结 基于大语言模型的多智能体图推理方法,通过分解图问题为节点中心任务,提升图推理的准确性和扩展性。

Comments Accepted by AAAI 2026 Workshop WMAC

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16660 2025-11-25 cs.AI 79%

Cognitive Foundations for Reasoning and Their Manifestation in LLMs

认知基础与推理及其在大语言模型中的体现

Priyanka Kargupta, Shuyue Stella Li, Haocheng Wang, Jinu Lee, Shan Chen, Orevaoghene Ahia, Dean Light, Thomas L. Griffiths, Max Kleiman-Weiner, Jiawei Han, Asli Celikyilmaz, Yulia Tsvetkov

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Washington(华盛顿大学) Princeton University(普林斯顿大学) Harvard University(哈佛大学)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

AI总结 本文通过分析LLMs推理机制,揭示其在复杂问题上的表现优于简单变体,提出基于认知科学的28项元素分类,并开发测试时推理指导方法,提升复杂问题性能达66.7%。

Comments 40 pages, 4 tables, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12509 2025-11-25 cs.AI 79%

Graph of Verification: Structured Verification of LLM Reasoning with Directed Acyclic Graphs

验证图:基于有向无环图的结构化LLM推理验证

Jiwei Fang, Bin Zhang, Changwei Wang, Jin Wan, Zhiwei Xu

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出验证图(GoV),通过灵活的节点块架构实现适应性多粒度验证,有效解决LLM推理验证中的精度与鲁棒性平衡问题。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16331 2025-11-21 cs.CL 79%

Incorporating Self-Rewriting into Large Language Model Reasoning Reinforcement

将自我修正纳入大语言模型推理强化

Jiashu Yao, Heyan Huang, Shuang Zeng, Chuwei Luo, WangJie You, Jie Tang, Qingsong Liu, Yuhang Guo, Yangyang Kang

机构 * ByteDance China(字节跳动中国)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.CL

AI总结 本研究提出自我修正框架,通过重写推理文本提升大语言模型的内部推理质量,实验表明其在准确性与推理长度权衡上优于现有方法。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16043 2025-11-21 cs.LG 79%

Agent0: Unleashing Self-Evolving Agents from Zero Data via Tool-Integrated Reasoning

Agent0: 通过工具集成推理从零数据中释放自进化代理

Peng Xia, Kaide Zeng, Jiaqi Liu, Can Qin, Fang Wu, Yiyang Zhou, Caiming Xiong, Huaxiu Yao

机构 * Stanford University(斯坦福大学) Salesforce Research(Salesforce研究院)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.LG

AI总结 Agent0通过多步骤共进化和工具集成,在无需外部数据的情况下自主提升代理性能,显著增强推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15259 2025-11-20 cs.AI cs.CY 79%

Efficiency Will Not Lead to Sustainable Reasoning AI

Philipp Wiesner, Daniel W. O'Neill, Francesca Larosa, Odej Kao

机构 * TU Berlin(柏林技术大学) Universitat de Barcelona(巴塞罗那大学) KTH Royal Institute of Technology(皇家理工学院)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

Comments Presented at the Rethinking AI Workshop @ EurIPS'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06727 2025-11-20 cs.MA cs.AI 79%

S-DAG: A Subject-Based Directed Acyclic Graph for Multi-Agent Heterogeneous Reasoning

Jiangwen Dong, Zehui Lin, Wanyu Lin, Mingjin Zhang

机构 * PolyU

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15208 2025-11-20 cs.LG 79%

Reasoning in Diffusion Large Language Models is Concentrated in Dynamic Confusion Zones

Ranfei Chen, Ming Chen, Kaifei Wang

机构 * Institute of Computing Technology Chinese Academy of Sciences Beijing, China(计算技术研究所中国科学院北京)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12344 2025-11-20 cs.AI 79%

Reward and Guidance through Rubrics: Promoting Exploration to Improve Multi-Domain Reasoning

Baolong Bi, Shenghua Liu, Yiwei Wang, Siqian Tong, Lingrui Mei, Yuyao Ge, Yilong Xu, Jiafeng Guo, Xueqi Cheng

机构 * Key Laboratory of Network Data Science(网络数据科学实验室) Technology, Institute of Computing Technology, Chinese Academy of Sciences(技术,计算技术研究所,中国科学院) State Key Laboratory of AI Safety(人工智能安全国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) University of California, Merced(加州大学梅尔塞德斯分校)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06110 2025-11-19 cs.AI cs.MA 79%

PanelTR: Zero-Shot Table Reasoning Framework Through Multi-Agent Scientific Discussion

Yiran Rex Ma

机构 * School of Humanities(人文学院) Beijing Univeristy of Posts and Telecommunications(北京邮电大学)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

Comments Accepted at IJCNN 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06105 2025-11-18 cs.CL 79%

You Don't Need Pre-built Graphs for RAG: Retrieval Augmented Generation with Adaptive Reasoning Structures

Shengyuan Chen, Chuang Zhou, Zheng Yuan, Qinggang Zhang, Zeyang Cui, Hao Chen, Yilin Xiao, Jiannong Cao, Xiao Huang

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.CL

Comments This work has been accepted to AAAI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12659 2025-11-18 cs.CY cs.AI 79%

The Hidden Risks of Large Reasoning Models: A Safety Assessment of R1

Kaiwen Zhou, Chengzhi Liu, Xuandong Zhao, Shreedhar Jangam, Jayanth Srinivasa, Gaowen Liu, Dawn Song, Xin Eric Wang

机构 * UC Santa Cruz(加州大学圣克ruz分校) UC Santa Barbara(加州大学圣芭芭拉分校) UC Berkeley(加州大学伯克利分校) Cisco Research(思科研究)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10182 2025-11-14 cs.CL 79%

Beyond the Black Box: Demystifying Multi-Turn LLM Reasoning with VISTA

Yiran Zhang, Mingyang Lin, Mark Dras, Usman Naseem

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20810 2025-11-12 cs.CL 79%

Enrich-on-Graph: Query-Graph Alignment for Complex Reasoning with LLM Enriching

Songze Li, Zhiqiang Liu, Zhengke Gui, Huajun Chen, Wen Zhang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) ZJU-Ant Group Joint Lab of Knowledge Graph(浙江大学-蚂蚁集团知识图谱联合实验室)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.CL

Journal ref EMNLP 2025, pages 7683-7703

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05528 2025-11-11 cs.AI 79%

SMAGDi: Socratic Multi Agent Interaction Graph Distillation for Efficient High Accuracy Reasoning

Aayush Aluru, Myra Malik, Samarth Patankar, Spencer Kim, Kevin Zhu, Sean O'Brien, Vasu Sharma

机构 * Algoverse AI Research(Algoverse AI研究)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

Comments Multi-Turn Interactions in Large Language Models (MTI-LLM) Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00299 2025-11-11 cs.AI 79%

Collaborative LLM Numerical Reasoning with Local Data Protection

Min Zhang, Yuzhe Lu, Yun Zhou, Panpan Xu, Lin Lee Cheong, Chang-Tien Lu, Haozhu Wang

机构 * AWS AI(AWS人工智能)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

Comments Accepted to AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23653 2025-11-07 cs.LG 79%

How do Transformers Learn Implicit Reasoning?

Jiaran Ye, Zijun Yao, Zhidian Huang, Liangming Pan, Jinxin Liu, Yushi Bai, Amy Xin, Weichuan Liu, Xiaoyin Che, Lei Hou, Juanzi Li

机构 * DCST, BNRist(中国清华大学人工智能研究院) KIRC, Institute for Artificial Intelligence, Tsinghua University, China

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.LG

Comments Accepted as Spotlight at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02219 2025-11-06 cs.AI 79%

TabDSR: Decompose, Sanitize, and Reason for Complex Numerical Reasoning in Tabular Data

Changjiang Jiang, Fengchang Yu, Haihua Chen, Wei Lu, Jin Zeng

机构 * Wuhan University(武汉大学) University of North Texas(北德克萨斯大学) Hubei University of Economics(湖北经济学院)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

Comments Accepted to EMNLP 2025 Findings

Journal ref EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02085 2025-11-04 cs.AI 79%

SE-Agent: Self-Evolution Trajectory Optimization in Multi-Step Reasoning with LLM-Based Agents

Jiaye Lin, Yifu Guo, Yuzhen Han, Sen Hu, Ziyi Ni, Licheng Wang, Mingguang Chen, Hongzhang Liu, Ronghao Chen, Yangfan He, Daxin Jiang, Binxing Jiao, Chen Hu, Huacan Wang

机构 * THU(清华大学) StepFun UofT(多伦多大学) PKU(北京大学) UCAS(中国科学院大学) CASIA(中国科学院自动化研究所) UCR(加州大学尔湾分校) USYD(新南威尔士大学) UMN(明尼苏达大学)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00985 2025-11-04 cs.CL 79%

Discourse Heuristics For Paradoxically Moral Self-Correction

Guangliang Liu, Zimo Qi, Xitong Zhang, Kristen Marie Johnson

机构 * Michigan State University(密歇根州立大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 复杂问题求解 :self-correction(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏