arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18857 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18857 篇

2506.08745 2025-06-11 cs.AI cs.CL 86%

Consistent Paths Lead to Truth: Self-Rewarding Reinforcement Learning for LLM Reasoning

Kongcheng Zhang, Qi Yao, Shunyu Liu, Yingjie Wang, Baisheng Lai, Jieping Ye, Mingli Song, Dacheng Tao

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08292 2025-06-11 cs.LG cs.CL 86%

From Debate to Equilibrium: Belief-Driven Multi-Agent LLM Reasoning via Bayesian Nash Equilibrium

Xie Yi, Zhanke Zhou, Chentao Cao, Qiyu Niu, Tongliang Liu, Bo Han

机构 * Academy for Engineering and Technology, Fudan University(复旦大学工程与技术学院) TMLR Group, Department of Computer Science, Hong Kong Baptist University(香港 Baptist 大学计算机科学系 TMLR 组) Sydney AI Center, The University of Sydney(悉尼大学悉尼人工智能中心)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted by ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06532 2025-06-10 cs.LG cs.AI cs.NI cs.RO cs.SY eess.SY 86%

Hierarchical and Collaborative LLM-Based Control for Multi-UAV Motion and Communication in Integrated Terrestrial and Non-Terrestrial Networks

Zijiang Yan, Hao Zhou, Jianhua Pei, Hina Tabassum

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted in ICML 2025 Workshop on Machine Learning for Wireless Communication and Networks (ML4Wireless)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05213 2025-06-06 cs.AI cs.CL 86%

LLM-First Search: Self-Guided Exploration of the Solution Space

Nathan Herr, Tim Rocktäschel, Roberta Raileanu

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 9 main pages, 2 figures, 2 tables, 36 appendix pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19449 2025-06-05 cs.SE cs.AI cs.LG cs.PF 86%

VecTrans: Enhancing Compiler Auto-Vectorization through LLM-Assisted Code Transformations

Zhongchun Zheng, Kan Wu, Long Cheng, Lu Li, Rodrigo C. O. Rocha, Tianyi Liu, Wei Wei, Jianjiang Zeng, Xianwei Zhang, Yaoqing Gao

机构 * Huawei(华为) Sun Yat-sen University(中山大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23754 2025-06-04 cs.CL cs.AI 86%

DeepTheorem: Advancing LLM Reasoning for Theorem Proving Through Natural Language and Reinforcement Learning

Ziyin Zhang, Jiahao Xu, Zhiwei He, Tian Liang, Qiuzhi Liu, Yansi Li, Linfeng Song, Zhenwen Liang, Zhuosheng Zhang, Rui Wang, Zhaopeng Tu, Haitao Mi, Dong Yu

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00483 2025-06-03 cs.CL cs.LG 86%

Auto-Patching: Enhancing Multi-Hop Reasoning in Language Models

Aviv Jan, Dean Tahory, Omer Talmi, Omar Abo Mokh

机构 * Tel Aviv University(特拉维夫大学)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24264 2025-06-02 cs.CL cs.AI 86%

Faithful and Robust LLM-Driven Theorem Proving for NLI Explanations

Xin Quan, Marco Valentino, Louise A. Dennis, André Freitas

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Camera-ready for ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11147 2025-06-02 cs.LG cs.AI 86%

RaaS: Reasoning-Aware Attention Sparsity for Efficient LLM Reasoning

Junhao Hu, Wenrui Huang, Weidong Wang, Zhenwen Li, Tiancheng Hu, Zhixia Liu, Xusheng Chen, Tao Xie, Yizhou Shan

机构 * SCS, Peking University, Beijing, China(北京大学计算机科学系) Key Lab of HCST (PKU), MOE, Beijing, China(北京大学高校计算机科学与技术关键实验室) School of Computer Science, Nanjing University, Nanjing, China(南京大学计算机科学系) Huawei Cloud, Shanghai, China(华为云)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16081 2025-05-30 cs.AI cs.CL cs.GT cs.LO 86%

Towards Logically Sound Natural Language Reasoning with Logic-Enhanced Language Model Agents

Agnieszka Mensfelt, Kostas Stathis, Vince Trencsenyi

机构 * Royal Holloway, University of London(伦敦大学皇家霍洛威学院)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Source code: https://github.com/dicelab-rhul/LELMA

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06046 2025-05-30 cs.CR cs.AI cs.CL 86%

LLM for SoC Security: A Paradigm Shift

Dipayan Saha, Shams Tarek, Katayoon Yahyaei, Sujan Kumar Saha, Jingbo Zhou, Mark Tehranipoor, Farimah Farahmandi

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 42 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22552 2025-05-29 cs.CL cs.AI cs.DB 86%

ClaimPKG: Enhancing Claim Verification via Pseudo-Subgraph Generation with Lightweight Specialized LLM

Hoang Pham, Thanh-Do Nguyen, Khac-Hoai Nam Bui

机构 * Viettel Artificial Intelligence and Data Services Center(越南 Viettel 人工智能与数据服务中心)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by ACL 2025 findings

Journal ref ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20643 2025-05-28 cs.LG cs.AI 86%

Can Past Experience Accelerate LLM Reasoning?

Bo Pan, Liang Zhao

机构 * Bo Pan Liang Zhao

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11807 2025-05-28 cs.CL cs.AI 86%

Retrospex: Language Agent Meets Offline Reinforcement Learning Critic

Yufei Xiang, Yiqun Shen, Yeqin Zhang, Cam-Tu Nguyen

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Nanjing University School of Artificial Intelligence(南京大学人工智能学院)

专题命中 推理与问题求解 :language agent(title);LLM(abstract);large language model(abstract);language model(abstract)

Comments 17 pages, Published in EMNLP 2024 (Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing)

Journal ref Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing, pages 4650-4666, ACL Anthology, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11074 2025-05-28 cs.AI cs.CL 86%

Exploring the Necessity of Reasoning in LLM-based Agent Scenarios

Xueyang Zhou, Guiyao Tie, Guowen Zhang, Weidong Wang, Zhigang Zuo, Di Wu, Duanfeng Chu, Pan Zhou, Neil Zhenqiang Gong, Lichao Sun

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 71 pages, 11 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18693 2025-05-28 cs.CL cs.AI 86%

Unleashing LLM Reasoning Capability via Scalable Question Synthesis from Scratch

Yuyang Ding, Xinyu Shi, Xiaobo Liang, Juntao Li, Zhaopeng Tu, Qiaoming Zhu, Min Zhang

机构 * Soochow University(苏州大学) Tencent AI Lab(腾讯AI实验室)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);preference optimization(abstract)

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19815 2025-05-27 cs.CL cs.AI 86%

Deciphering Trajectory-Aided LLM Reasoning: An Optimization Perspective

Junnan Liu, Hongwei Liu, Linchen Xiao, Shudong Liu, Taolin Zhang, Zihan Ma, Songyang Zhang, Kai Chen

机构 * Shanghai AI Laboratory(上海人工智能实验室)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11827 2025-05-27 cs.CL cs.AI 86%

Not All Thoughts are Generated Equal: Efficient LLM Reasoning via Multi-Turn Reinforcement Learning

Yansong Ning, Wei Li, Jun Fang, Naiqiang Tan, Hao Liu

机构 * AI Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)人工智能方向) Didichuxing Co. Ltd(滴滴出行有限公司) CSE, The Hong Kong University of Science and Technology(香港科学与技术大学计算机科学与工程系)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17216 2025-05-22 cs.AI cs.CL 86%

Intermediate Languages Matter: Formal Choice Drives Neurosymbolic LLM Reasoning

Alexander Beiser, David Penz, Nysret Musliu

机构 * TU Wien, Vienna, Austria(维也纳技术大学) Johannes Kepler University Linz, Linz, Austria(林茨约翰尼斯·凯普勒大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15117 2025-05-22 cs.CL cs.AI cs.IR 86%

An Empirical Study on Reinforcement Learning for Reasoning-Search Interleaved LLM Agents

Bowen Jin, Jinsung Yoon, Priyanka Kargupta, Sercan O. Arik, Jiawei Han

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04375 2025-05-22 cs.CL cs.LG 86%

An Analysis for Reasoning Bias of Language Models with Small Initialization

Junjie Yao, Zhongwang Zhang, Zhi-Qin John Xu

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments 31 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12951 2025-05-20 cs.LG cs.AI 86%

DGRO: Enhancing LLM Reasoning via Exploration-Exploitation Control and Reward Variance Management

Xuerui Su, Liya Guo, Yue Wang, Yi Zhu, Zhiming Ma, Zun Wang, Yuting Liu

机构 * School of Mathematics and Statistics(数学与统计学学院) Beijing Jiaotong University(北京交通大学) Yau Mathematical Sciences Center(叶中科学中心) Tsinghua University(清华大学) Department of Mathematical Sciences(数学科学系) Beijing, China(中国北京) Zhongguancun Academy(中关村学院) Yanqi Lake Beijing Institute of Mathematical Sciences and Applications(燕琪湖数学科学与应用研究所) Academy of Mathematics and Systems Science(数学与系统科学研究院) Chinese Academy of Sciences(中国科学院) Microsoft Research AI4Science(微软研究院AI4Science)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12135 2025-05-20 cs.AI cs.CL 86%

LLM-BABYBENCH: Understanding and Evaluating Grounded Planning and Reasoning in LLMs

Omar Choukrani, Idriss Malek, Daniil Orel, Zhuohan Xie, Zangir Iklassov, Martin Takáč, Salem Lahlou

机构 * MBZUAI(穆萨高等教育机构)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06321 2025-05-20 cs.LG cs.AI 86%

Learn to Think: Bootstrapping LLM Reasoning Capability Through Graph Representation Learning

Hang Gao, Chenhao Zhang, Tie Wang, Junsuo Zhao, Fengge Wu, Changwen Zheng, Huaping Liu

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted by IJCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01698 2025-05-19 cs.CL cs.AI 86%

Do Theory of Mind Benchmarks Need Explicit Human-like Reasoning in Language Models?

Yi-Long Lu, Chunhui Zhang, Jiajun Song, Lifeng Fan, Wei Wang

机构 * State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室) BIGAI

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);SFT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.04168 2025-05-14 cs.CL cs.AI 86%

From Calculation to Adjudication: Examining LLM judges on Mathematical Reasoning Tasks

Andreas Stephan, Dawei Zhu, Matthias Aßenmacher, Xiaoyu Shen, Benjamin Roth

机构 * Faculty of Computer Science(计算机科学系) UniVie Doctoral School Computer Science(维也纳大学计算机科学博士学院) Faculty of Philological and Cultural Studies(文学与文化研究系) University of Vienna(维也纳大学) Saarland University(萨尔兰大学) Eastern Institute of Technology(东部技术研究所) Department of Statistics(统计系) LMU Munich(慕尼黑莱茵河大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00024 2025-05-13 cs.CL cs.AI 86%

Nemotron-Research-Tool-N1: Exploring Tool-Using Language Models with Reinforced Reasoning

Shaokun Zhang, Yi Dong, Jieyu Zhang, Jan Kautz, Bryan Catanzaro, Andrew Tao, Qingyun Wu, Zhiding Yu, Guilin Liu

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);SFT(abstract);分类 cs.CL、cs.AI

Comments 17 pages, 6 tables, 12 figures. - update new results - add more details

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05093 2025-05-13 cs.CL cs.AI 86%

Order Matters in Hallucination: Reasoning Order as Benchmark and Reflexive Prompting for Large-Language-Models

Zikai Xie

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 推理与问题求解 :prompting(title);LLM(abstract);large language model(abstract);language model(abstract)

Comments 8 pages, submitted to ACL ARR

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09830 2025-05-05 cs.AI cs.CL 86%

Automating the Generation of Prompts for LLM-based Action Choice in PDDL Planning

Katharina Stein, Daniel Fišer, Jörg Hoffmann, Alexander Koller

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Extended version of the paper from the ICAPS'25 proceedings (same main part + additional appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12282 2025-04-29 cs.LG cs.AI 86%

Toward Foundation Models for Online Complex Event Detection in CPS-IoT: A Case Study

Liying Han, Gaofeng Dong, Xiaomin Ouyang, Lance Kaplan, Federico Cerutti, Mani Srivastava

机构 * UCLA(加州大学洛杉矶分校) HKUST(香港科技大学) DEVCOM Army Research Laboratory(国防部陆军研究实验室) University of Brescia(布雷西亚大学)

专题命中 推理与问题求解 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Journal ref FMSys Proc. 2 (2025) 1-6

详情

展开后加载摘要…

URL PDF HTML 收藏