arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18936 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18936 篇

2510.13395 2025-10-16 cs.CL 84%

Doing Things with Words: Rethinking Theory of Mind Simulation in Large Language Models

Agnese Lombardi, Alessandro Lenci

机构 * CoLing Lab, Department of Philology, Literature and Linguistics, University of Pisa(帕尔马大学哲学、文学与语言学系语言实验室)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

Journal ref roceedings of the Eleventh Italian Conference on Computational Linguistics (CLiC-it 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22017 2025-10-15 cs.CL 84%

The Price of a Second Thought: On the Evaluation of Reasoning Efficiency in Large Language Models

Siqi Fan, Bowen Qin, Peng Han, Shuo Shang, Yequan Wang, Aixin Sun

机构 * University of Electronic Science and Technology of China(电子科技大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Nanyang Technological University(南洋理工大学)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

Comments Added new experiments and revised the manuscript for clarity

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09426 2025-10-13 cs.CL 84%

KORMo: Korean Open Reasoning Model for Everyone

Minjun Kim, Hyeonseok Lim, Hangyeol Yoo, Inho Won, Seungwoo Song, Minkyung Cho, Junhun Yuk, Changsu Choi, Dongjae Shin, Huige Lee, Hoyun Song, Alice Oh, Kyungtae Lim

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08595 2025-10-13 cs.CL 84%

Systematic Diagnosis of Brittle Reasoning in Large Language Models

V. S. Raghu Parupudi

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

Comments Submitted to NEURIPS-2025 MATHAI workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01428 2025-10-03 q-bio.QM cs.AI 84%

BioVERSE: Representation Alignment of Biomedical Modalities to LLMs for Multi-Modal Reasoning

Ching-Huei Tsou, Michal Ozery-Flato, Ella Barkan, Diwakar Mahajan, Ben Shapira

机构 * IBM T.J. Watson Research Center(IBM T.J. Watson研究所以) IBM Research(IBM研究所以)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11341 2025-09-24 cs.CL 84%

Benchmarking Critical Questions Generation: A Challenging Reasoning Task for Large Language Models

Banca Calvo Figueras, Rodrigo Agerri

机构 * HiTZ Center - Ixa University of the Basque Country UPV/EHU(希茨中心 - Ixa巴斯克大学UPV/EHU)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15512 2025-09-10 cs.CL 84%

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models

Kaiyan Chang, Yonghao Shi, Chenglong Wang, Hang Zhou, Chi Hu, Xiaoqian Liu, Yingfeng Luo, Yuan Ge, Tong Xiao, Jingbo Zhu

机构 * School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院) NiuTrans Research(NiuTrans研究院) ByteDance(字节跳动)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

Comments Accepted by EMNLP 2025. Code: https://github.com/Lucky-259/Hybrid_TTS

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23067 2025-09-09 cs.AI 84%

FairReason: Balancing Reasoning and Social Bias in MLLMs

Zhenyu Pan, Yutong Zhang, Jianshu Zhang, Haoran Lu, Haozheng Luo, Yuwei Han, Philip S. Yu, Manling Li, Han Liu

机构 * Northwestern University(西北大学) University of Illinois at Chicago(伊利诺伊大学香槟分校)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)

Comments Accepted to the Trustworthy FMs workshop in ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05496 2025-08-13 cs.AI 84%

InfiAlign: A Scalable and Sample-Efficient Framework for Aligning LLMs to Enhance Reasoning Capabilities

Shuo Cai, Su Lu, Qi Zhou, Kejing Yang, Zhijie Sang, Congkai Xie, Hongxia Yang

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07127 2025-08-12 cs.LG q-bio.GN 84%

How Effectively Can Large Language Models Connect SNP Variants and ECG Phenotypes for Cardiovascular Risk Prediction?

Niranjana Arun Menon, Iqra Farooq, Yulong Li, Sara Ahmed, Yutong Xie, Muhammad Awais, Imran Razzak

机构 * University of New South Wales(新南威尔士大学) University of Surrey(萨里大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18878 2025-08-07 cs.CL 84%

I Have Covered All the Bases Here: Interpreting Reasoning Features in Large Language Models via Sparse Autoencoders

Andrey Galichin, Alexey Dontsov, Polina Druzhinina, Anton Razzhigaev, Oleg Y. Rogov, Elena Tutubalina, Ivan Oseledets

机构 * AIRI MTUCI Skoltech Sber HSE

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20959 2025-07-28 cs.CL cs.CY 84%

Research Community Perspectives on "Intelligence" and Large Language Models

Bertram Højer, Terne Sasha Thorn Jakobsen, Anna Rogers, Stefan Heinrich

机构 * IT University of Copenhagen(丹麦哥本哈根信息技术大学) University of Copenhagen(丹麦哥本哈根大学)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

Comments ACL Findings 2025

Journal ref Findings of the Association for Computational Linguistics: ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17665 2025-07-23 cs.CL 84%

Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics

Zena Al-Khalili, Nick Howell, Dietrich Klakow

机构 * Saarland University(萨尔兰大学)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02689 2025-06-05 cs.CL 84%

MASTER: Enhancing Large Language Model via Multi-Agent Simulated Teaching

Liang Yue, Yihong Tang, Kehai Chen, Jie Liu, Min Zhang

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00748 2025-06-03 cs.CL cs.CY 84%

Translate With Care: Addressing Gender Bias, Neutrality, and Reasoning in Large Language Model Translations

Pardis Sadat Zahraei, Ali Emami

机构 * Independent Researcher(独立研究者)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

Comments Accepted to Findings of ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20505 2025-05-28 cs.CL cs.SE 84%

Large Language Models for IT Automation Tasks: Are We There Yet?

Md Mahadi Hassan, John Salvador, Akond Rahman, Santu Karmaker

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18001 2025-05-28 cs.CL 84%

Unveiling the Key Factors for Distilling Chain-of-Thought Reasoning

Xinghao Chen, Zhijing Sun, Wenjin Guo, Miaoran Zhang, Yanjun Chen, Yirong Sun, Hui Su, Yijie Pan, Dietrich Klakow, Wenjie Li, Xiaoyu Shen

机构 * Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算机系) Ningbo Key Laboratory of Spatial Intelligence and Digital Derivative(宁波空间智能与数字衍生关键实验室) Institute of Digital Twin, EIT(数字孪生研究院) Saarland University(萨尔兰大学) Meituan Inc.(美团公司)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);small language model(abstract);pretraining(abstract)

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11899 2025-05-20 cs.AI 84%

From Recall to Reasoning: Automated Question Generation for Deeper Math Learning through Large Language Models

Yongan Yu, Alexandre Krantz, Nikki G. Lobczowski

机构 * McGill University(麦吉尔大学)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.AI

Comments 8 pages, 2 figures, accepted by AIED conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20125 2025-04-30 cs.DL cs.AI 84%

Towards Large Language Models for Lunar Mission Planning and In Situ Resource Utilization

Michael Pekala, Gregory Canal, Samuel Barham, Milena B. Graziano, Morgan Trexler, Leslie Hamilton, Elizabeth Reilly, Christopher D. Stiles

机构 * Johns Hopkins University Applied Physics Laboratory(约翰霍普金斯大学应用物理实验室)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11477 2025-04-17 cs.CV cs.AI 84%

SDIGLM: Leveraging Large Language Models and Multi-Modal Chain of Thought for Structural Damage Identification

Yunkai Zhang, Shiyin Wei, Yong Huang, Yawu Su, Shanshan Lu, Hui Li

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04104 2025-04-15 cs.CL 84%

LLMs Can Generate a Better Answer by Aggregating Their Own Responses

Zichong Li, Xinyu Feng, Yuheng Cai, Zixuan Zhang, Tianyi Liu, Chen Liang, Weizhu Chen, Haoyu Wang, Tuo Zhao

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15382 2025-04-01 cs.CL 84%

On the Impact of Fine-Tuning on Chain-of-Thought Reasoning

Elita Lobo, Chirag Agarwal, Himabindu Lakkaraju

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments This paper is a work in progress with findings based on limited evidence. Please exercise discretion when interpreting the findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17378 2025-03-26 cs.AI cs.CR cs.CY cs.ET cs.MA 84%

Large language model-powered AI systems achieve self-replication with no human intervention

Xudong Pan, Jiarun Dai, Yihe Fan, Minyuan Luo, Changyi Li, Min Yang

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.AI

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.04775 2025-02-14 cs.RO cs.AI 84%

Scalable Task Planning via Large Language Models and Structured World Representations

Rodrigo Pérez-Dattari, Zhaoting Li, Robert Babuška, Jens Kober, Cosimo Della Santina

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.AI

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16235 2025-01-31 cs.CL 84%

ToW: Thoughts of Words Improve Reasoning in Large Language Models

Zhikun Xu, Ming Shen, Jacob Dineen, Zhaonan Li, Xiao Ye, Shijie Lu, Aswin RRV, Chitta Baral, Ben Zhou

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

Comments Accepted by NAACL 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.21199 2025-01-03 cs.SE cs.CL 84%

HumanEval Pro and MBPP Pro: Evaluating Large Language Models on Self-invoking Code Generation

Zhaojian Yu, Yilun Zhao, Arman Cohan, Xiao-Ping Zhang

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08804 2024-11-14 q-fin.CP cs.LG q-fin.ST q-fin.TR 84%

FinRobot: AI Agent for Equity Research and Valuation with Large Language Models

Tianyu Zhou, Pinqiao Wang, Yilin Wu, Hongyang Yang

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.LG

Comments The 1st Workshop on LLMs and Generative AI for Finance, ICAIF 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09486 2024-09-27 cs.CL cs.CV cs.SE 84%

MMCode: Benchmarking Multimodal Large Language Models for Code Generation with Visually Rich Programming Problems

Kaixin Li, Yuchen Tian, Qisheng Hu, Ziyang Luo, Zhiyong Huang, Jing Ma

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03074 2024-08-07 cs.CL 84%

Towards an Analysis of Discourse and Interactional Pragmatic Reasoning Capabilities of Large Language Models

Amelie Robrecht, Judith Sieker, Clara Lachenmaier, Sina Zarieß, Stefan Kopp

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.02500 2024-08-06 cs.AI 84%

On the Prospects of Incorporating Large Language Models (LLMs) in Automated Planning and Scheduling (APS)

Vishal Pallagani, Kaushik Roy, Bharath Muppasani, Francesco Fabiano, Andrea Loreggia, Keerthiram Murugesan, Biplav Srivastava, Francesca Rossi, Lior Horesh, Amit Sheth

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.AI

Journal ref Proceedings of the International Conference on Automated Planning and Scheduling, 34(1), 432-444 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏