arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 19037 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 19037 篇

2507.22074 2025-07-31 cs.LG cs.CL 79%

CIMR: Contextualized Iterative Multimodal Reasoning for Robust Instruction Following in LVLMs

Yangshu Yuan, Heng Chen, Xinyi Jiang, Christian Ng, Kexin Qiu

机构 * Singapore Institute of Management(新加坡管理学院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21476 2025-07-30 cs.CL cs.AI 79%

Which LLMs Get the Joke? Probing Non-STEM Reasoning Abilities with HumorBench

Reuben Narad, Siddharth Suresh, Jiayi Chen, Pine S. L. Dysart-Bricken, Bob Mankoff, Robert Nowak, Jifan Zhang, Lalit Jain

机构 * University of Washington(华盛顿大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Air Mail and Cartoon Collections(航空邮报与漫画收藏)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18618 2025-07-25 cs.CL cs.LG 79%

TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards

Andreea Nica, Ivan Zakazov, Nicolas Mario Baldwin, Saibo Geng, Robert West

机构 * EPFL(瑞士联邦理工学院) Microsoft Research(微软研究院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14722 2025-07-22 cs.LG cs.AI 79%

LeanTree: Accelerating White-Box Proof Search with Factorized States in Lean 4

Matěj Kripner, Michal Šustr, Milan Straka

机构 * Charles University, Faculty of Mathematics and Physics(查尔斯大学数学与物理系) Czech Technical University, Faculty of Electrical Engineering(捷克技术大学电气工程系)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11092 2025-07-22 cs.CL cs.AI cs.HC 79%

Dynamic Context Tuning for Retrieval-Augmented Generation: Enhancing Multi-Turn Planning and Tool Adaptation

Jubin Abhishek Soni, Amit Anand, Rajesh Kumar Pandey, Aniket Abhishek Soni

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments We are withdrawing the submission in order to thoroughly revise the work

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21801 2025-07-21 cs.CL cs.AI 79%

DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition

Z. Z. Ren, Zhihong Shao, Junxiao Song, Huajian Xin, Haocheng Wang, Wanjia Zhao, Liyue Zhang, Zhe Fu, Qihao Zhu, Dejian Yang, Z. F. Wu, Zhibin Gou, Shirong Ma, Hongxuan Tang, Yuxuan Liu, Wenjun Gao, Daya Guo, Chong Ruan

机构 * DeepSeek-AI

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11222 2025-07-16 cs.CL cs.AI cs.NI 79%

An Agentic Flow for Finite State Machine Extraction using Prompt Chaining

Fares Wael, Youssef Maklad, Ali Hamdi, Wael Elsersy

机构 * Dept. of Computer Science MSA University(计算机科学系 MSA大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08960 2025-07-15 cs.MA cs.AI cs.LG 79%

How to Train a Leader: Hierarchical Reasoning in Multi-Agent LLMs

Andrew Estornell, Jean-Francois Ton, Muhammad Faaiz Taufiq, Hang Li

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22050 2025-07-15 cs.AI cs.LG 79%

Reinforced Reasoning for Embodied Planning

Di Wu, Jiaxin Fan, Junzhe Zang, Guanbo Wang, Wei Yin, Wenhao Li, Bo Jin

机构 * Tongji University(同济大学) Tsinghua University(清华大学) Bank of Communications(中国银行)

专题命中 推理与问题求解 :language model(abstract);SFT(abstract);preference optimization(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.00948 2025-07-14 cs.CL cs.AI 79%

Large Linguistic Models: Investigating LLMs' metalinguistic abilities

Gašper Beguš, Maksymilian Dąbkowski, Ryan Rhodes

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Journal ref IEEE Transactions on Artificial Intelligence 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09918 2025-07-14 cs.AI cs.LG cs.LO 79%

Dualformer: Controllable Fast and Slow Thinking by Learning with Randomized Reasoning Traces

DiJia Su, Sainbayar Sukhbaatar, Michael Rabbat, Yuandong Tian, Qinqing Zheng

机构 * Meta AI

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00004 2025-07-11 cs.LG cs.AI cs.CY cs.PF 79%

A Theory of Inference Compute Scaling: Reasoning through Directed Stochastic Skill Search

Austin R. Ellis-Mohr, Anuj K. Nayak, Lav R. Varshney

机构 * University of Illinois Urbana-Champaign, Urbana, IL, USA(伊利诺伊大学厄巴纳-香槟分校)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06427 2025-07-10 cs.CL cs.LG 79%

Exploring Task Performance with Interpretable Models via Sparse Auto-Encoders

Shun Wang, Tyler Loakman, Youbo Lei, Yi Liu, Bohao Yang, Yuting Zhao, Dong Yang, Chenghua Lin

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09347 2025-07-10 cs.CL cs.AI 79%

Safer or Luckier? LLMs as Safety Evaluators Are Not Robust to Artifacts

Hongyu Chen, Seraphina Goldfarb-Tarrant

机构 * Cohere

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 9 pages, ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10422 2025-07-10 cs.CL cs.AI 79%

AutoPrep: Natural Language Question-Aware Data Preparation with a Multi-Agent Framework

Meihao Fan, Ju Fan, Nan Tang, Lei Cao, Guoliang Li, Xiaoyong Du

机构 * Renmin University of China(中国人民大学) University of Arizona(亚利桑那大学) Tsinghua University(清华大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18071 2025-07-08 cs.CL cs.AI 79%

Extended Inductive Reasoning for Personalized Preference Inference from Behavioral Signals

Jia-Nan Li, Jian Guan, Wei Wu, Rui Yan

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02773 2025-07-08 cs.AI cs.LG cs.MA 79%

KERAP: A Knowledge-Enhanced Reasoning Approach for Accurate Zero-shot Diagnosis Prediction Using Multi-agent LLMs

Yuzhang Xie, Hejie Cui, Ziyang Zhang, Jiaying Lu, Kai Shu, Fadi Nahab, Xiao Hu, Carl Yang

机构 * Emory University(埃默里大学) Stanford University(斯坦福大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Journal ref American Medical Informatics Association (AMIA) 2025 Annual Symposium, Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21880 2025-07-04 cs.MA cs.AI cs.CL cs.CY 79%

Incorporating LLMs for Large-Scale Urban Complex Mobility Simulation

Yu-Lun Song, Chung-En Tsern, Che-Cheng Wu, Yu-Ming Chang, Syuan-Bo Huang, Wei-Chu Chen, Michael Chia-Liang Lin, Yu-Ta Lin

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 8 pages, 8 figures. This paper is reviewed and accepted by the CUPUM (Computational Urban Planning and Urban Management) Conference held by University College London (UCL) in 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02145 2025-07-04 cs.CL cs.AI 79%

Reasoning or Not? A Comprehensive Evaluation of Reasoning LLMs for Dialogue Summarization

Keyan Jin, Yapeng Wang, Leonel Santos, Tao Fang, Xu Yang, Sio Kei Im, Hugo Gonçalo Oliveira

机构 * Faculty of Applied Sciences, Macao Polytechnic University(澳门理工大学应用科学学院) Computer Science and Communication Research Center, School of Technology and Management, Polytechnic of Leiria(莱里亚理工学院技术与管理学院计算机科学与通信研究中心) Institute of International Language Services Studies, Macau Millennium College(澳门 millennium 学院国际语言服务研究学院) CISUC, Department of Informatics Engineering, University of Coimbra(科英布拉大学信息工程系 CISUC)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02076 2025-07-04 cs.AI cs.LG 79%

Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs

Mohammad Ali Alomrani, Yingxue Zhang, Derek Li, Qianyi Sun, Soumyasundar Pal, Zhanguang Zhang, Yaochen Hu, Rohan Deepak Ajwani, Antonios Valkanas, Raika Karimi, Peng Cheng, Yunzhou Wang, Pengyi Liao, Hanrui Huang, Bin Wang, Jianye Hao, Mark Coates

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17728 2025-07-01 cs.CL cs.AI 79%

KAG-Thinker: Interactive Thinking and Deep Reasoning in LLMs via Knowledge-Augmented Generation

Dalong Zhang, Jun Xu, Jun Zhou, Lei Liang, Lin Yuan, Ling Zhong, Mengshu Sun, Peilong Zhao, QiWei Wang, Xiaorui Wang, Xinkai Du, YangYang Hou, Yu Ao, ZhaoYang Wang, Zhengke Gui, ZhiYing Yi, Zhongpu Bo, Haofen Wang, Huajun Chen

机构 * Inclusion AI Ant Group(Inclusion AI蚂蚁集团)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20664 2025-06-26 cs.AI cs.CL cs.HC cs.MA 79%

The Decrypto Benchmark for Multi-Agent Reasoning and Theory of Mind

Andrei Lupu, Timon Willi, Jakob Foerster

机构 * FAIR at Meta(Meta 的 FAIR) University of Oxford(牛津大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 41 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01633 2025-06-26 cs.LG cs.AI 79%

Adversarial Reasoning at Jailbreaking Time

Mahdi Sabbaghi, Paul Kassianik, George Pappas, Yaron Singer, Amin Karbasi, Hamed Hassani

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to the 42nd International Conference on Machine Learning (ICML 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20897 2025-06-24 cs.CV cs.AI cs.CL cs.RO 79%

Cross from Left to Right Brain: Adaptive Text Dreamer for Vision-and-Language Navigation

Pingrui Zhang, Yifei Su, Pengyuan Wu, Dong An, Li Zhang, Zhigang Wang, Dong Wang, Yan Ding, Bin Zhao, Xuelong Li

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) MAIS, Institute of Automation of Chinese Academy of Sciences(中国科学院自动化研究所MAIS) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) University of Science and Technology of China(中国科学技术大学) TeleAI, China Telecom Corp Ltd(中国电信TeleAI)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22960 2025-06-23 cs.AI cs.LG 79%

Revisiting Multi-Agent Debate as Test-Time Scaling: A Systematic Study of Conditional Effectiveness

Yongjin Yang, Euiin Yi, Jongwoo Ko, Kimin Lee, Zhijing Jin, Se-Young Yun

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Preprint, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15701 2025-06-23 cs.LG cs.AI 79%

Compiler-R1: Towards Agentic Compiler Auto-tuning with Reinforcement Learning

Haolin Pan, Hongyu Lin, Haoran Luo, Yang Liu, Kaichun Yao, Libo Zhang, Mingjie Xing, Yanjun Wu

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Software Chinese Academy of Sciences(中国科学院软件研究所) Beijing University of Posts and Telecommunications(北京邮电大学) Hangzhou Institute for Advanced Study at UCAS(UCAS杭州高等研究院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15602 2025-06-23 cs.AI cs.CL 79%

Rethinking External Slow-Thinking: From Snowball Errors to Probability of Correct Reasoning

Zeyu Gan, Yun Liao, Yong Liu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China, Beijing, China(中国人民大学人工智能学院) Beijing Key Laboratory of Research on Large Models(北京大型模型研究关键实验室) Engineering Research Center of Next-Generation Intelligent Search(下一代智能搜索工程研究中心) College of Artificial Intelligence, Tianjin University of Science(天津科技大学人工智能学院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Published as a conference paper in ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15848 2025-06-19 cs.AI cs.CL 79%

Entropy-based Exploration Conduction for Multi-step Reasoning

Jinghan Zhang, Xiting Wang, Fengran Mo, Yeyang Zhou, Wanfu Gao, Kunpeng Liu

机构 * Portland State University(波特兰州立大学) University of Montreal(蒙特利尔大学) Uber Jilin University(吉林大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13172 2025-06-18 cs.CL cs.AI 79%

AI-Facilitated Analysis of Abstracts and Conclusions: Flagging Unsubstantiated Claims and Ambiguous Pronouns

Evgeny Markhasin

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06499 2025-06-18 cs.LG cs.AI 79%

SPARQ: Synthetic Problem Generation for Reasoning via Quality-Diversity Algorithms

Alex Havrilla, Edward Hughes, Mikayel Samvelyan, Jacob Abernethy

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏