arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18857 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18857 篇

2511.08721 2025-11-13 cs.LG cs.AI cs.CL 87%

Benevolent Dictators? On LLM Agent Behavior in Dictator Games

Andreas Einwiller, Kanishka Ghosh Dastidar, Artur Romazanov, Annette Hautli-Janisz, Michael Granitzer, Florian Lemmerich

机构 * University of Passau(帕绍大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 7 pages, 2 figures, v1 init

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04491 2025-11-07 cs.CL cs.AI cs.DB cs.IR cs.LG 87%

RUST-BENCH: Benchmarking LLM Reasoning on Unstructured Text within Structured Tables

Nikhil Abhyankar, Purvi Chaurasia, Sanchit Kabra, Ananya Srivastava, Vivek Gupta, Chandan K. Reddy

机构 * Virginia Tech(弗吉尼亚理工大学) IGDTUW New Delhi(新德里IGDTUW) Arizona State University(亚利桑那州立大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15207 2025-11-05 cs.LG cs.AI cs.CL 87%

FlowRL: Matching Reward Distributions for LLM Reasoning

Xuekai Zhu, Daixuan Cheng, Dinghuai Zhang, Hengli Li, Kaiyan Zhang, Che Jiang, Youbang Sun, Ermo Hua, Yuxin Zuo, Xingtai Lv, Qizheng Zhang, Lin Chen, Fanghao Shao, Bo Xue, Yunchong Song, Zhenjie Yang, Ganqu Cui, Ning Ding, Jianfeng Gao, Xiaodong Liu, Bowen Zhou, Hongyuan Mei, Zhouhan Lin

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Microsoft Research(微软研究院) Tsinghua University(清华大学) Peking University(北京大学) Renmin University of China(中国人民大学) Stanford University(斯坦福大学) Toyota Technological Institute at Chicago(芝加哥丰田技术研究所)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24109 2025-10-29 cs.RO 87%

PFEA: An LLM-based High-Level Natural Language Planning and Feedback Embodied Agent for Human-Centered AI

Wenbin Ding, Jun Chen, Mingjia Chen, Fei Xie, Qi Mao, Philip Dames

机构 * School of Electrical and Automation Engineering, Nanjing Normal University(南京师范大学电气与自动化工程学院) Department of Mechanical Engineering, Temple University(Temple大学机械工程系)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);language agent(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08263 2025-10-28 cs.SE 87%

LLM-Based Detection of Tangled Code Changes for Higher-Quality Method-Level Bug Datasets

Md Nahidul Islam Opu, Shaowei Wang, Shaiful Chowdhury

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05179 2025-10-27 cs.CL cs.AI cs.LG 87%

Sketch-of-Thought: Efficient LLM Reasoning with Adaptive Cognitive-Inspired Sketching

Simon A. Aytes, Jinheon Baek, Sung Ju Hwang

机构 * KAIST(韩国科学技术院)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09933 2025-10-24 cs.AI cs.CL cs.LG 87%

MIR-Bench: Can Your LLM Recognize Complicated Patterns via Many-Shot In-Context Reasoning?

Kai Yan, Zhan Ling, Kang Liu, Yifan Yang, Ting-Han Fan, Lingfeng Shen, Zhengyin Du, Jiecao Chen

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 39 pages, 11 figures. The paper is accepted at NeurIPS 2025 Datasets & Benchmarks Track, and the latest version adds modifications in camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18508 2025-10-22 cs.CR 87%

Prompting the Priorities: A First Look at Evaluating LLMs for Vulnerability Triage and Prioritization

Osama Al Haddad, Muhammad Ikram, Ejaz Ahmed, Young Lee

专题命中 推理与问题求解 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments 19 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02298 2025-10-21 cs.LG cs.AI cs.CL 87%

CAPO: Towards Enhancing LLM Reasoning through Generative Credit Assignment

Guofu Xie, Yunsheng Shi, Hongtao Tian, Ting Yao, Xiao Zhang

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(人工智能学院,中国人民大学) Tencent Inc(腾讯公司)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00218 2025-10-10 cs.MA cs.AI cs.CL cs.LG 87%

$\textit{Agents Under Siege}$: Breaking Pragmatic Multi-Agent LLM Systems with Optimized Prompt Attacks

Rana Muhammad Shahroz Khan, Zhen Tan, Sukwon Yun, Charles Fleming, Tianlong Chen

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Arizona State University(亚利桑那州立大学) Cisco(思科)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15734 2025-10-01 cs.CL cs.AI cs.LG 87%

DEBATE, TRAIN, EVOLVE: Self Evolution of Language Model Reasoning

Gaurav Srivastava, Zhenyu Bi, Meng Lu, Xuan Wang

机构 * Department of Computer Science, Virginia Tech, USA(弗吉尼亚理工大学计算机科学系)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03293 2025-09-24 cs.AI cs.CL cs.LG cs.SY eess.SY 87%

LogicGuard: Improving Embodied LLM agents through Temporal Logic based Critics

Anand Gokhale, Vaibhav Srivastava, Francesco Bullo

机构 * Department of Mechanical Engineering, University of California at Santa Barbara(加州大学圣芭芭拉分校机械工程系) Department of Electrical and Computer Engineering, Michigan State University(密歇根州立大学电气与计算机工程系)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Modified version of prior LTLCrit work with new robotics dataset

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05128 2025-09-19 cs.CL cs.AI cs.LG 87%

DiCoRe: Enhancing Zero-shot Event Detection via Divergent-Convergent LLM Reasoning

Tanmay Parekh, Kartik Mehta, Ninareh Mehrabi, Kai-Wei Chang, Nanyun Peng

机构 * Computer Science Department, University of California, Los Angeles(加州大学洛杉矶分校计算机科学系)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12273 2025-09-17 cs.AI cs.CL cs.LG 87%

LLMAP: LLM-Assisted Multi-Objective Route Planning with User Preferences

Liangqi Yuan, Dong-Jun Han, Christopher G. Brinton, Sabine Brunswicker

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02682 2025-09-11 cs.CL cs.AI cs.LG 87%

MPO: Boosting LLM Agents with Meta Plan Optimization

Weimin Xiong, Yifan Song, Qingxiu Dong, Bingchan Zhao, Feifan Song, Xun Wang, Sujian Li

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16603 2025-08-26 cs.CL cs.AI cs.LG 87%

GreenTEA: Gradient Descent with Topic-modeling and Evolutionary Auto-prompting

Zheng Dong, Luming Shang, Gabriela Olinto

机构 * Amazon Buyer Risk Prevention(亚马逊买家风险预防)

专题命中 推理与问题求解 :prompting(title);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07060 2025-08-21 q-bio.QM cs.AI cs.CL cs.LG q-bio.BM q-bio.MN 87%

DeepRetro: Retrosynthetic Pathway Discovery using Iterative LLM Reasoning

Shreyas Vinaya Sathyanarayana, Sharanabasava D. Hiremath, Rahil Shah, Rishikesh Panda, Rahul Jana, Riya Singh, Rida Irfan, Ashwin Murali, Bharath Ramsundar

机构 * Deep Forest Sciences(深林科学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 64 pages,

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02083 2025-08-19 cs.CL cs.AI cs.CE cs.LG 87%

Regress, Don't Guess -- A Regression-like Loss on Number Tokens for Language Models

Jonas Zausinger, Lars Pennig, Anamarija Kozina, Sean Sdahl, Julian Sikora, Adrian Dendorfer, Timofey Kuznetsov, Mohamad Hagog, Nina Wiedemann, Kacper Chlodny, Vincent Limbach, Anna Ketteler, Thorben Prein, Vishwa Mohan Singh, Michael Morris Danziger, Jannis Born

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML)) IBM Research Europe(IBM欧洲研究院) ETH Zurich(苏黎世联邦理工学院)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10026 2025-08-15 cs.CL cs.AI cs.LG 87%

SABER: Switchable and Balanced Training for Efficient LLM Reasoning

Kai Zhao, Yanjun Zhao, Jiaming Song, Shien He, Lusheng Zhang, Qiang Zhang, Tianjiao Li

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23145 2025-08-11 cs.PL cs.AI cs.CL cs.LG 87%

CodeARC: Benchmarking Reasoning Capabilities of LLM Agents for Inductive Program Synthesis

Anjiang Wei, Tarun Suresh, Jiannan Cao, Naveen Kannan, Yuheng Wu, Kai Yan, Thiago S. F. X. Teixeira, Ke Wang, Alex Aiken

机构 * Stanford University(斯坦福大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) MIT(麻省理工学院) Intel(英特尔) Nanjing University(南京大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04350 2025-08-07 cs.CL cs.AI cs.CV cs.LG cs.MA 87%

Chain of Questions: Guiding Multimodal Curiosity in Language Models

Nima Iji, Kia Dashtipour

机构 * Edinburgh Napier University(爱丁堡纳皮尔大学)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18252 2025-07-25 cs.HC cs.AI cs.CL cs.LG 87%

Multimodal Behavioral Patterns Analysis with Eye-Tracking and LLM-Based Reasoning

Dongyang Guo, Yasmeen Abdrabou, Enkeleda Thaqi, Enkelejda Kasneci

机构 * Technical University of Munich(慕尼黑技术大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11525 2025-07-16 cs.RO cs.HC 87%

LLM-based ambiguity detection in natural language instructions for collaborative surgical robots

Ana Davila, Jacinto Colan, Yasuhisa Hasegawa

机构 * Institutes of Innovation for Future Society, Nagoya University(未来社会创新研究所,名古屋大学) Department of Micro-Nano Mechanical Science and Engineering, Nagoya University(微纳米机械科学与工程系,名古屋大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted at 2025 IEEE International Conference on Robot and Human Interactive Communication (ROMAN)

Journal ref 2025 IEEE International Conference on Robot and Human Interactive Communication (ROMAN)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18397 2025-07-16 cs.CV 87%

Unsupervised Visual Chain-of-Thought Reasoning via Preference Optimization

Kesen Zhao, Beier Zhu, Qianru Sun, Hanwang Zhang

机构 * Nanyang Technological University(南洋理工大学) Singapore Management University(新加坡管理大学)

专题命中 推理与问题求解 :preference optimization(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06980 2025-07-10 cs.SE 87%

Are They All Good? Evaluating the Quality of CoTs in LLM-based Code Generation

Binquan Zhang, Li Zhang, Zhiwen Luo, Yuxin Du, Fang Liu, Song Wang, Lin Shi

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06044 2025-07-09 cs.IR 87%

Hierarchical Interaction Summarization and Contrastive Prompting for Explainable Recommendations

Yibin Liu, Ang Li, Shijian Li

专题命中 推理与问题求解 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18330 2025-06-26 cs.LG cs.AI cs.CL 87%

Confucius3-Math: A Lightweight High-Performance Reasoning LLM for Chinese K-12 Mathematics Learning

Lixin Wu, Na Cai, Qiao Cheng, Jiachen Wang, Yitao Duan

机构 * NetEase Youdao(网易有道)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11702 2025-06-23 cs.AI cs.CL cs.LG 87%

LLM-Guided Indoor Navigation with Multimodal Map Understanding

Alberto Coffrini, Paolo Barsocchi, Francesco Furfari, Antonino Crivello, Alessio Ferrari

机构 * Institute of Information Science and Technologies (ISTI)(信息科学与技术研究所) National Research Council of Italy (CNR)(意大利国家研究理事会) Department of Computer Science(计算机科学系) University of Pisa(比萨大学) University College Dublin (UCD)(都柏林大学学院) School of Computer Science(计算机科学学院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 7 pages, 3 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09659 2025-06-12 cs.AI cs.CL cs.LG 87%

Intent Factored Generation: Unleashing the Diversity in Your Language Model

Eltayeb Ahmed, Uljad Berdica, Martha Elliott, Danijela Horak, Jakob N. Foerster

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08379 2025-06-11 cs.LG cs.AI cs.CL 87%

Reinforce LLM Reasoning through Multi-Agent Reflection

Yurun Yuan, Tengyang Xie

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments International Conference on Machine Learning (ICML), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏