arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18936 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18936 篇

2509.14380 2026-06-08 cs.RO 版本更新 88%

CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks

CRAFT:利用基础模型自主教练强化学习以完成多机器人协调任务

Seoyeon Choi, Kanghyun Ryu, Jonghoon Ock, Negar Mehr

机构 * Department of Mechanical Engineering, University of California Berkeley(机械工程系,加州大学伯克利分校)

专题命中 推理与问题求解 :foundation model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出CRAFT框架,利用大语言模型分解任务、生成奖励函数,并通过视觉语言模型优化,实现多机器人协调学习,在四足导航和双臂操作任务中验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05414 2026-06-05 cs.CL cs.AI cs.HC cs.LG 88%

When Evidence is Sparse: Weakly Supervised Early Failure Alerting in Dialogs and LLM-Agent Trajectories

当证据稀疏时:对话和LLM-Agent轨迹中的弱监督早期失败预警

Avinash Baidya, Xinran Liang, Ruocheng Guo, Xiang Gao, Kamalika Das

机构 * Intuit AI Research(Intuit AI研究院) Princeton University(普林斯顿大学)

专题命中 推理与问题求解 :LLM(title,title_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 针对对话和LLM-Agent轨迹中早期失败预警问题,提出一种两阶段方法,通过注意力机制从稀疏的轨迹级标签中学习回合级失败证据,并结合α-STOP策略实现可控的早期预警,在多个基准上显著提升帕累托前沿质量并降低训练成本。

Comments 9 pages, 14 figures, and appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23497 2026-06-05 cs.CV 88%

VOLD: Reasoning Transfer from LLMs to Vision-Language Models via On-Policy Distillation

VOLD:通过在线蒸馏将LLM推理能力转移到视觉语言模型

Walid Bousselham, Hilde Kuehne, Cordelia Schmid

机构 * Tuebingen AI Center(图宾根人工智能中心) University of Tuebingen(图宾根大学) MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室) Inria, École Normale Supérieure, CNRS, PSL Research University(法国国家科学研究院、巴黎-萨克勒大学、École Normale Supérieure、PSL研究大学)

专题命中 推理与问题求解 :language model(title,abstract);LLM(title_cn);SFT(abstract,abstract_cn)

AI总结 本文提出VOLD框架,通过在线蒸馏将文本模型的推理能力转移到视觉语言模型,利用组相对策略优化与在线蒸馏结合,提升推理性能,并验证了冷启动对齐在在线训练中的重要性。

Comments www.walidbousselham.com/VOLD/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23647 2026-05-26 cs.SE 88%

SGAgent: Suggestion-Guided LLM-Based Multi-Agent Framework for Repository-Level Software Repair

SGAgent:基于建议引导的LLM多智能体框架用于仓库级软件修复

Quanjun Zhang, Chengyu Gao, Yu Han, Ye Shang, Chunrong Fang, Zhenyu Chen, Liang Xiao

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 提出SGAgent框架,通过引入建议阶段(localize-suggest-fix范式)和知识图谱工具,增强从定位到修复的推理,在SWE-Bench-Lite上达到51.3%修复准确率。

Comments Accepted to ACM Transactions on Software Engineering and Methodology (TOSEM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17914 2026-05-19 cs.PL 88%

Guiding LLM-based Loop Invariant Synthesis via Feedback on Local Reasoning Errors

通过反馈局部推理错误引导基于LLM的循环不变式合成

Tianchi Li, Zhenyu Yan, Junhao Liu, Peng Di, Xin Zhang

专题命中 推理与问题求解 :LLM(title,title_cn)

AI总结 本文提出了一种框架,通过形式验证LLM的思考过程并检测局部推理错误,为基于LLM的循环不变式合成提供建设性反馈,从而提高合成效果。

Comments Accepted by ACM Transactions on Programming Languages and Systems (TOPLAS). DOI: 10.1145/3806652

Journal ref ACM Trans. Program. Lang. Syst. 48, 2, Article 8 (May 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07027 2026-05-12 cs.AI cs.CL cs.LG cs.NE physics.chem-ph 88%

LLM-Augmented Chemical Synthesis and Design Decision Programs

基于大语言模型的化学合成与设计决策程序

Haorui Wang, Jeff Guo, Lingkai Kong, Rampi Ramprasad, Philippe Schwaller, Yuanqi Du, Chao Zhang

机构 * École Polytechnique Fédérale de Lausanne (EPFL)(瑞士联邦理工学院洛桑校区) National Centre of Competence in Research (NCCR) Catalysis(催化领域竞争力研究国立中心) Harvard University(哈佛大学) Cornell University(康奈尔大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出利用大语言模型增强的 retrosynthesis 规划方法,通过高效编码反应路径和新的路线搜索策略,提升多步合成规划与可合成分子设计能力。

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17788 2026-04-13 cs.AI cs.CL cs.LG cs.MA 88%

Bayesian Social Deduction with Graph-Informed Language Models

基于图信息的语言模型的贝叶斯社会推断

Shahab Rahimirad, Guven Gergerli, Lucia Romero, Angela Qian, Matthew Lyle Olson, Simon Stepputtis, Joseph Campbell

机构 * Purdue University(普渡大学) Oracle(甲骨文公司) Virginia Tech(弗吉尼亚理工大学) Intel Labs(英特尔实验室)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);language agent(abstract)

AI总结 本文提出一种混合推理框架,通过外部化信念推断到结构化概率模型,结合语言模型进行理解和交互,在Agent-Agent游戏中实现与大模型相当的性能,并首次在受控研究中击败人类玩家。

Comments Accepted to ACL 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16917 2026-03-26 cs.AI cs.CL cs.LG 88%

Generative Adversarial Reasoner: Enhancing LLM Reasoning with Adversarial Reinforcement Learning

生成对抗推理器:通过对抗性强化学习增强大语言模型推理

Qihao Liu, Luoxin Ye, Wufei Ma, Yu-Cheng Chou, Alan Yuille

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 本文提出生成对抗推理器,通过对抗性强化学习联合训练LLM推理器和判别器,提升推理质量与准确性。

Comments Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08213 2026-02-10 cs.LG cs.AI cs.CL q-bio.QM 88%

DrugR: Optimizing Molecular Drugs through LLM-based Explicit Reasoning

DrugR: 通过基于大语言模型的显式推理优化分子药物

Haoran Liu, Zheni Zeng, Yukun Yan, Yuxuan Chen, Yunduo Xiao

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 DrugR通过基于大语言模型的显式推理方法,优化分子药物的ADMET性质,提升药理效果并提供可解释的优化依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00879 2025-11-04 cs.CL cs.AI cs.LG 88%

Assessing LLM Reasoning Steps via Principal Knowledge Grounding

Hyeon Hwang, Yewon Cho, Chanwoong Yoon, Yein Park, Minju Song, Kyungjae Lee, Gangwoo Kim, Jaewoo Kang

机构 * Korea University(韩国大学) University of Seoul(首尔大学) AWS AI Labs(AWS人工智能实验室) AIGEN Sciences(AIGEN科学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

Comments Accepted to EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01029 2025-07-03 cs.LG cs.AI cs.CL 88%

PathCoT: Chain-of-Thought Prompting for Zero-shot Pathology Visual Reasoning

Junjie Zhou, Yingli Zuo, Shichang Feng, Peng Wan, Qi Zhu, Daoqiang Zhang, Wei Shao

机构 * The College of Artificial Intelligence, Nanjing University of Aeronautics(人工智能学院,南京航空航天大学) Astronautics The Key Laboratory of Brain-Machine Intelligence Technology, Ministry of Education(航空航天脑机智能技术重点实验室,教育部)

专题命中 推理与问题求解 :prompting(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00092 2025-07-02 cs.AI cs.CL cs.LG 88%

Thinking About Thinking: SAGE-nano's Inverse Reasoning for Self-Aware Language Models

Basab Jha, Firoj Paudel, Ujjwal Puri, Zhang Yuting, Choi Donghyuk, Wang Junhao

机构 * SAGEA Tribhuwan University(特里布文大学) Vedas College(维达学院) Madan Bhandari Memorial College(马达恩·班达里纪念学院) Fudan University(复旦大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

Comments 19 pages, 2 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14965 2025-06-19 cs.LG cs.AI cs.CL 88%

Revisiting Reinforcement Learning for LLM Reasoning from A Cross-Domain Perspective

Zhoujun Cheng, Shibo Hao, Tianyang Liu, Fan Zhou, Yutao Xie, Feng Yao, Yuexin Bian, Yonghao Zhuang, Nilabjo Dey, Yuheng Zha, Yi Gu, Kun Zhou, Yuqi Wang, Yuan Li, Richard Fan, Jianshu She, Chengqian Gao, Abulhair Saparov, Haonan Li, Taylor W. Killian, Mikhail Yurochkin, Zhengzhong Liu, Eric P. Xing, Zhiting Hu

机构 * Carnegie Mellon University(卡内基梅隆大学) Purdue University(普渡大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments 38 pages, 9 figures. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11343 2025-06-13 cs.LG cs.AI cs.CL stat.ML 88%

A Minimalist Approach to LLM Reasoning: from Rejection Sampling to Reinforce

Wei Xiong, Jiarui Yao, Yuhui Xu, Bo Pang, Lei Wang, Doyen Sahoo, Junnan Li, Nan Jiang, Tong Zhang, Caiming Xiong, Hanze Dong

机构 * Salesforce AI Research(Salesforce AI研究院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01636 2025-05-06 cs.AI cs.CL cs.LG 88%

Structured Prompting and Feedback-Guided Reasoning with LLMs for Data Interpretation

Amit Rath

专题命中 推理与问题求解 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments 21 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09077 2025-02-19 cs.CL cs.AI cs.IR cs.LG 88%

CuriousLLM: Elevating Multi-Document Question Answering with LLM-Enhanced Knowledge Graph Reasoning

Zukang Yang, Zixuan Zhu, Xuan Zhu

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted for publication in NAACL 2025. The official version will be available in the ACL Anthology

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16145 2024-12-30 cs.LG cs.AI cs.CL 88%

Offline Reinforcement Learning for LLM Multi-Step Reasoning

Huaijie Wang, Shibo Hao, Hanze Dong, Shenao Zhang, Yilin Bao, Ziran Yang, Yi Wu

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10176 2024-11-05 cs.CL cs.AI cs.LG 88%

OpenMathInstruct-1: A 1.8 Million Math Instruction Tuning Dataset

Shubham Toshniwal, Ivan Moshkov, Sean Narenthiran, Daria Gitman, Fei Jia, Igor Gitman

专题命中 推理与问题求解 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Camera-ready version for NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00106 2024-09-04 cs.CL cs.AI cs.CV cs.LG 88%

Zero-Shot Visual Reasoning by Vision-Language Models: Benchmarking and Analysis

Aishik Nagar, Shantanu Jaiswal, Cheston Tan

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00802 2024-08-05 cs.IR cs.AI cs.CL cs.LG 88%

Leveraging LLM Reasoning Enhances Personalized Recommender Systems

Alicia Y. Tsai, Adam Kraft, Long Jin, Chenwei Cai, Anahita Hosseini, Taibai Xu, Zemin Zhang, Lichan Hong, Ed H. Chi, Xinyang Yi

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments To be published at ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18219 2024-07-29 cs.LG cs.AI cs.CL 88%

Recursive Introspection: Teaching Language Model Agents How to Self-Improve

Yuxiao Qu, Tianjun Zhang, Naman Garg, Aviral Kumar

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10890 2024-06-07 cs.CL cs.AI cs.LG 88%

When is Tree Search Useful for LLM Planning? It Depends on the Discriminator

Ziru Chen, Michael White, Raymond Mooney, Ali Payani, Yu Su, Huan Sun

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);language agent(abstract)

Comments ACL 2024 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05660 2024-06-03 cs.LG cs.AI cs.CL 88%

Hypothesis Search: Inductive Reasoning with Language Models

Ruocheng Wang, Eric Zelikman, Gabriel Poesia, Yewen Pu, Nick Haber, Noah D. Goodman

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

Comments ICLR 2024. The first two authors contributed equally. Code: https://github.com/Relento/hypothesis_search

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01248 2024-03-05 cs.CV cs.AI cs.CL cs.LG 88%

SceneCraft: An LLM Agent for Synthesizing 3D Scene as Blender Code

Ziniu Hu, Ahmet Iscen, Aashi Jain, Thomas Kipf, Yisong Yue, David A. Ross, Cordelia Schmid, Alireza Fathi

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15006 2024-02-21 cs.AI cs.CL cs.LG 88%

Assessing the Impact of Prompting Methods on ChatGPT's Mathematical Capabilities

Yuhao Chen, Chloe Wong, Hanwen Yang, Juan Aguenza, Sai Bhujangari, Benthan Vu, Xun Lei, Amisha Prasad, Manny Fluss, Eric Phuong, Minghao Liu, Raja Kumar, Vanshika Vats, James Davis

专题命中 推理与问题求解 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06634 2024-02-13 cs.AI cs.CL cs.LG 88%

SocraSynth: Multi-LLM Reasoning with Conditional Statistics

Edward Y. Chang

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 1 figure, 6 tables, 6 appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14926 2023-10-24 cs.CL cs.AI cs.LG 88%

Universal Self-Adaptive Prompting

Xingchen Wan, Ruoxi Sun, Hootan Nakhost, Hanjun Dai, Julian Martin Eisenschlos, Sercan O. Arik, Tomas Pfister

专题命中 推理与问题求解 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments EMNLP 2023 (Main). 10 pages, 5 figures, 4 tables (26 pages, 9 figures and 13 tables including references and appendices)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14106 2023-05-24 cs.CL cs.AI cs.LG 88%

Better Zero-Shot Reasoning with Self-Adaptive Prompting

Xingchen Wan, Ruoxi Sun, Hanjun Dai, Sercan O. Arik, Tomas Pfister

专题命中 推理与问题求解 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments Findings of the Association for Computational Linguistics: ACL 2023. 10 pages, 2 tables, 4 figures (20 pages, 8 tables, 7 figures including references and appendices)

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.01478 2022-10-28 cs.CL cs.AI cs.CY cs.LG 88%

When to Make Exceptions: Exploring Language Models as Accounts of Human Moral Judgment

Zhijing Jin, Sydney Levine, Fernando Gonzalez, Ojasv Kamal, Maarten Sap, Mrinmaya Sachan, Rada Mihalcea, Josh Tenenbaum, Bernhard Schölkopf

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

Comments NeurIPS 2022 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07943 2026-08-12 cs.CR cs.AI cs.CL 版本更新 88%

Poise: Position-Aware One-Instruction Skill Injection for Silent Execution on LLM Agents

POISE:面向LLM智能体的位置感知不可检测技能注入攻击

Haochang Hao, Dehai Min, Zhifang Zhang, Yunbei Zhang, Miao Xu, Yingqiang Ge, Lu Cheng

机构 * University of Illinois at Chicago(伊利诺伊大学香槟分校) University of Queensland(昆士兰大学) Tulane University(路易斯安那州立大学) Rutgers University(罗格斯大学)

专题命中 推理与问题求解 :LLM(title,title_cn);分类 cs.CL、cs.AI

AI总结 提出POISE攻击方法,通过位置感知将恶意指令压缩为单一良性指令嵌入技能正文,在保持隐蔽性的同时实现89.3%的攻击成功率,比随机位置基线高28.0个百分点。

Comments Title changed from "POISE: Position-Aware Undetectable Skill Injection on LLM Agents" to "Poise: Position-Aware One-Instruction Skill Injection for Silent Execution on LLM Agents"; the manuscript, figures, appendices, and reproducibility details have been updated. 15 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏