arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18875 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18875 篇

2411.01141 2026-05-21 cs.CL 91%

Dictionary Insertion Prompting for Multilingual Reasoning on Multilingual Large Language Models

字典插入提示用于多语言推理在多语言大语言模型上

Hongyuan Lu, Zixuan Li, Wai Lam

机构 * The Chinese University of Hong Kong(香港中文大学) Southeast University(东南大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title);分类 cs.CL

AI总结 本文提出了一种名为字典插入提示(DIP)的新方法,通过在提示中插入词典中的英文对应词来提升多语言推理性能,实验表明在10到200种语言上效果显著。

Comments ACL *SEM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17734 2026-05-19 cs.AI 91%

Harnessing LLM Agents with Skill Programs

通过技能程序 harnessing LLM agents

Hongjun Liu, Yifei Ming, Shafiq Joty, Chen Zhao

机构 * New York University(纽约大学) Salesforce AI Research(Salesforce人工智能研究)

专题命中 推理与问题求解 :LLM(title,title_cn);post-training(abstract);分类 cs.AI

AI总结 本文提出 HASP 框架,通过将技能转化为可执行程序函数(PFs)来提升 LLM agent 在复杂任务中的表现,其核心方法是通过 PFs 在失败状态时介入并修正行动,主要贡献是通过模块化设计实现推理、训练和自改进的多场景应用。

Comments 40 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06475 2026-05-14 cs.LG 91%

Towards Generalizable Reasoning: Group Causal Counterfactual Policy Optimization for LLM Reasoning

迈向通用性推理:面向LLM推理的群体因果反事实策略优化

Jingyao Wang, Peizheng Guo, Wenwen Qiang, Jiahuan Zhou, Huijie Guo, Changwen Zheng, Hui Xiong

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学) Wangxuan Institute of Computer Technology, Peking University(北京大学王宣计算机技术研究所) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出群体因果反事实策略优化方法,通过反事实奖励提升LLM推理的通用性,强调推理过程的鲁棒性和有效性,实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08904 2026-05-12 cs.AI 91%

OPT-BENCH: Evaluating the Iterative Self-Optimization of LLM Agents in Large-Scale Search Spaces

OPT-BENCH:评估大搜索空间中LLM代理的迭代自我优化

Xiaozhe Li, Jixuan Chen, Xinyu Fang, Shengyuan Ding, Haodong Duan, Qingwen Liu, Kai Chen

机构 * Tongji University(同济大学) Shanghai AI Lab(上海人工智能实验室) Fudan University(复旦大学) Zhejiang University(浙江大学) University of California San Diego(加州大学圣地亚哥分校)

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 OPT-BENCH通过结合20个机器学习任务和10个经典NP难问题,评估LLM代理在大规模搜索空间中通过内在自我反思而非机械工具应用进行适应的能力,揭示更强模型在反馈利用上的优势及基础能力的限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05950 2026-05-04 cs.AI 91%

Training-Free Time Series Classification via In-Context Reasoning with LLM Agents

无需训练的时间序列分类通过LLM代理的上下文推理

Songyuan Sui, Zihang Xu, Xia Hu

机构 * Rice University(Rice大学)

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 本文提出FETA框架,利用上下文推理实现无需训练的时间序列分类,通过多代理结构提升效率和可解释性,在多个数据集上取得优异性能。

Comments 8 pages main content, 12 pages total including appendix, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24790 2026-04-29 cs.CR cs.AI 91%

Semantic Denial of Service in LLM-controlled robots

语义拒绝服务在LLM控制的机器人中

Jonathan Steinberg, Oren Gal

机构 * Swarms & AI Lab (SAIL) University of Haifa(群集与人工智能实验室(SAIL)海法大学)

专题命中 推理与问题求解 :LLM(title,title_cn);language model(abstract);分类 cs.AI

AI总结 本文研究了LLM控制机器人中语义拒绝服务攻击,发现通过注入安全可信的短语可触发安全推理中断,提出防御策略需平衡攻击抑制与真实危险响应,强调系统架构而非提示级别的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22606 2026-04-27 cs.CL 91%

Dharma, Data and Deception: An LLM-Powered Rhetorical Analysis of Cow-Urine Health Claims on YouTube

达摩、数据与欺骗:一种基于LLM的牛尿健康主张YouTube评论修辞分析

Sheza Munir, Ratna Kandala, Anamta Khan, Deepti, Joyojeet Pal

机构 * University of Michigan(密歇根大学) University of Kansas(堪萨斯大学) IIT Jodhpur(印度理工学院乔普里尔)

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文利用LLM分析YouTube上牛尿健康主张的修辞策略,揭示推广者与反驳者在说服技巧上的差异,验证了LLM在 misinformation 分析中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19716 2026-04-22 cs.CL 91%

Discovering a Shared Logical Subspace: Steering LLM Logical Reasoning via Alignment of Natural-Language and Symbolic Views

发现共享的逻辑子空间:通过自然语言和符号视角的对齐来引导LLM逻辑推理

Feihao Fang, My T. Thai, Yuanyuan Lei

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Computer & Information Science and Engineering, University of Florida(佛罗里达大学计算机与信息科学与工程系)

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出通过对齐自然语言和符号视角的逻辑子空间来提升LLM的多步逻辑推理能力,通过实验验证该方法在四个基准测试中提升了准确率并具备良好的泛化能力。

Comments Accepted to ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09953 2026-04-22 cs.CL 91%

Take Out Your Calculators: Estimating the Real Difficulty of Question Items with LLM Student Simulations

拿出计算器:利用LLM学生模拟估算问题的真实难度

Christabel Acquaye, Yi Ting Huang, Marine Carpuat, Rachel Rudinger

机构 * University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文探讨利用开源大语言模型评估数学选择题难度的方法,通过模拟不同年级学生角色扮演,利用IRT模型对比预测难度与实际难度,发现模型性能受学生命名策略和数学能力影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17255 2026-04-21 cs.CL 91%

Are Emotion and Rhetoric Neurons in LLM? Neuron Recognition and Adaptive Masking for Emotion-Rhetoric Prediction Steering

LLM中是否存在情绪与修辞神经元?神经元识别与自适应遮蔽用于情绪-修辞预测引导

Li Zheng, Xin Zhang, Shuyi He, Fei Li, Chong Teng, Jiangming Yang, Donghong Ji, Zhuang Li

机构 * Key Laboratory of Aerospace Information Security and Trusted Computing, Ministry of Education, School of Cyber Science and Engineering, Wuhan University(航空信息安全与可信计算 key laboratory,教育部,武汉大学计算机科学与工程学院)

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文研究LLM中情绪与修辞神经元的表示机制及内在关联,提出神经元识别框架与自适应遮蔽方法,实现神经元功能的可靠验证,通过神经元调控提升情绪任务与修辞表达的精细控制。

Comments Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22513 2026-03-25 cs.SE cs.CL 91%

Generating and Evaluating Sustainable Procurement Criteria for the Swiss Public Sector using In-Context Prompting with Large Language Models

利用大语言模型的上下文提示生成和评估瑞士公共部门可持续采购标准

Yingqiang Gao, Veton Matoshi, Luca Rolshoven, Tilia Ellendorff, Judith Binder, Jeremy Austin Jann, Gerold Schneider, Matthias Stürmer

机构 * University of Zurich(苏黎世大学) Bern University of Applied Sciences(伯尔尼应用科学大学) University of Bern(伯尔尼大学)

专题命中 推理与问题求解 :prompting(title,abstract);large language model(title);language model(title);LLM(abstract)

AI总结 本文提出一种可配置的LLM辅助流程,用于系统生成和评估瑞士可持续采购标准目录。通过整合上下文提示、可替换的LLM后端和自动输出验证,该系统能跨不同采购领域生成可审计的标准。实验表明,该流程能显著减少手动撰写工作,生成符合官方指南的标准目录。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02648 2025-10-06 cs.CL 91%

SoT: Structured-of-Thought Prompting Guides Multilingual Reasoning in Large Language Models

Rui Qi, Zhibo Man, Yufeng Chen, Fengran Mo, Jinan Xu, Kaiyu Huang

机构 * Key Laboratory of Big Data & Artificial Intelligence in Transportation (Beijing Jiaotong University), Ministry of Education(大数据与人工智能交通 key laboratory(北京交通大学)) School of Computer Science and Technology, Beijing Jiaotong University(计算机科学与技术学院(北京交通大学)) University of Montreal(蒙特利尔大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title);分类 cs.CL

Comments EMNLP 2025 (findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16729 2025-08-26 cs.CL 91%

Error Reflection Prompting: Can Large Language Models Successfully Understand Errors?

Jason Li, Lauren Yraola, Kevin Zhu, Sean O'Brien

机构 * Algoverse AI Research(Algoverse AI 研究所)

专题命中 推理与问题求解 :language model(title,abstract);prompting(title,abstract);large language model(title);分类 cs.CL

Comments Accepted to Insights @ NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01290 2025-08-05 cs.CL 91%

Prompting Large Language Models with Partial Knowledge for Answering Questions with Unseen Entities

Zhichao Yan, Jiapu Wang, Jiaoyan Chen, Yanyan Wang, Hongye Tan, Jiye Liang, Xiaoli Li, Ru Li, Jeff Z. Pan

机构 * School of Computer and Information Technology, Shanxi University(山西大学计算机与信息学院) Beijing University of Technology(北京理工大学) Department of Computer Science, University of Manchester(曼彻斯特大学计算机科学系) Singapore University of Technology and Design(新加坡科技与设计大学) ILCC, School of Informatics, University of Edinburgh(爱丁堡大学信息学院ILCC)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03573 2025-06-05 cs.CL 91%

Exchange of Perspective Prompting Enhances Reasoning in Large Language Models

Lin Sun, Can Zhang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14812 2025-05-27 cs.CL 91%

Enhancing Chain of Thought Prompting in Large Language Models via Reasoning Patterns

Yufeng Zhang, Xuepeng Wang, Lingxiang Wu, Jinqiao Wang

专题命中 推理与问题求解 :language model(title,abstract);prompting(title,abstract);large language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02025 2024-12-04 cs.RO cs.AI 91%

PKRD-CoT: A Unified Chain-of-thought Prompting for Multi-Modal Large Language Models in Autonomous Driving

Xuewen Luo, Fan Ding, Yinsheng Song, Xiaofeng Zhang, Junnyong Loo

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title);分类 cs.AI

Comments This paper has been accepted for presentation at ICONIP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03062 2024-10-07 cs.AI 91%

Image First or Text First? Optimising the Sequencing of Modalities in Large Language Model Prompting and Reasoning Tasks

Grant Wardle, Teo Susnjak

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09821 2024-07-15 cs.CL 91%

Towards Robust Temporal Reasoning of Large Language Models via a Multi-Hop QA Dataset and Pseudo-Instruction Tuning

Qingyu Tan, Hwee Tou Ng, Lidong Bing

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);instruction tuning(title);分类 cs.CL

Comments To appear in Findings of ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16127 2024-06-18 cs.AI 91%

LLM-SAP: Large Language Models Situational Awareness Based Planning

Liman Wang, Hanyang Zhong

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(title);分类 cs.AI

Comments This article has been accepted by ICME2024 Workshop MML4SG. Website:https://github.com/HanyangZhong/Situational_Planning_datasets

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11598 2024-06-11 cs.CL 91%

Filling the Image Information Gap for VQA: Prompting Large Language Models to Proactively Ask Questions

Ziyue Wang, Chi Chen, Peng Li, Yang Liu

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title);分类 cs.CL

Comments Accepted to EMNLP2023 Findings

Journal ref https://aclanthology.org/2023.findings-emnlp.189/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03288 2024-03-07 cs.AI 91%

Should We Fear Large Language Models? A Structural Analysis of the Human Reasoning System for Elucidating LLM Capabilities and Risks Through the Lens of Heidegger's Philosophy

Jianqiiu Zhang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(title);分类 cs.AI

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.08769 2023-03-17 cs.LG 91%

Prompting Large Language Models With the Socratic Method

Edward Y. Chang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title);分类 cs.LG

Comments 10 pages

Journal ref IEEE Computing and Communication Workshop and Conference (CCWC), March 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22651 2026-08-14 cs.LG cs.AI cs.CE cs.MA 版本更新 91%

Automated Design Optimization via Strategic Search with Large Language Models

通过大语言模型的战略搜索实现自动化设计优化

Anthony Carreon, Vansh Sharma, Venkat Raman

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 本研究提出AUTO框架,利用大语言模型的战略搜索实现GPU代码优化,提升搜索效率并降低成本。

Comments 16 pages, 4 tables, 8 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04591 2026-08-06 cs.CL cs.AI 新提交 91%

When Absence Is Evidence: Evaluating Completeness-Sensitive Negative Reasoning in Large Language Models

当缺失即证据:评估大语言模型中对完整性敏感的负向推理能力

Byoungjae Min, Kennedy Edemacu, Sae-Hong Cho, Yoonhyuk Choi, Beakcheol Jang, Jong Wook Kim

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 该研究针对大语言模型的完整性敏感负向推理能力,构建CROWN-QA评估基准,发现模型存在过度闭合等问题,提示无法持续解决错误,且部分覆盖不对称性在真实文档中依然存在。

Comments 19 pages, 2 figures, 20 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22182 2026-07-27 cs.CL cs.AI 新提交 91%

From Isolated Tasks to Structured Capabilities: A Multilayer Taxonomy for Large Language Models

从孤立任务到结构化能力:大语言模型的多层分类法

Shixin Fang, Jiachen Wo, Wenjuan Qin, Sihang Jiang, Yanghua Xiao

机构 * Fudan University(复旦大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 该研究提出大语言模型多层分类法,含14个能力领域和91个子技能,以人类认知科学为指导。通过筛选和映射相关论文,分析研究关注情况,揭示领域及子技能分布,此分类法有助于大语言模型研究组织、评估等多方面工作。

Comments 34 pages, 5 figures, 20 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16827 2026-07-23 cs.AI cs.CL 版本更新 91%

Prompt Programming for Cultural Bias and Alignment of Large Language Models

提示编程用于大型语言模型的文化偏差与对齐

Maksim Eren, Eric Michalak, Brian Cook, Johnny Seales

机构 * Information Systems and Modeling, Los Alamos National Laboratory(信息系统与建模,洛斯阿拉莫斯国家实验室) Advanced Research in Cyber Systems, Los Alamos National Laboratory(网络安全系统高级研究,洛斯阿拉莫斯国家实验室) Center for National Security and International Studies(国家安全与国际研究中心) Analytics Division, Los Alamos National Laboratory(分析部门,洛斯阿拉莫斯国家实验室)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 本文提出通过提示编程优化大型语言模型的文化对齐,利用DSPy框架系统调整治文化偏差,实验表明提示优化优于传统手动提示工程,提升模型响应的可转移性与稳定性。

Comments 10 pages, pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12349 2026-07-21 cs.CY cs.AI cs.CL 91%

Information Suppression in Large Language Models: Auditing, Quantifying, and Characterizing Censorship in DeepSeek

大语言模型中的信息压制:对DeepSeek的信息审查、量化与特征化

Peiran Qiu, Siyi Zhou, Emilio Ferrara

机构 * Thomas Lord Department of Computer Science, University of Southern California, USA(汤姆斯·劳德计算机科学系,南加州大学) Information Sciences Institute, University of Southern California, USA(信息科学研究所,南加州大学) Annenberg School of Communication, University of Southern California, USA(安纳伯格传播学院,南加州大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 本研究通过审计框架揭示DeepSeek在处理政治敏感提示时的信息压制现象,指出模型在内部推理中保留敏感内容,但在最终输出中进行过滤或改写,强调了对AI模型中信息压制机制进行系统审查的重要性。

Journal ref Inf. Sci. 724, C (Jan 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14149 2026-07-17 cs.AI cs.LG 新提交 91%

Enhancing Small Language Models Reasoning through Knowledge Graph Grounding

通过知识图谱基础增强小型语言模型推理

Dimitrios Kelesis, Konstantinos Bougiatiotis, Georgios Paliouras

机构 * Institute of Informatics and Telecommunications, National Center for Scientific Research “Demokritos(信息与电信研究所,国家科学研究中心“德谟克利特”)

专题命中 推理与问题求解 :language model(title,abstract);small language model(title,abstract);large language model(abstract);SLM(abstract)

AI总结 研究利用神经符号智能框架增强小型语言模型推理能力,通过特定工具调用转变模型,在两种场景下评估,发现虽提示提升性能,但受提取瓶颈等限制,还存在“干扰效应”,刻画了挑战并提供迭代验证路线图。

Comments Presented at the 2nd Causal Neuro-symbolic Artificial Intelligence (Causal NeSy): Toward Agentic LLMs with Neuro-Symbolic and Graph Based Reasoning Workshop @ ESWC2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14114 2026-07-17 cs.CL cs.AI 新提交 91%

CoEvoT: Co-Evolving Chain-of-Thought Prompting for Graph-LLM Reasoning

CoEvoT:用于图语言模型推理的协同进化思维链提示

Haohua Niu, Xingtong Yu, Yang Liu, Junfeng Fang, Xuanting Xie, Jie Tan, Zhongjian Zhang, Hong Cheng, Yuan Fang

机构 * Sun Yat-Sen University(中山大学) The Chinese University of Hong Kong(香港中文大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) National University of Singapore(新加坡国立大学) University of Electronic Science and Technology of China(电子科技大学) Beijing University of Posts and Telecommunieations(北京邮电大学) Singapore Management University(新加坡管理大学)

专题命中 推理与问题求解 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究分布转移下的图学习问题,提出CoEvoT框架,通过文本到图令牌重写与图到文本推理指导的闭环协同进化,实现逐步的、状态感知的证据细化,在八个数据集实验中性能优于现有基准模型。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏