arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18857 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18857 篇

2604.10291 2026-04-15 cs.AI 86%

TimeSeriesExamAgent: Creating Time Series Reasoning Benchmarks at Scale

时间序列考试代理:大规模创建时间序列推理基准测试

Malgorzata Gwiazda, Yifu Cai, Mononito Goswami, Arjun Choudhry, Artur Dubrawski

机构 * Technical University of Munich(慕尼黑技术大学) Auton Lab, School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机学院自主实验室)

专题命中 推理与问题求解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出TimeSeriesExamAgent,通过模板灵活性与LLM代理创造力结合,创建涵盖医疗、金融和天气领域的综合性时间序列推理基准测试,验证LLM在时间序列理解上的能力与局限。

Journal ref Proc. Int. Conf. Learn. Representations ICLR (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12066 2026-04-15 cs.AI cs.CY 86%

Mathematics Teachers Interactions with a Multi-Agent System for Personalized Problem Generation

数学教师与多智能体系统在个性化问题生成中的互动

Candace Walkington, Theodora Beauchamp, Fareya Ikram, Merve Koçyiğit Gürbüz, Fangli Xia, Margan Lee, Andrew Lan

机构 * Southern Methodist University(南方 Methodist 大学) University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校) Worchester Polytechnic Institute(沃斯顿理工学院)

专题命中 推理与问题求解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究探讨了多智能体教师闭环系统在中学数学问题个性化中的应用,通过教师输入基础问题和主题,由LLM生成问题,再由四个AI代理评估问题的数学准确性、真实性、可读性和现实性。

Comments Paper accepted to AIED 2026 - South Korea

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05716 2026-04-08 cs.AI 86%

Can Large Language Models Reinvent Foundational Algorithms?

大语言模型能否重新发明基础算法?

Jian Zhao, Haoren Luo, Yu Wang, Yuhan Cao, Pingyue Sheng, Tianxing He

机构 * Xiongan AI Institute(雄安人工智能研究院) Institute for Interdisciplinary Information Sciences, Tsinghua University(清华大学交叉信息研究院) Shanghai Qi Zhi Institute(上海期智研究院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.AI

AI总结 本文研究大语言模型能否在受控环境中重新发明基础算法,通过Unlearn-and-Reinvent流程验证模型在无提示、低提示和高提示下的表现,发现生成验证器在推理过程中起到关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01711 2026-04-03 cs.CL 86%

Human-Guided Reasoning with Large Language Models for Vietnamese Speech Emotion Recognition

基于大语言模型的人机协同推理用于越南语语音情感识别

Truc Nguyen, Then Tran, Binh Truong, Phuoc Nguyen T. H

机构 * University of Information Technology, Ho Chi Minh City, Vietnam(越南胡志明市信息技术大学) Vietnam National University Ho Chi Minh City, Ho Chi Minh City, Vietnam(越南胡志明市国家大学)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

AI总结 本文提出一种融合人类知识的语音情感识别框架,通过LLM推理处理模糊样本,提升低资源环境下的情感分类性能,达到86.59%的准确率。

Comments 6 pages, 2 figures. Dataset of 2,764 Vietnamese speech samples across three emotion classes

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01594 2026-04-03 cs.AI 86%

Do Large Language Models Mentalize When They Teach?

大型语言模型在教学时是否具备心智化能力?

Sevan K. Harootonian, Mark K. Ho, Thomas L. Griffiths, Yael Niv, Ilia Sucholutsky

机构 * Princeton University(普林斯顿大学) New York University(纽约大学)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.AI

AI总结 研究通过控制任务探讨LLM教学决策机制,发现LLM在教学策略上与人类相似,但Bayes-Optimal模型最佳解释其选择,提示提示合规性不等于教学效果提升。

Comments 9 pages, 5 figures. Workshop paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20219 2026-02-25 cs.RO cs.AI 86%

An Approach to Combining Video and Speech with Large Language Models in Human-Robot Interaction

一种结合视频和语音的大型语言模型在人机交互中的应用方法

Guanting Shen, Zi Tian

机构 * Dalian University of Technology(大连理工大学)

专题命中 推理与问题求解 :language model(title,abstract);large language model(title);分类 cs.AI

AI总结 本文提出结合视觉-语言模型、语音处理和模糊逻辑的多模态人机交互框架,通过语音指令实现机械臂的精准操控,实验显示命令执行准确率达75%,为未来人机协作提供灵活的基础。

Comments Preprint currently under revision

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14386 2026-02-17 cs.CL 86%

Beyond Token-Level Policy Gradients for Complex Reasoning with Large Language Models

超越令牌级策略梯度:用于大语言模型复杂推理的多令牌策略梯度优化

Mufan Xu, Kehai Chen, Xuefeng Bai, Zhengyu Niu, Muyun Yang, Tiejun Zhao, Min Zhang

机构 * School of Computer Science and Technology, Harbin Institute of Technology, China(哈尔滨工业大学计算机科学与技术学院) Baidu Inc.(百度公司)

专题命中 推理与问题求解 :language model(title,abstract);large language model(title);分类 cs.CL

AI总结 本文提出MPO框架,通过多令牌级优化提升大语言模型在复杂推理任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11530 2026-02-13 cs.LG cs.AR 86%

PASCAL: A Phase-Aware Scheduling Algorithm for Serving Reasoning-based Large Language Models

PASCAL:一种面向推理型大语言模型的服务调度算法

Eunyeong Cho, Jehyeon Bang, Ranggi Hwang, Minsoo Rhu

机构 * KAIST(韩国科学技术院)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.LG

AI总结 PASCAL通过优先处理推理阶段和控制回答阶段的令牌节奏,有效降低了推理型大语言模型的TTFT并保持服务等级目标。

Comments Accepted for publication at the 32nd IEEE International Symposium on High-Performance Computer Architecture (HPCA-32), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16376 2026-02-12 cs.CL 86%

Polymer-Agent: Large Language Model Agent for Polymer Design

聚合物代理:用于聚合物设计的大型语言模型代理

Vani Nigam, Achuth Chandrasekhar, Amir Barati Farimani

机构 * Department of Materials Science and Engineering, Carnegie Mellon University(材料科学与工程系,卡内基梅隆大学) Department of Mechanical Engineering, Carnegie Mellon University(机械工程系,卡内基梅隆大学)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

AI总结 本文提出基于LLM的聚合物代理,通过结构-性质预测和生成技术,助力实验室研究人员高效发现新型聚合物结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23133 2026-02-02 cs.AI 86%

RAudit: A Blind Auditing Protocol for Large Language Model Reasoning

RAudit: 一种用于大语言模型推理的盲审协议

Edward Y. Chang, Longling Geng

机构 * Stanford University(斯坦福大学)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.AI

AI总结 RAudit通过盲审协议检测大语言模型推理中的问题,揭示了四个导致模型不可靠的机制,挑战了能力与鲁棒性之间的关系。

Comments 24 pages, 21 tables, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18132 2026-01-27 cs.AI 86%

RareAlert: Aligning heterogeneous large language model reasoning for early rare disease risk screening

RareAlert: 对齐异构大语言模型推理以实现早期罕见病风险筛查

Xi Chen, Hongru Zhou, Huahui Yi, Shiyu Feng, Hanyu Zhou, Tiancheng He, Mingke You, Li Wang, Qiankun Li, Kun Wang, Weili Fu, Kang Li, Jian Li

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.AI

AI总结 RareAlert通过整合多个LLM推理并校准后生成单一模型,实现早期罕见病风险筛查,其AUC达到0.917,优于现有方法。

Comments 28 page, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09993 2026-01-12 cs.AI 86%

SPAN: Benchmarking and Improving Cross-Calendar Temporal Reasoning of Large Language Models

SPAN:大型语言模型跨日历时间推理的基准测试与改进

Zhongjian Miao, Hao Fu, Chen Wei

机构 * Li Auto(利亚特)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.AI

AI总结 SPAN通过开发时间代理提升大型语言模型跨日历时间推理能力,实验显示其准确率高达95.31%

Comments Accepted at the AAAI 2026 conference. This version includes the supplementary appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19250 2025-12-23 cs.LG cs.PL 86%

Small Language Models as Compiler Experts: Auto-Parallelization for Heterogeneous Systems

小型语言模型作为编译器专家:异构系统的自动并行化

Prathamesh Devadiga

专题命中 推理与问题求解 :language model(title,abstract);small language model(title);分类 cs.LG

AI总结 本文提出利用小型语言模型提升异构系统自动并行化性能,通过多种模型和策略在科学计算等领域实现显著加速。

Comments Accepted at NeurIPS 2025 ML for Systems Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05836 2025-12-08 cs.AI 86%

Using Large Language Models to Create Personalized Networks From Therapy Sessions

利用大语言模型从治疗会谈中创建个性化网络

Clarissa W. Ong, Hiba Arnaout, Kate Sheehan, Estella Fox, Eugen Owtscharow, Iryna Gurevych

机构 * Department of Psychological and Brain Sciences, University of Louisville, U.S.A(心理与脑科学系,路易斯维尔大学,美国) Department of Computer Science, TU Darmstadt, Germany(计算机科学系,图恩-达姆斯塔特大学,德国) Department of Psychology, University of Toledo, U.S.A(心理学系,托莱多大学,美国)

专题命中 推理与问题求解 :large language model(title);language model(title);prompting(abstract);分类 cs.AI

AI总结 本研究利用大语言模型从治疗记录中自动生成个性化网络,通过上下文学习和聚类方法提升临床效用和可解释性,为治疗个性化提供新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05419 2025-12-08 cs.LG 86%

TS-HINT: Enhancing Semiconductor Time Series Regression Using Attention Hints From Large Language Model Reasoning

基于大语言模型推理的注意力提示的半导体时间序列回归增强方法

Jonathan Adam Rico, Nagarajan Raghavan, Senthilnath Jayavelu

机构 * Engineering Product Development (EPD), SUTD, Singapore(新加坡南洋理工大学工程产品开发部) Institute for Infocomm Research (I$^2$R), A*STAR, Singapore(新加坡信息通信研究所)

专题命中 推理与问题求解 :large language model(title);language model(title);foundation model(abstract);分类 cs.LG

AI总结 TS-Hint通过结合大语言模型推理提供注意力提示,提升半导体时间序列回归在有限数据下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16331 2025-11-21 cs.CL 86%

Incorporating Self-Rewriting into Large Language Model Reasoning Reinforcement

将自我修正纳入大语言模型推理强化

Jiashu Yao, Heyan Huang, Shuang Zeng, Chuwei Luo, WangJie You, Jie Tang, Qingsong Liu, Yuhang Guo, Yangyang Kang

机构 * ByteDance China(字节跳动中国)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

AI总结 本研究提出自我修正框架,通过重写推理文本提升大语言模型的内部推理质量,实验表明其在准确性与推理长度权衡上优于现有方法。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14099 2025-11-18 cs.CL cs.IR 86%

Beyond Chains: Bridging Large Language Models and Knowledge Bases in Complex Question Answering

Yihua Zhu, Qianying Liu, Akiko Aizawa, Hidetoshi Shimodaira

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

Comments AAAI2026 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26193 2025-10-31 cs.CL 86%

RCScore: Quantifying Response Consistency in Large Language Models

Dongjun Jang, Youngchae Ahn, Hyopil Shin

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

Journal ref EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16924 2025-10-21 cs.CL 86%

Does Visual Grounding Enhance the Understanding of Embodied Knowledge in Large Language Models?

Zhihui Yang, Yupei Wang, Kaijie Mo, Zhe Zhao, Renfen Hu

机构 * Beijing Normal University(北京师范大学) Tencent AI Lab(腾讯AI实验室)

专题命中 推理与问题求解 :language model(title,abstract);large language model(title);分类 cs.CL

Comments Accepted to EMNLP 2025 (Findings). This version corrects a redundant sentence in the Results section that appeared in the camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09403 2025-09-24 cs.CL cs.DB 86%

Columbo: Expanding Abbreviated Column Names for Tabular Data Using Large Language Models

Ting Cai, Stephen Sheen, AnHai Doan

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

Comments Accepted to Findings of EMNLP 2025; 19 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16578 2025-09-23 cs.AI cs.IR 86%

Zero-Shot Human Mobility Forecasting via Large Language Model with Hierarchical Reasoning

Wenyao Li, Ran Zhang, Pengyang Wang, Yuanchun Zhou, Pengfei Wang

专题命中 推理与问题求解 :language model(title,abstract);large language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21137 2025-09-18 cs.CL 86%

How Does Cognitive Bias Affect Large Language Models? A Case Study on the Anchoring Effect in Price Negotiation Simulations

Yoshiki Takenami, Yin Jou Huang, Yugo Murawaki, Chenhui Chu

机构 * Kyoto University(京都大学)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

Comments 18 pages, 2 figures. Accepted to EMNLP 2025 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16326 2025-06-12 cs.CL 86%

Critic-CoT: Boosting the reasoning abilities of large language model via Chain-of-thoughts Critic

Xin Zheng, Jie Lou, Boxi Cao, Xueru Wen, Yuqiu Ji, Hongyu Lin, Yaojie Lu, Xianpei Han, Debing Zhang, Le Sun

机构 * Chinese Information Processing Laboratory, Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所信息处理实验室) University of Chinese Academy of Sciences(中国科学院大学) Xiaohongshu Inc(小红书公司)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

Comments Accepted at ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21299 2025-06-11 cs.CL 86%

BiasGuard: A Reasoning-enhanced Bias Detection Tool For Large Language Models

Zhiting Fan, Ruizhe Chen, Zuozhu Liu

机构 * Zhejiang University(浙江大学) Zhejiang Key Laboratory of Medical Imaging Artificial Intelligence(浙江省医学影像人工智能重点实验室)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

Comments ACL 2025 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16867 2025-05-13 cs.CL 86%

Playing repeated games with Large Language Models

Elif Akata, Lion Schulz, Julian Coda-Forno, Seong Joon Oh, Matthias Bethge, Eric Schulz

机构 * Institute for Human-Centered AI, Helmholtz Munich, Oberschleißheim, Germany(以人为中心的人工智能研究所,慕尼黑海德堡研究所,奥伯施莱斯海姆,德国) Max Planck Institute for Biological Cybernetics, Tübingen, Germany(生物控制研究所,图宾根,德国) University of Tübingen, Tübingen, Germany(图宾根大学,图宾根,德国)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01007 2025-04-16 cs.AI 86%

Unlocking the Wisdom of Large Language Models: An Introduction to The Path to Artificial General Intelligence

Edward Y. Chang

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.AI

Comments 153 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07202 2025-04-08 cs.AI 86%

A Zero-shot Learning Method Based on Large Language Models for Multi-modal Knowledge Graph Embedding

Bingchen Liu, Jingchen Li, Yuanyuan Fang, Xin Li

专题命中 推理与问题求解 :language model(title,abstract);large language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16537 2025-03-24 cs.CL cs.CV 86%

Do Multimodal Large Language Models Understand Welding?

Grigorii Khvatskii, Yong Suk Lee, Corey Angst, Maria Gibbs, Robert Landers, Nitesh V. Chawla

专题命中 推理与问题求解 :large language model(title);language model(title);prompting(abstract);分类 cs.CL

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08392 2025-03-07 cs.CV cs.CL 86%

DoraemonGPT: Toward Understanding Dynamic Scenes with Large Language Models (Exemplified as A Video Agent)

Zongxin Yang, Guikun Chen, Xiaodi Li, Wenguan Wang, Yi Yang

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17359 2025-02-24 cs.CL 86%

Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models

Zhenyu Pan, Haozheng Luo, Manling Li, Han Liu

专题命中 推理与问题求解 :large language model(title);language model(title);prompting(abstract);分类 cs.CL

Comments International Conference on Learning Representations (ICLR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏