arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-05 至 2025-09-05 共收录 19 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 19 篇

2509.03537 2025-09-05 cs.CL cs.AI cs.LG 90%

AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models

Cheng-Kai Yeh, Hsing-Wang Lee, Chung-Hung Kuo, Hen-Hsen Huang

机构 * Department of Mathematical Sciences National Chengchi University Taipei Taiwan(数学科学系 国立政治大学 台北 台湾) Department of Computer Science National Chengchi University Taipei Taiwan(计算机科学系 国立政治大学 台北 台湾) Institute of Information Science Academia Sinica Taipei Taiwan(信息科学研究所 中国学术院 台北 台湾) National Chengchi University(国立政治大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 7 pages, accepted by CIKM 2025 as a short paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11701 2025-09-05 cs.AI 90%

DMN-Guided Prompting: A Framework for Controlling LLM Behavior

Shaghayegh Abedi, Amin Jalali

机构 * Politecnico di Torino(都灵理工大学) Stockholm University(斯德哥尔摩大学)

专题命中 推理与问题求解 :prompting(title,abstract);LLM(title);large language model(abstract,comments);language model(abstract,comments)

Comments Large Language Models, Decision Model and Notation, Automated Feedback, Prompt Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03871 2025-09-05 cs.CL cs.AI cs.CR 88%

A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models

Yanbo Wang, Yongcan Yu, Jian Liang, Ran He

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) NLPR & MAIS, Institute of Automation, Chinese Academy of Sciences(神经语言处理与机器智能中心,中国科学院自动化研究所)

专题命中 推理与问题求解 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments 38 pages. This survey considers papers published up to June 30, 2025. Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11110 2025-09-05 cs.CL 88%

Chain-of-Reasoning: Towards Unified Mathematical Reasoning in Large Language Models via a Multi-Paradigm Perspective

Yiyao Yu, Yuxiang Zhang, Dongdong Zhang, Xiao Liang, Hengyuan Zhang, Xingxing Zhang, Ziyi Yang, Mahmoud Khademi, Hany Awadalla, Junjie Wang, Yujiu Yang, Furu Wei

机构 * Microsoft Research Asia(微软亚洲研究院) Tsinghua University(清华大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted to ACL 2025 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02025 2025-09-05 cs.DC cs.AI 85%

Evaluating the Efficacy of LLM-Based Reasoning for Multiobjective HPC Job Scheduling

Prachi Jadhav, Hongwei Jin, Ewa Deelman, Prasanna Balaprakash

机构 * University of Tennessee, Knoxville\ Ridge National Laboratory Oak Ridge, TN USA Argonne National Laboratory Lemont, IL USA University of Southern California Los Angeles, CA USA Oak Ridge National Laboratory Oak Ridge, TN USA University of Tennessee, Knoxville\ Ridge National Laboratory Argonne National Laboratory University of Southern California Oak Ridge National Laboratory

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 10 pages, 6 figures, work under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03995 2025-09-05 cs.CL cs.AI 85%

RTQA : Recursive Thinking for Complex Temporal Knowledge Graph Question Answering with Large Language Models

Zhaoyan Gong, Juan Li, Zhiqiang Liu, Lei Liang, Huajun Chen, Wen Zhang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) ZJU-Ant Group Joint Lab of Knowledge Graph(浙江大学-蚂蚁集团知识图谱联合实验室)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL、cs.AI

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03957 2025-09-05 cs.CL cs.AI 82%

CANDY: Benchmarking LLMs' Limitations and Assistive Potential in Chinese Misinformation Fact-Checking

Ruiling Guo, Xinwei Yang, Chen Huang, Tong Zhang, Yong Hu

机构 * School of Cyber Science and Engineering, Sichuan University, China(四川大学网络科学与工程学院) College of Computer Science, Sichuan University, China(四川大学计算机学院) Institute of Data Science, National University of Singapore, Singapore(新加坡国立大学数据科学研究所)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Findings of EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04077 2025-09-05 cs.CL 79%

Improving Narrative Classification and Explanation via Fine Tuned Language Models

Rishit Tyagi, Rahul Bouri, Mohit Gupta

专题命中 推理与问题求解 :language model(title);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01747 2025-09-05 cs.CL 79%

DynaSaur: Large Language Agents Beyond Predefined Actions

Dang Nguyen, Viet Dac Lai, Seunghyun Yoon, Ryan A. Rossi, Handong Zhao, Ruiyi Zhang, Puneet Mathur, Nedim Lipka, Yu Wang, Trung Bui, Franck Dernoncourt, Tianyi Zhou

机构 * University of Maryland(马里兰大学) Adobe Research(Adobe研究院)

专题命中 推理与问题求解 :language agent(title);LLM(abstract);分类 cs.CL

Comments Published as a conference paper at COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04083 2025-09-05 cs.AI 77%

Intermediate Languages Matter: Formal Languages and LLMs affect Neurosymbolic Reasoning

Alexander Beiser, David Penz, Nysret Musliu

机构 * Johannes Kepler University Linz(约翰内斯·开普勒大学林茨)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments To appear in the proceedings of The Second Workshop on Knowledge Graphs and Neurosymbolic AI (KG-NeSy) Co-located with SEMANTiCS 2025 Conference, Vienna, Austria - September 3rd, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18201 2025-09-05 cs.CL cs.CV cs.HC 77%

Deciphering Emotions in Children Storybooks: A Comparative Analysis of Multimodal LLMs in Educational Applications

Bushra Asseri, Estabraq Abdelaziz, Maha Al Mogren, Tayef Alhefdhi, Areej Al-Wabil

机构 * College of Engineering & Advanced Computing(工程与高级计算学院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03875 2025-09-05 cs.SE 75%

VulRTex: A Reasoning-Guided Approach to Identify Vulnerabilities from Rich-Text Issue Report

Ziyou Jiang, Mingyang Li, Guowei Yang, Lin Shi, Qing Wang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 25 pages, 7 figures, submitting to TOSEM journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12736 2025-09-05 cs.CL cs.AI cs.LG cs.SY eess.SY math.OC 75%

ACING: Actor-Critic for Instruction Learning in Black-Box LLMs

Salma Kharrat, Fares Fourati, Marco Canini

机构 * KAUST(卡斯土尼亚大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03644 2025-09-05 cs.AI cs.CL 73%

Towards a Neurosymbolic Reasoning System Grounded in Schematic Representations

François Olivier, Zied Bouraoui

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments To appear in Proceedings of Machine Learning Research, 19th Conference on Neurosymbolic Learning and Reasoning, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16117 2025-09-05 cs.AI cs.CL cs.IR 73%

Extending FKG.in: Towards a Food Claim Traceability Network

Saransh Kumar Gupta, Rizwan Gulzar Mir, Lipika Dey, Partha Pratim Das, Anirban Sen, Ramesh Jain

机构 * Ashoka University(阿什瓦克大学) UCI Institute for Future Health(加州未来健康研究所)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 10 pages, 3 figures, 1 table, 45 references, ACM International Conference on Multimedia 2025 - Multi-modal Food Computing Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01115 2025-09-05 cs.LG cs.CL 73%

Is Random Attention Sufficient for Sequence Modeling? Disentangling Trainable Components in the Transformer

Yihe Dong, Lorenzo Noci, Mikhail Khodak, Mufan Li

机构 * Princeton University(普林斯顿大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14585 2025-09-05 cs.CL 70%

Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning

Wenbin Hu, Haoran Li, Huihao Jing, Qi Hu, Ziqian Zeng, Sirui Han, Heli Xu, Tianshu Chu, Peizhao Hu, Yangqiu Song

机构 * HKUST(香港科技大学) South China University of Technology(华南理工大学) Huawei Technologies(华为技术有限公司)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03805 2025-09-05 cs.CL cs.AI 62%

Measuring How (Not Just Whether) VLMs Build Common Ground

Saki Imai, Mert İnan, Anthony Sicilia, Malihe Alikhani

机构 * Northeastern University(东北大学)

专题命中 推理与问题求解 :language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12065 2025-09-05 cs.CL cs.FL 57%

Autoformalization in the Wild: Assessing LLMs on Real-World Mathematical Definitions

Lan Zhang, Marco Valentino, Andre Freitas

机构 * Department of Computer Science, University of Manchester(曼彻斯特大学计算机科学系) School of Computer Science, University of Sheffield(谢菲尔德大学计算机科学学院) Idiap Research Institute(Idiap研究机构) National Biomarker Centre, CRUK Manchester Institute(国家生物标志物中心、CRUK曼彻斯特研究所)

专题命中 推理与问题求解 :LLM(abstract);分类 cs.CL

Comments EMNLP 2025 Camera-Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏