arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-06 至 2025-08-06 共收录 19 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 19 篇

2508.03500 2025-08-06 cs.AI 90%

Error Detection and Correction for Interpretable Mathematics in Large Language Models

Yijin Yang, Cristina Cornelio, Mario Leiva, Paulo Shakarian

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02913 2025-08-06 cs.AI 89%

Enhancing Japanese Large Language Models with Reasoning Vectors

Carolina Minami Oguchi, Leo Wei, Koyo Kobayashi, Hsin-Tai Wu, Dipak Ghosal

机构 * University of California, Davis(加州大学戴维斯分校) Santa Clara University(圣克拉拉大学) NTT DOCOMO, INC(NTT DOCOMO公司) DOCOMO Innovations, Inc(DOCOMO创新公司)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03120 2025-08-06 eess.SP cs.ET cs.RO 89%

Can Large Language Models Identify Materials from Radar Signals?

Jiangyou Zhu, Hongyu Deng, He Chen

机构 * The Chinese University of Hong Kong(香港中文大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01056 2025-08-06 cs.ET cs.AI 88%

Managing Escalation in Off-the-Shelf Large Language Models

Sebastian Elbaum, Jonathan Panter

机构 * Council on Foreign Relations and University of Virginia(美国对外关系委员会和弗吉尼亚大学) Council on Foreign Relations(美国对外关系委员会)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02823 2025-08-06 cs.HC cs.AI cs.CL cs.SE 81%

NeuroSync: Intent-Aware Code-Based Problem Solving via Direct LLM Understanding Modification

Wenshuo Zhang, Leixian Shen, Shuchang Xu, Jindu Wang, Jian Zhao, Huamin Qu, Linping Yuan

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) University of Waterloo(滑铁卢大学)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI

Comments Accepted in UIST 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03366 2025-08-06 cs.AI cs.CL cs.LG cs.SC 80%

A Comparative Study of Neurosymbolic AI Approaches to Interpretable Logical Reasoning

Michael K. Chen

机构 * Raffles Institution(拉夫斯学院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to NeSy 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03686 2025-08-06 cs.CL cs.AI 79%

CompassVerifier: A Unified and Robust Verifier for LLMs Evaluation and Outcome Reward

Shudong Liu, Hongwei Liu, Junnan Liu, Linchen Xiao, Songyang Gao, Chengqi Lyu, Yuzhe Gu, Wenwei Zhang, Derek F. Wong, Songyang Zhang, Kai Chen

机构 * Shanghai AI Laboratory(上海人工智能实验室) NLP 2 CT Lab, University of Macau(澳门大学自然语言处理与计算机视觉实验室) University of Macau(澳门大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Technical Report; 31 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01263 2025-08-06 cs.CL cs.AI cs.LO 79%

Bridging LLMs and Symbolic Reasoning in Educational QA Systems: Insights from the XAI Challenge at IJCNN 2025

Long S. T. Nguyen, Khang H. N. Vo, Thu H. A. Nguyen, Tuan C. Bui, Duc Q. Nguyen, Thanh-Tung Tran, Anh D. Nguyen, Minh L. Nguyen, Fabien Baldacci, Thang H. Bui, Emanuel Di Nardo, Angelo Ciaramella, Son H. Le, Ihsan Ullah, Lorenzo Di Rocco, Tho T. Quan

机构 * URA Research Group, Ho Chi Minh City University of Technology (HCMUT), Vietnam Ho Chi Minh City International University (HCMIU), Vietnam University of South-Eastern Norway, Norway Japan Advanced Institute of Science Univ. Bordeaux, CNRS, Bordeaux INP, LaBRI, UMR 5800, F-33400 Talence, France University of Naples Parthenope, Italy VNU Information Technology Institute, Vietnam National University, Vietnam Visual Intelligence Lab, School of Computer Science \& Insight Center for Data Analyitcs, University of Galway, Ireland Sapienza University of Rome, Italy

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments The XAI Challenge @ TRNS-AI Workshop, IJCNN 2025: Explainable AI for Educational Question Answering. Website: https://sites.google.com/view/trns-ai/challenge/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03444 2025-08-06 cs.LG 77%

An Auditable Agent Platform For Automated Molecular Optimisation

Atabey Ünlü, Phil Rohr, Ahmet Celebi

机构 * DeltaWave

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02789 2025-08-06 cs.AI 77%

Cognitive Loop via In-Situ Optimization: Self-Adaptive Reasoning for Science

Newman Cheng, Gordon Broadbent, William Chappell

机构 * Microsoft Discovery and Quantum, Office of the Chief Technology Officer(微软发现与量子,首席技术官办公室)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03560 2025-08-06 cs.SE 75%

LaTCoder: Converting Webpage Design to Code with Layout-as-Thought

Yi Gui, Zhen Li, Zhongyi Zhang, Guohao Wang, Tianpeng Lv, Gaoyang Jiang, Yi Liu, Dongping Chen, Yao Wan, Hongyu Zhang, Wenbin Jiang, Xuanhua Shi, Hai Jin

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract)

Comments KDD 2025 v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03680 2025-08-06 cs.AI cs.LG 73%

Agent Lightning: Train ANY AI Agents with Reinforcement Learning

Xufang Luo, Yuge Zhang, Zhiyuan He, Zilong Wang, Siyun Zhao, Dongsheng Li, Luna K. Qiu, Yuqing Yang

机构 * Microsoft Research(微软研究院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03173 2025-08-06 cs.AI 70%

Geoint-R1: Formalizing Multimodal Geometric Reasoning with Dynamic Auxiliary Constructions

Jingxuan Wei, Caijun Jia, Qi Chen, Honghao He, Linzhuang Sun, Conghui He, Lijun Wu, Bihui Yu, Cheng Tan

机构 * Shenyang institute of computing technology, Chinese academy of sciences(沈阳计算技术研究所,中国科学院) Shanghai AI Laboratory(上海人工智能实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03054 2025-08-06 cs.AI 70%

Beyond Surface-Level Detection: Towards Cognitive-Driven Defense Against Jailbreak Attacks via Meta-Operations Reasoning

Rui Pu, Chaozhuo Li, Rui Ha, Litian Zhang, Lirong Qiu, Xi Zhang

机构 * Key Laboratory of Trustworthy Distributed Computing and Service (MoE)(可信分布式计算与服务重点实验室)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18337 2025-08-06 cs.AI 70%

The AlphaPhysics Term Rewriting System for Marking Algebraic Expressions in Physics Exams

Peter Baumgartner, Lachlan McGinness

机构 * CSIRO/Data61 and Australian National University(CSIRO/Data61和澳大利亚国立大学) Australian National University and CSIRO/Data61(澳大利亚国立大学和CSIRO/Data61)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03232 2025-08-06 cs.RO 67%

CookBench: A Long-Horizon Embodied Planning Benchmark for Complex Cooking Scenarios

Muzhen Cai, Xiubo Chen, Yining An, Jiaxin Zhang, Xuesong Wang, Wang Xu, Weinan Zhang, Ting Liu

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02962 2025-08-06 cs.RO 67%

Robot builds a robot's brain: AI generated drone command and control station hosted in the sky

Peter Burke

机构 * Department of Electrical Engineering and Computer Science, University of California, Irvine(电气工程与计算机科学系,加州大学伊文斯顿分校)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03613 2025-08-06 cs.LG cs.AI 62%

Goedel-Prover-V2: Scaling Formal Theorem Proving with Scaffolded Data Synthesis and Self-Correction

Yong Lin, Shange Tang, Bohan Lyu, Ziran Yang, Jui-Hui Chung, Haoyu Zhao, Lai Jiang, Yihan Geng, Jiawei Ge, Jingruo Sun, Jiayun Wu, Jiri Gesi, Ximing Lu, David Acuna, Kaiyu Yang, Hongzhou Lin, Yejin Choi, Danqi Chen, Sanjeev Arora, Chi Jin

专题命中 推理与问题求解 :language model(abstract);分类 cs.AI、cs.LG

Comments 24 pages, 10 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14821 2025-08-06 cs.LG cs.AI cs.CV 62%

Reinforcing VLMs to Use Tools for Detailed Visual Reasoning Under Resource Constraints

Sunil Kumar, Bowen Zhao, Leo Dirac, Paulina Varshavskaya

专题命中 推理与问题求解 :language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏