arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-04 至 2025-11-04 共收录 58 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 58 篇

2511.01618 2025-11-04 cs.CV cs.CL 90%

Actial: Activate Spatial Reasoning Ability of Multimodal Large Language Models

Xiaoyu Zhan, Wenxuan Huang, Hao Sun, Xinyu Fu, Changfeng Ma, Shaosheng Cao, Bohan Jia, Shaohui Lin, Zhenfei Yin, Lei Bai, Wanli Ouyang, Yuanqi Li, Jie Guo, Yanwen Guo

机构 * Nanjing University(南京大学) Xiaohongshu Inc.(小红书公司) East China Normal University(华东师范大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学) University of Oxford(牛津大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);SFT(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11511 2025-11-04 cs.AI cs.CL cs.LG 90%

Multi-Step Reasoning with Large Language Models, a Survey

Aske Plaat, Annie Wong, Suzan Verberne, Joost Broekens, Niki van Stein, Thomas Back

机构 * LIACS(莱顿大学信息科学研究中心) Leiden University(莱顿大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ACM Computing Surveys

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00379 2025-11-04 cs.AI cs.CL 90%

Diverse Human Value Alignment for Large Language Models via Ethical Reasoning

Jiahao Wang, Songkai Xue, Jinghui Li, Xiaozhen Wang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted by AIES 2025, camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24236 2025-11-04 cs.CL 90%

Towards Transparent Reasoning: What Drives Faithfulness in Large Language Models?

Teague McMillan, Gabriele Dominici, Martin Gjoreski, Marc Langheinrich

机构 * ETH Zurich(苏黎世联邦理工学院) Università della Svizzera italiana(瑞士意大利大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: NeurIPS 2025 Workshop on Evaluating the Evolving LLM Lifecycle: Benchmarks, Emergent Abilities, and Scaling

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23433 2025-11-04 cs.LG 89%

Diversity-Aware Policy Optimization for Large Language Model Reasoning

Jian Yao, Ran Cheng, Xingyu Wu, Jibin Wu, Kay Chen Tan

机构 * Department of Data Science and Artificial Intelligence, The Hong Kong Polytechnic University(数据科学与人工智能系,香港理工大学) Department of Computing, The Hong Kong Polytechnic University(计算系,香港理工大学) The Hong Kong Polytechnic University Shenzhen Research Institute(香港理工大学深圳研究院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01052 2025-11-04 cs.AI physics.med-ph 89%

Knowledge Elicitation with Large Language Models for Interpretable Cancer Stage Identification from Pathology Reports

Yeawon Lee, Christopher C. Yang, Chia-Hsuan Chang, Grace Lu-Yao

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08619 2025-11-04 cs.AI 89%

Agentic Large Language Models for Conceptual Systems Engineering and Design

Soheyl Massoudi, Mark Fuge

机构 * ETH Zurich(苏黎世联邦理工学院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 32 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00879 2025-11-04 cs.CL cs.AI cs.LG 88%

Assessing LLM Reasoning Steps via Principal Knowledge Grounding

Hyeon Hwang, Yewon Cho, Chanwoong Yoon, Yein Park, Minju Song, Kyungjae Lee, Gangwoo Kim, Jaewoo Kang

机构 * Korea University(韩国大学) University of Seoul(首尔大学) AWS AI Labs(AWS人工智能实验室) AIGEN Sciences(AIGEN科学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

Comments Accepted to EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13927 2025-11-04 eess.AS cs.AI cs.SD 88%

DSpAST: Disentangled Representations for Spatial Audio Reasoning with Large Language Models

Kevin Wilkinghoff, Zheng-Hua Tan

机构 * Department of Electronic Systems, Aalborg University, Denmark(电子系统系,奥尔堡大学,丹麦) Pioneer Centre for AI, Denmark(人工智能先锋中心,丹麦)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01136 2025-11-04 cs.MA 88%

Credit Network Modeling and Analysis via Large Language Models

Enbo Sun, Yongzhao Wang, Hao Zhou

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract)

Comments 8 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18032 2025-11-04 cs.AI cs.CL cs.MA 87%

GraphTeam: Facilitating Large Language Model-based Graph Analysis via Multi-Agent Collaboration

Xin Li, Qizhi Chu, Yubin Chen, Yang Liu, Yaoqi Liu, Zekai Yu, Weize Chen, Chen Qian, Chuan Shi, Cheng Yang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) The Chinese University of Hong Kong(香港中文大学) Tsinghua University(清华大学)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00993 2025-11-04 cs.AI cs.LG 86%

Aligning LLM agents with human learning and adjustment behavior: a dual agent approach

Tianming Liu, Jirong Yang, Yafeng Yin, Manzi Li, Linghao Wang, Zheng Zhu

机构 * Department of Civil and Environmental Engineering, University of Michigan, Ann Arbor, United States(美国密歇根大学土木与环境工程系) Department of Electrical Engineering and Computer Science, University of Michigan, Ann Arbor, United States(美国密歇根大学电气工程与计算机科学系) College of Civil Engineering and Architecture, Zhejiang University, Hangzhou, China(浙江大学建筑工程学院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 32 pages, 6 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20432 2025-11-04 cs.AI cs.CY cs.GT cs.LG 86%

LLM Strategic Reasoning: Agentic Study through Behavioral Game Theory

Jingru Jia, Zehua Yuan, Junhao Pan, Paul E. McNamara, Deming Chen

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27598 2025-11-04 cs.AI 85%

InnovatorBench: Evaluating Agents' Ability to Conduct Innovative LLM Research

Yunze Wu, Dayuan Fu, Weiye Si, Zhen Huang, Mohan Jiang, Keyu Li, Shijie Xia, Jie Sun, Tianze Xu, Xiangkun Hu, Pengrui Lu, Xiaojie Cai, Lyumanshan Ye, Wenhong Zhu, Yang Xiao, Pengfei Liu

机构 * SJTU(上海交通大学) SII(新加坡理工学院) GAIR(谷歌人工智能研究)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02085 2025-11-04 cs.AI 85%

SE-Agent: Self-Evolution Trajectory Optimization in Multi-Step Reasoning with LLM-Based Agents

Jiaye Lin, Yifu Guo, Yuzhen Han, Sen Hu, Ziyi Ni, Licheng Wang, Mingguang Chen, Hongzhang Liu, Ronghao Chen, Yangfan He, Daxin Jiang, Binxing Jiao, Chen Hu, Huacan Wang

机构 * THU(清华大学) StepFun UofT(多伦多大学) PKU(北京大学) UCAS(中国科学院大学) CASIA(中国科学院自动化研究所) UCR(加州大学尔湾分校) USYD(新南威尔士大学) UMN(明尼苏达大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13908 2025-11-04 cs.CL 85%

Interpreting the Latent Structure of Operator Precedence in Language Models

Dharunish Yugeswardeenoo, Harshil Nukala, Ved Shah, Cole Blondin, Sean O Brien, Vasu Sharma, Kevin Zhu

机构 * Algoverse AI Research(Algoverse AI研究)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL

Comments 11 pages, 6 figures. An earlier version of this work was accepted to CoLM 2024. This is an extended version of our CoLM 2024 paper. Includes additional ablations; added Ved Shah as author for those contributions

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17336 2025-11-04 cs.CR cs.AI 85%

PPMI: Privacy-Preserving LLM Interaction with Socratic Chain-of-Thought Reasoning and Homomorphically Encrypted Vector Databases

Yubeen Bae, Minchan Kim, Jaejin Lee, Sangbum Kim, Jaehyung Kim, Yejin Choi, Niloofar Mireshghallah

机构 * Seoul National University(首尔国立大学) Stanford University(斯坦福大学) NVIDIA(英伟达) University of Washington(华盛顿大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01558 2025-11-04 cs.CL cs.CY 84%

Math anxiety and associative knowledge structure are entwined in psychology students but not in Large Language Models like GPT-3.5 and GPT-4o

Luciana Ciringione, Emma Franchino, Simone Reigl, Isaia D'Onofrio, Anna Serbati, Oleksandra Poquet, Florence Gabriel, Massimo Stella

机构 * Department of Psychology and Cognitive Science, University of Trento(心理学与认知科学系,特伦托大学) CogNosco Lab, Department of Psychology and Cognitive Science, University of Trento(CogNosco实验室,心理学与认知科学系,特伦托大学) Technical University of Munich(慕尼黑技术大学) Munich Data Science Institute(慕尼黑数据科学研究所) Centre for Change and Complexity in Learning, University of South Australia(学习变革与复杂性研究中心,澳大利亚南澳大利亚大学)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01323 2025-11-04 cs.CL cs.AI 84%

DEEPAMBIGQA: Ambiguous Multi-hop Questions for Benchmarking LLM Answer Completeness

Jiabao Ji, Min Li, Priyanshu Kumar, Shiyu Chang, Saloni Potdar

机构 * UCSB(UCSB大学) Apple(苹果公司)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23945 2025-11-04 cs.CL cs.AI 84%

A Closer Look at Bias and Chain-of-Thought Faithfulness of Large (Vision) Language Models

Sriram Balasubramanian, Samyadeep Basu, Soheil Feizi

机构 * Department of Computer Science University of Maryland, College Park(计算机科学系马里兰大学 College Park)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted in EMNLP 2025, 34 pages, 25 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10142 2025-11-04 cs.CL cs.AI 82%

Debiasing LLMs by Masking Unfairness-Driving Attention Heads

Tingxu Han, Wei Song, Ziqi Ding, Ziming Li, Chunrong Fang, Yuekang Li, Dongfang Liu, Zhenyu Chen, Zhenting Wang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01252 2025-11-04 cs.SE 82%

Lares: LLM-driven Code Slice Semantic Search for Patch Presence Testing

Siyuan Li, Yaowen Zheng, Hong Li, Jingdong Guo, Chaopeng Dong, Chunpeng Yan, Weijie Wang, Yimo Ren, Limin Sun, Hongsong Zhu

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01208 2025-11-04 cs.IR 82%

Contextual Relevance and Adaptive Sampling for LLM-Based Document Reranking

Jerry Huang, Siddarth Madala, Cheng Niu, Julia Hockenmaier, Tong Zhang

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00509 2025-11-04 cs.AI cs.CL cs.LG 82%

Recitation over Reasoning: How Cutting-Edge Language Models Can Fail on Elementary School-Level Reasoning Problems?

Kai Yan, Yufei Xu, Zhengyin Du, Xuesong Yao, Zheyu Wang, Xiaowen Guo, Jiecao Chen

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 推理与问题求解 :language model(title);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 24 pages, 3 figures, 13 tables. The paper is accepted at AACL-IJCNLP 2025 (main track), and the latest version adds modifications in camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01203 2025-11-04 cs.LG cs.CL 79%

FEval-TTC: Fair Evaluation Protocol for Test-Time Compute

Pavel Rumiantsev, Soumyasundar Pal, Yingxue Zhang, Mark Coates

机构 * McGill University(麦吉尔大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00202 2025-11-04 cs.SE cs.LG cs.LO 78%

Position: Vibe Coding Needs Vibe Reasoning: Improving Vibe Coding with Formal Verification

Jacqueline Mitchell, Yasser Shaaban

机构 * University of Southern California(南加州大学)

专题命中 推理与问题求解 :language model(abstract,comments);LLM(abstract);large language model(abstract);分类 cs.LG

Comments 7 pages, 3 figures, In Proceedings of the 1st ACM SIGPLAN International Workshop on Language Models and Programming Languages (LMPL'25), October 12-18, 2025, Singapore, Singapore. ACM, New York, NY, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01423 2025-11-04 cs.SE 78%

LLM-Assisted Tool for Joint Generation of Formulas and Functions in Rule-Based Verification of Map Transformations

Ruidi He, Yu Zhang, Meng Zhang, Andreas Rausch

专题命中 推理与问题求解 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01527 2025-11-04 cs.AI 77%

TPS-Bench: Evaluating AI Agents' Tool Planning \& Scheduling Abilities in Compounding Tasks

Hanwen Xu, Xuyao Huang, Yuzhe Liu, Kai Yu, Zhijie Deng

机构 * Shanghai Jiaotong University(上海交通大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00685 2025-11-04 stat.ML cs.LG 77%

SOCRATES: Simulation Optimization with Correlated Replicas and Adaptive Trajectory Evaluations

Haoting Zhang, Haoxian Chen, Donglin Zhan, Hanyang Zhao, Henry Lam, Wenpin Tang, David Yao, Zeyu Zheng

机构 * University of California, Berkeley(加州大学伯克利分校) Columbia University(哥伦比亚大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00125 2025-11-04 cs.SE cs.AI cs.LO cs.PL 77%

Inferring multiple helper Dafny assertions with LLMs

Álvaro Silva, Alexandra Mendes, Ruben Martins

机构 * INESC TEC, Faculty of Engineering, University of Porto(葡萄牙波尔图大学工程学院INESC TEC) Computer Science Department of Carnegie Mellon University(卡内基梅隆大学计算机科学系)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏