arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-16 至 2025-10-16 共收录 175 信号源:cs.CL, cs.AI, cs.LG

1. 后训练与偏好优化 4 篇

2408.03459 2025-10-16 cs.LG 81%

Can DPO Learn Diverse Human Values? A Theoretical Scaling Law

Shawn Im, Sharon Li

机构 * Department of Computer Sciences University of Wisconsin-Madison(计算机科学系威斯康星大学麦迪逊分校)

专题命中 后训练与偏好优化 :LLM(abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13501 2025-10-16 cs.AI 77%

Confidence as a Reward: Transforming LLMs into Reward Models

He Du, Bowen Li, Chengxing Xie, Chang Gao, Kai Chen, Dacheng Tao

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Xidian University(西安电子科技大学) The Chinese University of Hong Kong(香港中文大学) Nanyang Technological University(南洋理工大学)

专题命中 后训练与偏好优化 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 长上下文与记忆 3 篇

2510.13363 2025-10-16 cs.CL 83%

D-SMART: Enhancing LLM Dialogue Consistency via Dynamic Structured Memory And Reasoning Tree

Xiang Lei, Qin Li, Min Zhang, Min Zhang

专题命中 长上下文与记忆 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments 8 pages, 6 figures (main content); 25 pages, 18 figures (total)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13334 2025-10-16 cs.CL 83%

Taming the Fragility of KV Cache Eviction in LLM Inference

Yuan Feng, Haoyu Guo, JunLin Lv, S. Kevin Zhou, Xike Xie

机构 * University of Science and Technology of China(中国科学技术大学) USTC Data Darkness Lab, MIRACLE Center, Suzhou Institute for Advanced Research(数据暗夜实验室、MIRACLE中心、苏州先进研究所)

专题命中 长上下文与记忆 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13276 2025-10-16 cs.CV cs.CL 79%

MMLongCite: A Benchmark for Evaluating Fidelity of Long-Context Vision-Language Models

Keyan Zhou, Zecheng Tang, Lingfeng Ming, Guanghao Zhou, Qiguang Chen, Dan Qiao, Zheming Yang, Libo Qin, Minghui Qiu, Juntao Li, Min Zhang

机构 * Soochow University(苏州大学) ByteDance(字节跳动) Harbin Institute of Technology(哈尔滨工业大学) Central South University(中南大学)

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 推理与问题求解 35 篇

2310.00194 2025-10-16 cs.AI cs.NE 90%

Improving Planning with Large Language Models: A Modular Agentic Architecture

Taylor Webb, Shanka Subhra Mondal, Ida Momennejad

机构 * Princeton University(普林斯顿大学) Microsoft Research(微软研究院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13002 2025-10-16 cs.AI cs.LG 90%

From Narratives to Probabilistic Reasoning: Predicting and Interpreting Drivers' Hazardous Actions in Crashes Using Large Language Model

Boyou Chen, Gerui Xu, Zifei Wang, Huizhong Guo, Ananna Ahmed, Zhaonan Sun, Zhen Hu, Kaihan Zhang, Shan Bao

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06134 2025-10-16 cs.CL 89%

Evaluating and Mitigating Social Bias for Large Language Models in Open-ended Settings

Zhao Liu, Tian Xie, Xueru Zhang

机构 * The Ohio State University(俄亥俄州立大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01340 2025-10-16 cs.CL 88%

The Landscape of Arabic Large Language Models (ALLMs): A New Era for Arabic Language Technology

Shahad Al-Khalifa, Nadir Durrani, Hend Al-Khalifa, Firoj Alam

机构 * is a Researcher at iWAN Research Group, King Saud University(iWAN研究组,国王沙特大学) is a Senior Scientist at Qatar Computing Research Institute(卡塔尔计算研究所) is a Professor at King Saud University(国王沙特大学) Head of iWAN Research Group(iWAN研究组)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted at CACM

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05258 2025-10-16 cs.CV cs.LG 85%

Spatio-Temporal LLM: Reasoning about Environments and Actions

Haozhen Zheng, Beitong Tian, Mingyuan Wu, Zhenggang Tang, Klara Nahrstedt, Alex Schwing

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Code and data are available at https://zoezheng126.github.io/STLLM-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02253 2025-10-16 cs.AI 85%

Scaling LLM Planning: NL2FLOW for Parametric Problem Generation and Rigorous Evaluation

Jungkoo Kang

机构 * IBM Research(IBM研究院) MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 30 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13395 2025-10-16 cs.CL 84%

Doing Things with Words: Rethinking Theory of Mind Simulation in Large Language Models

Agnese Lombardi, Alessandro Lenci

机构 * CoLing Lab, Department of Philology, Literature and Linguistics, University of Pisa(帕尔马大学哲学、文学与语言学系语言实验室)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL

Journal ref roceedings of the Eleventh Italian Conference on Computational Linguistics (CLiC-it 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13886 2025-10-16 cs.CL cs.AI 84%

Investigating the interaction of linguistic and mathematical reasoning in language models using multilingual number puzzles

Antara Raaghavi Bhattacharya, Isabel Papadimitriou, Kathryn Davidson, David Alvarez-Melis

机构 * School of Engineering and Applied Sciences, Harvard University(哈佛大学工程与应用科学学院) Department of Linguistics, Harvard University(哈佛大学语言学系) Kempner Institute for the Study of Natural and Artificial Intelligence at Harvard University(哈佛大学凯普纳自然与人工智能研究 institute)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21908 2025-10-16 cs.LG cs.AI 82%

Reinforcement Learning for Out-of-Distribution Reasoning in LLMs: An Empirical Study on Diagnosis-Related Group Coding

Hanyin Wang, Zhenbang Wu, Gururaj Kolar, Hariprasad Korsapati, Brian Bartlett, Bryan Hull, Jimeng Sun

机构 * School of Computing and Data Science, UIUC(计算与数据科学学院,UIUC) Mayo Clinic Health System(梅奥诊所健康系统) Mayo Clinic Rochester(梅奥诊所罗切斯特分部) Mayo Clinic Phoenix(梅奥诊所凤凰城分部) Carle Illinois College of Medicine, UIUC(Carle伊利诺伊医学院,UIUC)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);pretraining(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22637 2025-10-16 cs.CL cs.AI cs.LG 82%

Variational Reasoning for Language Models

Xiangxin Zhou, Zichen Liu, Haonan Wang, Chao Du, Min Lin, Chongxuan Li, Liang Wang, Tianyu Pang

机构 * Sea AI Lab(海智实验室) UCAS(中国科学院大学) CASIA(中国科学院自动化研究所) NUS(新加坡国立大学) RUC(哈尔滨工业大学)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13214 2025-10-16 cs.AI 81%

Adaptive Reasoning Executor: A Collaborative Agent System for Efficient Reasoning

Zehui Ling, Deshu Chen, Yichi Zhang, Yuchen Liu, Xigui Li, Xin Guo, Yuan Cheng

机构 * Artificial Intelligence Innovation and Incubation Institute, Fudan University(复旦大学人工智能创新与孵化院) School of Data Science, Fudan University(复旦大学数据科学学院) Shanghai Academy of Artificial Intelligence for Science(上海人工智能科学研究院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01656 2025-10-16 cs.LG cs.AI 81%

Asymmetric Proximal Policy Optimization: mini-critics boost LLM reasoning

Jiashun Liu, Johan Obando-Ceron, Han Lu, Yancheng He, Weixun Wang, Wenbo Su, Bo Zheng, Pablo Samuel Castro, Aaron Courville, Ling Pan

机构 * HKUST(香港科技大学) Mila, Université de Montréal(蒙特利尔大学Mila实验室) Alibaba Group(阿里巴巴集团)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13744 2025-10-16 cs.AI cs.CL cs.LG 80%

Hard2Verify: A Step-Level Verification Benchmark for Open-Ended Frontier Math

Shrey Pandit, Austin Xu, Xuan-Phi Nguyen, Yifei Ming, Caiming Xiong, Shafiq Joty

机构 * Salesforce AI Research(Salesforce AI研究)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 21 pages, 8 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02737 2025-10-16 cs.CR cs.AI cs.CL cs.LG 80%

Early Signs of Steganographic Capabilities in Frontier LLMs

Artur Zolkowski, Kei Nishimura-Gasparian, Robert McCarthy, Roland S. Zimmermann, David Lindner

机构 * MATS † ETH Zurich(MATS 伦理与理论学者(ETH 瑞士联邦理工学院)) MATS † University College London(MATS 伦理与理论学者(伦敦大学学院)) Google DeepMind(谷歌DeepMind)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13190 2025-10-16 cs.CL 79%

SHIELD: Classifier-Guided Prompting for Robust and Safer LVLMs

Juan Ren, Mark Dras, Usman Naseem

机构 * School of Computing, Macquarie University(计算机学院,麦考瑞大学)

专题命中 推理与问题求解 :prompting(title);language model(abstract);分类 cs.CL

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13157 2025-10-16 cs.CE cs.AI cs.CL 79%

Program of Thoughts for Financial Reasoning: Leveraging Dynamic In-Context Examples and Generative Retrieval

Subhendu Khatuya, Shashwat Naidu, Pawan Goyal, Niloy Ganguly

机构 * Indian Institute of Technology Kharagpur(印度理工学院卡格鲁分校)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments This work has been accepted for publication in the Main Conference of the Empirical Methods in Natural Language Processing (EMNLP) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13029 2025-10-16 cs.AI 77%

Toward Reasoning-Centric Time-Series Analysis

Xinlei Wang, Mingtian Tan, Jing Qiu, Junhua Zhao, Jinjin Gu

机构 * University of Sydney(悉尼大学) University of Virginia(弗吉尼亚大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shenzhen Institute of Artificial Intelligence and Robotics for Society(深圳人工智能与机器人社会研究院) INSAIT

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04364 2025-10-16 cs.MA cs.CL 77%

Benchmarking LLMs' Swarm intelligence

Kai Ruan, Mowen Huang, Ji-Rong Wen, Hao Sun

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(人工智能学院,中国人民大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14138 2025-10-16 cs.CV cs.AI 77%

ProReason: Multi-Modal Proactive Reasoning with Decoupled Eyesight and Wisdom

Jingqi Zhou, Sheng Wang, Jingwei Dong, Kai Liu, Lei Li, Jiahui Gao, Jiyue Jiang, Lingpeng Kong, Chuan Wu

机构 * The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11052 2025-10-16 cs.CL 74%

Latent Refinement Decoding: Enhancing Diffusion-Based Language Models by Refining Belief States

Qinglin Zhu, Yizhen Yao, Runcong Zhao, Yanzheng Xiang, Amrutha Saseendran, Chen Jin, Philip Teare, Bin Liang, Yulan He, Lin Gui

机构 * King’s College London(伦敦国王学院) The Alan Turing Institute(艾伦·图灵研究所) Centre for AI, Data Science & Artificial Intelligence, BioPharmaceuticals R&D, AstraZeneca(人工智能、数据科学与人工智能研究中心,生物制药研发,阿斯利康) The Chinese University of Hong Kong(香港中文大学) MoE Lab, CUHK(CUHK MoE实验室)

专题命中 推理与问题求解 :language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07312 2025-10-16 cs.LG cs.AI 73%

h1: Bootstrapping LLMs to Reason over Longer Horizons via Reinforcement Learning

Sumeet Ramesh Motwani, Alesia Ivanova, Ziyang Cai, Philip Torr, Riashat Islam, Shital Shah, Christian Schroeder de Witt, Charles London

机构 * University of Oxford(牛津大学) Princeton University(普林斯顿大学) Microsoft AI Frontiers(微软人工智能前沿)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Preprint, 31 pages, 8 figures, long-horizon reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12818 2025-10-16 cs.CL cs.AI cs.CY 73%

MEDEQUALQA: Evaluating Biases in LLMs with Counterfactual Reasoning

Rajarshi Ghosh, Abhay Gupta, Hudson McBride, Anurag Vaidya, Faisal Mahmood

机构 * Lone Star College Algoverse AI Research Empire State University Brigham and Women’s Hospital, Harvard Medical School

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03394 2025-10-16 cs.LG cs.CL 73%

Studying the Korean Word-Chain Game with RLVR: Mitigating Reward Conflicts via Curriculum Learning

Donghwan Rho

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16494 2025-10-16 cs.CL cs.AI 73%

Can an Individual Manipulate the Collective Decisions of Multi-Agents?

Fengyuan Liu, Rui Zhao, Shuo Chen, Guohao Li, Philip Torr, Lei Han, Jindong Gu

机构 * Tencent Robotics X(腾讯机器人实验室) University of Oxford(牛津大学) LMU Munich(慕尼黑大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Konrad Zuse School of Excellence in Reliable AI (relAI)(康拉德·祖斯卓越人工智能学校)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17365 2025-10-16 cs.LG cs.AI 73%

DynaSearcher: Dynamic Knowledge Graph Augmented Search Agent via Multi-Reward Reinforcement Learning

Chuzhan Hao, Wenfeng Feng, Yuewei Zhang, Hao Wang

机构 * Alibaba Cloud Computing(阿里巴巴云 computing)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 12 pages, 3 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏