arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-28 至 2025-10-28 共收录 412 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 71 篇

2510.23208 2025-10-28 cs.LG cs.AI 84%

Increasing LLM Coding Capabilities through Diverse Synthetic Coding Tasks

Amal Abed, Ivan Lukic, Jörg K. H. Franke, Frank Hutter

机构 * University of Freiburg(弗赖堡大学) ELLIS Institute Tübingen(图宾根ELLIS研究所) Open-Sci Collective(开放科学集体) LAION Prior Labs(Prior实验室)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Presented at the 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: The 4th Deep Learning for Code Workshop (DL4C)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22823 2025-10-28 cs.CL cs.AI 84%

Cross-Lingual Stability and Bias in Instruction-Tuned Language Models for Humanitarian NLP

Poli Nemkova, Amrit Adhikari, Matthew Pearson, Vamsi Krishna Sadu, Mark V. Albert

机构 * University of North Texas(北卡罗来纳大学达顿分校) Davidson College(戴维森学院)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21339 2025-10-28 cs.CL cs.IT cs.LG math.IT 84%

Multi-turn Training with Basic Human Feedback Helps Little on LLM Reasoning

Qiang Liu, Wuganjing Song, Zhenzhou Lin, Feifan Chen, Qiaolong Cai, Chen Li, Yongduo Sui

机构 * Tencent Interactive Entertainment(腾讯互动娱乐) The Hong Kong University of Science and Technology(香港理工大学) Sun Yat-sen University(中山大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21881 2025-10-28 cs.AI cs.CL 84%

GeoThought: A Dataset for Enhancing Mathematical Geometry Reasoning in Vision-Language Models

Nannan Shi, Chuanyu Qin, Shipeng Song, Man Luo

机构 * Baidu Inc.(百度公司) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Intel Lab, Intel(英特尔实验室)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09853 2025-10-28 cs.CL cs.AI math.ST stat.ME stat.TH 82%

Causal Sufficiency and Necessity Improves Chain-of-Thought Reasoning

Xiangning Yu, Zhuohan Wang, Linyi Yang, Haoxuan Li, Anjie Liu, Xiao Xue, Jun Wang, Mengyue Yang

机构 * Tianjin University(天津大学) City University of Hong Kong(香港城市大学) University College London(伦敦大学学院) Peking University(北京大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) University of Bristol(布里斯托大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19143 2025-10-28 cs.LG cs.AI cs.CL 82%

Thought Anchors: Which LLM Reasoning Steps Matter?

Paul C. Bogdan, Uzay Macar, Neel Nanda, Arthur Conmy

机构 * MATS

专题命中 推理与问题求解 :LLM(title);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Paul C. Bogdan and Uzay Macar contributed equally to this work, and their listed order was determined by coinflip. Neel Nanda and Arthur Conmy contributed equally to this work as senior authors, and their listed order was determined by coinflip

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13939 2025-10-28 cs.CV 82%

Med-R1: Reinforcement Learning for Generalizable Medical Reasoning in Vision-Language Models

Yuxiang Lai, Jike Zhong, Ming Li, Shitian Zhao, Yuheng Li, Konstantinos Psounis, Xiaofeng Yang

机构 * Department of Computer Science and Informatics, Emory University(计算机科学与信息学系,埃默里大学) Department of Computer Science and Department of Electrical and Computer Engineering, University of Southern California(计算机科学系和电气与计算机工程系,南加州大学) Department of Computer Science, University of Tokyo(计算机科学系,东京大学) Department of Computer Science, Johns Hopkins University(计算机科学系,约翰霍普金斯大学) Department of Biomedical Engineering, Georgia Institute of Technology and Emory University(生物医学工程系,佐治亚理工学院和埃默里大学)

专题命中 推理与问题求解 :language model(title,abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20014 2025-10-28 cs.CL 81%

Does Rationale Quality Matter? Enhancing Mental Disorder Detection via Selective Reasoning Distillation

Hoyun Song, Huije Lee, Jisu Shin, Sukmin Cho, Changgeon Ko, Jong C. Park

机构 * School of Computing(计算学院) Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);SLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22993 2025-10-28 cs.LG cs.CL 81%

Can Language Models Compose Skills In-Context?

Zidong Liu, Zhuoyan Xu, Zhenmei Shi, Yingyu Liang

机构 * The University of Hong Kong(香港大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22362 2025-10-28 cs.LG cs.CL 81%

Mapping Faithful Reasoning in Language Models

Jiazheng Li, Andreas Damianou, J Rosser, José Luis Redondo García, Konstantina Palla

机构 * King’s College London(伦敦国王学院) Spotify UK(Spotify英国分公司) University of Oxford(牛津大学) Spotify Spain(Spotify西班牙分公司)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.LG

Comments 9 pages, Accepted to the Mechanistic Interpretability Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22255 2025-10-28 cs.AI cs.CL 81%

PACR: Progressively Ascending Confidence Reward for LLM Reasoning

Eunseop Yoon, Hee Suk Yoon, Jaehyun Jang, SooHwan Eom, Qi Dai, Chong Luo, Mark A. Hasegawa-Johnson, Chang D. Yoo

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院) Microsoft Research Asia (MSRA)(微软亚洲研究院) University of Illinois at Urbana-Champaign (UIUC)(伊利诺伊大学厄巴纳-香槟分校)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI

Comments 16 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08221 2025-10-28 cs.LG cs.CL 81%

Part I: Tricks or Traps? A Deep Dive into RL for LLM Reasoning

Zihe Liu, Jiashun Liu, Yancheng He, Weixun Wang, Jiaheng Liu, Ling Pan, Xinyu Hu, Shaopan Xiong, Ju Huang, Jian Hu, Shengyi Huang, Johan Obando-Ceron, Siran Yang, Jiamang Wang, Wenbo Su, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团) Beijing Jiaotong University(北京交通大学) Hong Kong University of Science and Technology(香港理工大学) Nanjing University(南京大学) Peking University(北京大学) OpenRLHF CleanRL Mila

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.LG

Comments 26 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02992 2025-10-28 cs.AI cs.CL 81%

Learning to Better Search with Language Models via Guided Reinforced Self-Training

Seungyong Moon, Bumsoo Park, Hyun Oh Song

机构 * Seoul National University(首尔国立大学) KRAFTON

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01347 2025-10-28 cs.CL cs.LG 81%

The Surprising Effectiveness of Negative Reinforcement in LLM Reasoning

Xinyu Zhu, Mengzhou Xia, Zhepei Wei, Wei-Lin Chen, Danqi Chen, Yu Meng

机构 * Computer Science Department, University of Virginia(弗吉尼亚大学计算机科学系) Princeton Language and Intelligence (PLI), Princeton University(普林斯顿大学语言与智能研究所)

专题命中 推理与问题求解 :LLM(title);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22674 2025-10-28 cs.AI cs.CL cs.LG 80%

QuestBench: Can LLMs ask the right question to acquire information in reasoning tasks?

Belinda Z. Li, Been Kim, Zi Wang

机构 * Massachusetts Institute of Technology(麻省理工学院) Google DeepMind(谷歌DeepMind)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Code and dataset are available at \url{https://github.com/google-deepmind/questbench}

Journal ref 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Track on Datasets and Benchmarks

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18700 2025-10-28 cs.CV cs.AI 79%

GRE Suite: Geo-localization Inference via Fine-Tuned Vision-Language Models and Enhanced Reasoning Chains

Chun Wang, Xiaojun Ye, Xiaoran Pan, Zihao Pan, Haofan Wang, Yiren Song

机构 * Zhejiang University(浙江大学) Sun Yat-sen University(中山大学) NUS(国立大学)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21715 2025-10-28 cs.HC cs.AI cs.CL eess.AS 79%

Beyond IVR Touch-Tones: Customer Intent Routing using LLMs

Sergio Rojas-Galeano

机构 * Facultad de Ingeniería Universidad Distrital Francisco José de Caldas(工程学院乌尔比诺大学弗朗西斯科·乔斯·德·卡拉斯多分校)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted for publication in the Proceedings of the Workshop on Engineering Applications 2025 (WEA 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22978 2025-10-28 cs.HC 78%

Reasoning About Reasoning: Towards Informed and Reflective Use of LLM Reasoning in HCI

Ramaravind Kommiya Mothilal, Sally Zhang, Syed Ishtiaque Ahmed, Shion Guha

专题命中 推理与问题求解 :LLM(title,abstract)

Comments 14 pages, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22838 2025-10-28 cs.CV 78%

Semantic-Preserving Cross-Style Visual Reasoning for Robust Multi-Modal Understanding in Large Vision-Language Models

Aya Nakayama, Brian Wong, Yuji Nishimura, Kaito Tanaka

专题命中 推理与问题求解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21757 2025-10-28 cs.CV 78%

Agro-Consensus: Semantic Self-Consistency in Vision-Language Models for Crop Disease Management in Developing Countries

Mihir Gupta, Pratik Desai, Ross Greer

机构 * The Harker School(哈克尔学校) University of California, Merced(加州大学默塞德分校)

专题命中 推理与问题求解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23566 2025-10-28 cs.CV 78%

Uni-MuMER: Unified Multi-Task Fine-Tuning of Vision-Language Model for Handwritten Mathematical Expression Recognition

Yu Li, Jin Jiang, Jianhua Zhu, Shuai Peng, Baole Wei, Yuxuan Zhou, Liangcai Gao

机构 * Wangxuan Institute of Computer Technology, Peking University(计算机技术研究院,北京大学)

专题命中 推理与问题求解 :language model(title,abstract)

Comments Accepted by NeurIPS 2025 as a spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23474 2025-10-28 cs.AI 77%

Policy-Aware Generative AI for Safe, Auditable Data Access Governance

Shames Al Mandalawi, Muzakkiruddin Ahmed Mohammed, Hendrika Maclean, Mert Can Cakmak, John R. Talburt

机构 * Center for Advanced Research in Entity Resolution and Information Quality (ERIQ)(实体解析与信息质量高级研究中心)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments The 17th International Conference on Knowledge and Systems Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23337 2025-10-28 cs.CL 77%

BaZi-Based Character Simulation Benchmark: Evaluating AI on Temporal and Persona Reasoning

Siyuan Zheng, Pai Liu, Xi Chen, Jizheng Dong, Sihan Jia

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Journal ref WordPlay Workshop 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23077 2025-10-28 cs.IR cs.AI 77%

Think before Recommendation: Autonomous Reasoning-enhanced Recommender

Xiaoyu Kong, Junguang Jiang, Bin Liu, Ziru Xu, Han Zhu, Jian Xu, Bo Zheng, Jiancan Wu, Xiang Wang

机构 * Taobao & Tmall Group of Alibaba, China(阿里巴巴集团淘宝与天猫事业部) National University of Singapore(新加坡国立大学) Institute of Dataspace, Hefei Comprehensive National Science Center(合肥综合国家科学中心数据空间研究院) Shanghai Key Laboratory of Data Science(上海数据科学重点实验室)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments NeurIPS 2025 poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21999 2025-10-28 cs.AI 77%

Foundation of Intelligence: Review of Math Word Problems from Human Cognition Perspective

Zhenya Huang, Jiayu Liu, Xin Lin, Zhiyuan Ma, Shangzi Xue, Tong Xiao, Qi Liu, Yee Whye Teh, Enhong Chen

机构 * Department of Statistics, University of Oxford(统计学系、牛津大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22344 2025-10-28 cs.CL cs.AI cs.IR 76%

FAIR-RAG: Faithful Adaptive Iterative Refinement for Retrieval-Augmented Generation

Mohammad Aghajani Asl, Majid Asgari-Bidhendi, Behrooz Minaei-Bidgoli

机构 * Sharif University of Technology(谢里夫理工大学) Iran University of Science and Technology(伊朗科学技术大学) Noor Avaran Jelvehaye Maanaei Najm Co., Ltd.(诺尔·阿瓦兰·杰拉维耶·马纳埃尼纳姆公司)

专题命中 推理与问题求解 :large language model(abstract,comments);language model(abstract,comments);分类 cs.CL、cs.AI

Comments 30 pages, 5 figures, 5 tables. Keywords: Retrieval-Augmented Generation (RAG), Large Language Models (LLMs), Agentic AI, Multi-hop Question Answering, Faithfulness

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23569 2025-10-28 cs.CV 75%

EgoThinker: Unveiling Egocentric Reasoning with Spatio-Temporal CoT

Baoqi Pei, Yifei Huang, Jilan Xu, Yuping He, Guo Chen, Fei Wu, Yu Qiao, Jiangmiao Pang

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Zhejiang University(浙江大学) The University of Tokyo(东京大学) Fudan University(复旦大学) Nanjing University(南京大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);SFT(abstract)

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22849 2025-10-28 cs.CL cs.AI cs.LG 75%

Once Upon an Input: Reasoning via Per-Instance Program Synthesis

Adam Stein, Neelay Velingker, Mayur Naik, Eric Wong

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at NeurIPS 2025. 34 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14677 2025-10-28 cs.CV 75%

Visionary-R1: Mitigating Shortcuts in Visual Reasoning with Reinforcement Learning

Jiaer Xia, Yuhang Zang, Peng Gao, Sharon Li, Kaiyang Zhou

机构 * Hong Kong Baptist University(香港 Baptist 大学) Shanghai AI Lab(上海人工智能实验室) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22710 2025-10-28 cs.AI 74%

RaCoT: Plug-and-Play Contrastive Example Generation Mechanism for Enhanced LLM Reasoning Reliability

Kaitong Cai, Jusheng Zhang, Yijia Fan, Jing Yang, Keze Wang

专题命中 推理与问题求解 :LLM(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏