arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-30 至 2025-09-30 共收录 95 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 95 篇

2509.23368 2025-09-30 cs.CL cs.AI 91%

MedCritical: Enhancing Medical Reasoning in Small Language Models via Self-Collaborative Correction

Xinchun Su, Chunxu Luo, Yixuan Li, Weidong Yang, Lipeng Ma

机构 * School of Computer Science, Fudan University, Shanghai, China(复旦大学计算机学院)

专题命中 推理与问题求解 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22131 2025-09-30 cs.CL cs.AI 90%

R-Capsule: Compressing High-Level Plans for Efficient Large Language Model Reasoning

Hongyu Shan, Mingyang Song, Chang Dai, Di Liang, Han Chen

机构 * Tianjin University(天津大学) Tencent Hunyuan(腾讯文元) Peking University(北京大学) Fudan University(复旦大学) National Engineering Research Center of Educational Big Data and the Faculty of Artificial Intelligence in Education, Central China Normal University(教育大数据国家工程研究中心和教育人工智能学院,中央财经大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23501 2025-09-30 cs.CL cs.AI 90%

The Impact of Role Design in In-Context Learning for Large Language Models

Hamidreza Rouzegar, Masoud Makrehchi

机构 * Department of Electrical, Computer and Software Engineering(电气、计算机与软件工程系) Ontario Tech University(安大略技术大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Code is available at https://github.com/hrouzegar/Role_Based-In-Context-Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23412 2025-09-30 cs.CL cs.LG 90%

Comparison of Scoring Rationales Between Large Language Models and Human Raters

Haowei Hua, Hong Jiao, Dan Song

机构 * Princeton University(普林斯顿大学) University of Maryland(马里兰大学) University of Iowa(爱荷华大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments 23 Pages, 4 Tables, 13 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24163 2025-09-30 cs.RO 89%

Preference-Based Long-Horizon Robotic Stacking with Multimodal Large Language Models

Wanming Yu, Adrian Röfer, Abhinav Valada, Sethu Vijayakumar

机构 * School of Informatics, University of Edinburgh(信息学院,爱丁堡大学) University of Freiburg(弗赖堡大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22716 2025-09-30 cs.RO 89%

Large Language Models for 3D IC Space Planning

Hung-Ying Chu, Guan-Wei Chen, Shao-Yu Wei, Yu-Cheng Lin

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted at AICCC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24322 2025-09-30 cs.CL 88%

Multimodal Large Language Models Meet Multimodal Emotion Recognition and Reasoning: A Survey

Yuntao Shou, Tao Meng, Wei Ai, Keqin Li

机构 * Central South University of Forestry and Technology(林业科技大学) State University of New York(纽约州立大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 35 pages, 10 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23633 2025-09-30 cs.CL 88%

Fast Thinking for Large Language Models

Haoyu Zheng, Zhuonan Wang, Yuqian Yuan, Tianwei Lin, Wenqiao Zhang, Zheqi Lv, Juncheng Li, Siliang Tang, Yueting Zhuang, Hongyang He

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24405 2025-09-30 cs.CL cs.AI cs.DB cs.ET cs.IR 87%

Multilingual Text-to-SQL: Benchmarking the Limits of Language Models with Collaborative Language Agents

Khanh Trinh Pham, Thu Huong Nguyen, Jun Jo, Quoc Viet Hung Nguyen, Thanh Tam Nguyen

机构 * Griffith University(格里菲斯大学)

专题命中 推理与问题求解 :language agent(title,abstract);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24981 2025-09-30 cs.LG cs.AI 86%

Random Policy Valuation is Enough for LLM Reasoning with Verifiable Rewards

Haoran He, Yuxiao Ye, Qingpeng Cai, Chen Hu, Binxing Jiao, Daxin Jiang, Ling Pan

机构 * Hong Kong University of Science and Technology(香港科学与技术大学) Kuaishou Technology(快手科技) StepFun

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 32 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12948 2025-09-30 cs.LG cs.CL 86%

Probabilistic Soundness Guarantees in LLM Reasoning Chains

Weiqiu You, Anton Xue, Shreya Havaldar, Delip Rao, Helen Jin, Chris Callison-Burch, Eric Wong

机构 * University of Pennsylvania(宾夕法尼亚大学) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments EMNLP 2025 camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24957 2025-09-30 cs.LG 85%

Intra-request branch orchestration for efficient LLM reasoning

Weifan Jiang, Rana Shahout, Yilun Du, Michael Mitzenmacher, Minlan Yu

机构 * Harvard University(哈佛大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24217 2025-09-30 cs.CL 85%

Semi-structured LLM Reasoners Can Be Rigorously Audited

Jixuan Leng, Cassandra A. Cohen, Zhixian Zhang, Chenyan Xiong, William W. Cohen

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22834 2025-09-30 cs.NI cs.AI 85%

Bridging Language Models and Formal Methods for Intent-Driven Optical Network Design

Anis Bekri, Amar Abane, Abdella Battou, Saddek Bensalem

机构 * National Institute of Standards and Technology(美国国家标准技术研究院)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

Comments Accepted at AICCSA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00089 2025-09-30 cs.CY cs.AI 85%

TRAPDOC: Deceiving LLM Users by Injecting Imperceptible Phantom Tokens into Documents

Hyundong Jin, Sicheol Sung, Shinwoo Park, SeungYeop Baik, Yo-Sub Han

机构 * Yonsei University(延世大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15524 2025-09-30 cs.CL cs.AI 85%

IPBench: Benchmarking the Knowledge of Large Language Models in Intellectual Property

Qiyao Wang, Guhong Chen, Hongbo Wang, Huaren Liu, Minghui Zhu, Zhifei Qin, Linwei Li, Yilin Yue, Shiqiang Wang, Jiayan Li, Yihang Wu, Ziqiang Liu, Longze Chen, Run Luo, Liyang Fan, Jiaming Li, Lei Zhang, Kan Xu, Chengming Li, Hamid Alinejad-Rokny, Shiwen Ni, Yuan Lin, Min Yang

机构 * Shenzhen Key Laboratory for High Performance Data Mining, Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences, China(深圳高性能数据挖掘重点实验室,深圳先进技术研究院,中国科学院,中国) University of Chinese Academy of Sciences, China(中国科学院大学,中国) Dalian University of Technology, China(大连理工大学,中国) School of Biomedical Engineering, UNSW Sydney, Australia(生物医学工程学院,新南威尔士大学悉尼分校,澳大利亚) Shenzhen MSU-BIT University, China(深圳MSU-BIT大学,中国) Shenzhen University of Advanced Technology, China(深圳大学先进技术学院,中国)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL、cs.AI

Comments 71 pages, 75 figures, 53 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23674 2025-09-30 cs.AR 85%

AssertGen: Enhancement of LLM-aided Assertion Generation through Cross-Layer Signal Bridging

Hongqin Lyu, Yonghao Wang, Yunlin Du, Mingyu Shi, Zhiteng Chao, Wenxing Li, Tiancheng Wang, Huawei Li

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 6 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15213 2025-09-30 cs.CR 85%

Evil Vizier: Vulnerabilities of LLM-Integrated XR Systems

Yicheng Zhang, Zijian Huang, Sophie Chen, Erfan Shayegani, Jiasi Chen, Nael Abu-Ghazaleh

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24285 2025-09-30 cs.AI cs.CL cs.LG 84%

SCI-Verifier: Scientific Verifier with Thinking

Shenghe Zheng, Chenyu Huang, Fangchen Yu, Junchi Yao, Jingqi Ye, Tao Chen, Yun Luo, Ning Ding, LEI BAI, Ganqu Cui, Peng Ye

机构 * Shanghai AI Laboratory(上海人工智能实验室) Harbin Institute of Technology(哈尔滨工业大学) Fudan University(复旦大学) CUHK(香港中文大学) Tsinghua University(清华大学) CUHK-Shenzhen(香港中文大学深圳校区) UESTC(电子科技大学) USTC(中国科学技术大学)

专题命中 推理与问题求解 :LLM(abstract,comments);large language model(abstract);language model(abstract);post-training(abstract)

Comments This paper focuses on LLM-as-a-Judge, and the project is currently in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23186 2025-09-30 cs.AI cs.LG 84%

Understanding and Enhancing the Planning Capability of Language Models via Multi-Token Prediction

Qimin Zhong, Hao Liao, Siwei Wang, Mingyang Zhou, Xiaoqun Wu, Rui Mao, Wei Chen

机构 * College of Computer Science and Software Engineering, Shenzhen University(计算机科学与软件工程学院,深圳大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07335 2025-09-30 cs.CL cs.AI 84%

Improving LLM Reasoning through Interpretable Role-Playing Steering

Anyi Wang, Dong Shu, Yifan Wang, Yunpu Ma, Mengnan Du

机构 * Center for Information and Language Processing, LMU Munich(信息与语言处理中心,慕尼黑大学) Northwestern University(西北大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML)) New Jersey Institute of Technology(新泽西理工学院)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06952 2025-09-30 cs.CL 83%

On the Same Wavelength? Evaluating Pragmatic Reasoning in Language Models across Broad Concepts

Linlu Qiu, Cedegao E. Zhang, Joshua B. Tenenbaum, Yoon Kim, Roger P. Levy

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) MIT BCS(麻省理工学院脑科学与认知研究中心)

专题命中 推理与问题求解 :language model(title,abstract);prompting(abstract);分类 cs.CL

Comments EMNLP 2025 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15298 2025-09-30 cs.RO cs.CL cs.CV 83%

AgentThink: A Unified Framework for Tool-Augmented Chain-of-Thought Reasoning in Vision-Language Models for Autonomous Driving

Kangan Qian, Sicong Jiang, Yang Zhong, Ziang Luo, Zilin Huang, Tianze Zhu, Kun Jiang, Mengmeng Yang, Zheng Fu, Jinyu Miao, Yining Shi, He Zhe Lim, Li Liu, Tianbao Zhou, Huang Yu, Yifei Hu, Guang Li, Guang Chen, Hao Ye, Lijun Sun, Diange Yang

机构 * School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动学院) McGill University(麦吉尔大学) Automotive and Robotics, Xiaomi Corporation(小米公司汽车与机器人部门) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 推理与问题求解 :language model(title,abstract);SFT(abstract);分类 cs.CL

Comments 19 pages, 8 figures

Journal ref EMNLP2025 Fundings

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13758 2025-09-30 cs.CY 82%

Towards Evaluting Fake Reasoning Bias in Language Models

Qian Wang, Zhenheng Tang, Zhanzhi Lou, Nuo Chen, Wenxuan Wang, Bingsheng He

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15182 2025-09-30 cs.CL cs.AI cs.LG 82%

ReflAct: World-Grounded Decision Making in LLM Agents via Goal-State Reflection

Jeonghye Kim, Sojeong Rhee, Minbeom Kim, Dohyung Kim, Sangmook Lee, Youngchul Sung, Kyomin Jung

机构 * KAIST(韩国科学技术院) Seoul National University(首尔国立大学)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to EMNLP 2025 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24217 2025-09-30 cs.LG cs.NA math.NA 81%

MDD-Thinker: Towards Large Reasoning Models for Major Depressive Disorder Diagnosis

Yuyang Sha, Hongxin Pan, Gang Luo, Caijuan Shi, Jing Wang, Kefeng Li

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23657 2025-09-30 cs.CL 81%

Beyond English-Centric Training: How Reinforcement Learning Improves Cross-Lingual Reasoning in LLMs

Shulin Huang, Yiran Ding, Junshu Pan, Yue Zhang

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);foundation model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23140 2025-09-30 cs.CL 81%

Tagging the Thought: Unlocking Personalization Reasoning via Reinforcement Learning

Song Jin, Juntian Zhang, Yong Liu, Xun Zhang, Yufei Zhang, Fei Jiang, Guojun Yin, Wei Lin, Rui Yan

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Meituan(美团) Wuhan University(武汉大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09736 2025-09-30 cs.CV cs.AI 81%

Revisiting Visual Understanding in Multimodal Reasoning through a Lens of Image Perturbation

Yuting Li, Lai Wei, Kaipeng Zheng, Jingyuan Huang, Guilin Li, Bo Wang, Linghe Kong, Lichao Sun, Weiran Huang

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Shanghai Innovation Institute(上海创新研究院) Zhongguancun Academy(中关村学院) Tencent(腾讯) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) Lehigh University(莱斯大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23924 2025-09-30 cs.CL cs.AI 81%

Taming Masked Diffusion Language Models via Consistency Trajectory Reinforcement Learning with Fewer Decoding Step

Jingyi Yang, Guanxu Chen, Xuhao Hu, Jing Shao

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments 10 pages, 4 figures, 7 tables. Code: https://github.com/yjyddq/EOSER-ASS-RL

详情

展开后加载摘要…

URL PDF HTML 收藏