arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-25 至 2025-08-25 共收录 138 信号源:cs.CL, cs.AI, cs.LG

1. 后训练与偏好优化 5 篇

2508.16379 2025-08-25 cs.IT eess.SP math.IT 75%

Agentic AI Empowered Multi-UAV Trajectory Optimization in Low-Altitude Economy Networks

Feibo Jiang, Li Dong, Xitao Pan, Kezhi Wang, Cunhua Pan

专题命中 后训练与偏好优化 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13622 2025-08-25 cs.AI 70%

Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning

Yulan Hu, Sheng Ouyang, Jinman Zhao, Yong Liu

机构 * Renmin University of China(中国人民大学) Gaoling School of Artificial Intelligence(甘肃学校人工智能学院) University of Toronto(多伦多大学)

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16230 2025-08-25 cs.CV cs.AI 57%

FlexMUSE: Multimodal Unification and Semantics Enhancement Framework with Flexible interaction for Creative Writing

Jiahao Chen, Zhiyong Ma, Wenbiao Du, Qingyuan Chuai

机构 * Cao Tu Li(Guangzhou) Technology Co., Ltd, China(广东曹图利技术有限公司) South China University of Technology, China(华南理工大学)

专题命中 后训练与偏好优化 :preference optimization(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 长上下文与记忆 4 篇

2504.09071 2025-08-25 cs.CL 88%

Exploration of Plan-Guided Summarization for Narrative Texts: the Case of Small Language Models

Matt Grenander, Siddharth Varia, Paula Czarnowska, Yogarshi Vyas, Kishaloy Halder, Bonan Min

机构 * AWS AI Labs(AWS人工智能实验室) School of Informatics, University of Edinburgh(信息学院,爱丁堡大学)

专题命中 长上下文与记忆 :language model(title,abstract);small language model(title,abstract);分类 cs.CL

Comments Accepted to the 7th Workshop on Narrative Understanding (WNU), co-located with NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16568 2025-08-25 cs.LG cs.CV 79%

Closer to Reality: Practical Semi-Supervised Federated Learning for Foundation Model Adaptation

Guangyu Sun, Jingtao Li, Weiming Zhuang, Chen Chen, Chen Chen, Lingjuan Lyu

机构 * Sony AI(索尼人工智能) University of Central Florida(中央佛罗里达大学)

专题命中 长上下文与记忆 :foundation model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15980 2025-08-25 cs.OS 75%

CXLAimPod: CXL Memory is all you need in AI era

Yiwei Yang, Yusheng Zheng, Yiqi Chen, Zheng Liang, Kexin Chu, Zhe Zhou, Andi Quinn, Wei Zhang

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16134 2025-08-25 cs.LG cs.AI 73%

CommonKV: Compressing KV Cache with Cross-layer Parameter Sharing

Yixuan Wang, Haoyu Qiao, Lujun Li, Qingfu Zhu, Wanxiang Che

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 推理与问题求解 20 篇

2502.19954 2025-08-25 cs.CL cs.AI 91%

Collaborative Stance Detection via Small-Large Language Model Consistency Verification

Yu Yan, Sheng Sun, Zixiang Tang, Teli Liu, Min Liu

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) People Public Security University of China(中国人民公安大学) University of Chinese Academy of Sciences(中国科学院大学) Zhongguancun Laboratory(中关村实验室)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);small language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10652 2025-08-25 cs.CL cs.AI cs.CY 91%

Can Large Language Models Simulate Human Responses? A Case Study of Stated Preference Experiments in the Context of Heating-related Choices

Han Wang, Jacek Pawlak, Aruna Sivakumar

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16419 2025-08-25 cs.CL 90%

Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models

Yang Sui, Yu-Neng Chuang, Guanchu Wang, Jiamu Zhang, Tianyi Zhang, Jiayi Yuan, Hongyi Liu, Andrew Wen, Shaochen Zhong, Na Zou, Hanjie Chen, Xia Hu

机构 * Rice University(里士大学) University of Houston(休斯顿大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);small language model(abstract);SFT(abstract)

Comments Accepted by TMLR 2025. Project website: https://github.com/Eclipsess/Awesome-Efficient-Reasoning-LLMs

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15842 2025-08-25 cs.CL cs.LG 86%

Lexical Hints of Accuracy in LLM Reasoning Chains

Arne Vanhoyweghen, Brecht Verbeken, Andres Algaba, Vincent Ginis

机构 * Data Analytics Lab, Vrije Universiteit Brussel(自由大学布鲁塞尔数据分析实验室) School of Engineering and Applied Sciences, Harvard University(哈佛大学工程与应用科学学院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 21 pages, 7 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14879 2025-08-25 cs.GR cs.CV 85%

MeshCoder: LLM-Powered Structured Mesh Code Generation from Point Clouds

Bingquan Dai, Li Ray Luo, Qihong Tang, Jie Wang, Xinyu Lian, Hao Xu, Minghan Qin, Xudong Xu, Bo Dai, Haoqian Wang, Zhaoyang Lyu, Jiangmiao Pang

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Tsinghua University(清华大学) Harbin Institute of Technology(哈尔滨工业大学) Beijing Institute of Technology(北京理工大学) AI Thrust, HKUST(GZ)(AI thrust, 香港科技大学(广州))

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15835 2025-08-25 cs.CL cs.AI 84%

Alvorada-Bench: Can Language Models Solve Brazilian University Entrance Exams?

Henrique Godoy

专题命中 推理与问题求解 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17218 2025-08-25 cs.CL 83%

Prompting Techniques for Reducing Social Bias in LLMs through System 1 and System 2 Cognitive Processes

Mahammed Kamruzzaman, Gene Louis Kim

机构 * Bellini College of AI, Cybersecurity and Computing University of South Florida(人工智能、网络安全与计算学院,佛罗里达州立大学)

专题命中 推理与问题求解 :prompting(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted at RANLP-2025 (main conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16514 2025-08-25 cs.LG cs.AI cs.CL 82%

FLAMES: Improving LLM Math Reasoning via a Fine-Grained Analysis of the Data Synthesis Pipeline

Parker Seegmiller, Kartik Mehta, Soumya Saha, Chenyang Tao, Shereen Oraby, Arpit Gupta, Tagyoung Chung, Mohit Bansal, Nanyun Peng

机构 * Amazon AGI Foundations(亚马逊人工智能基础研究机构) Dartmouth College(达特茅斯学院) UNC Chapel Hill(北卡罗来纳大学教堂山分校) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments To appear at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14295 2025-08-25 cs.LG cs.AI 81%

A Simple "Try Again" Can Elicit Multi-Turn LLM Reasoning

Licheng Liu, Zihan Wang, Linjie Li, Chenwei Xu, Yiping Lu, Han Liu, Avirup Sil, Manling Li

专题命中 推理与问题求解 :LLM(title);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18973 2025-08-25 cs.CL cs.AI cs.LG 80%

A Toolbox, Not a Hammer -- Multi-TAG: Scaling Math Reasoning with Multi-Tool Aggregation

Bohan Yao, Vikas Yadav

机构 * ServiceNow AI University of Washington(华盛顿大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published at EMNLP Findings 2025; 21 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15861 2025-08-25 cs.CL cs.LG 79%

XFinBench: Benchmarking LLMs in Complex Financial Problem Solving and Reasoning

Zhihan Zhang, Yixin Cao, Lizi Liao

机构 * School of Computing and Information Systems, Singapore Management University(计算与信息系统学院,新加坡管理大学) Institute of Trustworthy Embodied AI, Fudan University(可信具身人工智能研究院,复旦大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13082 2025-08-25 cs.SE cs.AI cs.FL 77%

AutoVerus: Automated Proof Generation for Rust Code

Chenyuan Yang, Xuheng Li, Md Rakib Hossain Misu, Jianan Yao, Weidong Cui, Yeyun Gong, Chris Hawblitzel, Shuvendu Lahiri, Jacob R. Lorch, Shuai Lu, Fan Yang, Ziqiao Zhou, Shan Lu

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Columbia University(哥伦比亚大学) University of California Irvine(加州大学尔湾分校) University of Toronto(多伦多大学) Microsoft Research(微软研究院) Microsoft Research Asia(微软亚洲研究院) University of Chicago(芝加哥大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments OOPSLA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10454 2025-08-25 cs.LG cs.AI cs.CL 75%

One Example Shown, Many Concepts Known! Counterexample-Driven Conceptual Reasoning in Mathematical LLMs

Yinghui Li, Jiayi Kuang, Haojing Huang, Zhikun Xu, Xinnian Liang, Yi Yu, Wenlian Lu, Yangning Li, Xiaoyu Tan, Chao Qu, Ying Shen, Hai-Tao Zheng, Philip S. Yu

机构 * Tsinghua University(清华大学) Sun-Yat Sen University(孙中山大学) School of Mathematical Science, Fudan University(复旦大学数学学院) Bytedance Inc.(字节跳动公司) INFLY TECH (Shanghai) Co., Ltd.(INFLY TECH(上海)有限公司) ARC Lab, Arizona State University(ARC实验室,亚利桑那州立大学) University of Illinois Chicago(伊利诺伊大学芝加哥分校) Peng Cheng Laboratory(鹏城实验室) Guangdong Provincial Key Laboratory of Fire Science(广东省消防科学与智能应急技术重点实验室)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21054 2025-08-25 cs.CL cs.AI cs.LG cs.SD eess.AS 75%

Sentiment Reasoning for Healthcare

Khai-Nguyen Nguyen, Khai Le-Duc, Bach Phan Tat, Duy Le, Long Vo-Dang, Truong-Son Hy

机构 * College of William and Mary(威廉与玛丽学院) University of Toronto(多伦多大学) University Health Network(大学健康网络) KU Leuven(鲁汶大学) Bucknell University(巴克内尔大学) University of Cincinnati(辛辛那提大学) University of Alabama at Birmingham(伯明翰大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ACL 2025 Industry Track (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16383 2025-08-25 cs.AI cs.CL cs.CY 73%

GLARE: Agentic Reasoning for Legal Judgment Prediction

Xinyu Yang, Chenlong Deng, Zhicheng Dou

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学北京校区人工智能学院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16077 2025-08-25 cs.HC cs.AI cs.LG 73%

Cooperative Design Optimization through Natural Language Interaction

Ryogo Niwa, Shigeo Yoshida, Yuki Koyama, Yoshitaka Ushiku

机构 * OMRON SINIC X Corporation(OMRON SINIC X公司) The University of Tsukuba(茨口大学) The University of Tokyo(东京大学) National Institute of Advanced Industrial Science and Technology (AIST)(国家先进工业科学与技术研究院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 25 pages, 20 figures, to appear in Proceedings of the 38th Annual ACM Symposium on User Interface Software and Technology (UIST '25), September 28-October 1, 2025, Busan, Republic of Korea

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16148 2025-08-25 cs.IR cs.CL cs.MM 70%

Hierarchical Vision-Language Reasoning for Multimodal Multiple-Choice Question Answering

Ao Zhou, Zebo Gu, Tenghao Sun, Jiawen Chen, Mingsheng Tu, Zifeng Cheng, Yafeng Yin, Zhiwei Jiang, Qing Gu

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Chongqing University of Posts and Telecommunications(重庆邮电大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments This paper has been accepted by ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16213 2025-08-25 cs.CV 67%

MedOmni-45°: A Safety-Performance Benchmark for Reasoning-Oriented LLMs in Medicine

Kaiyuan Ji, Yijin Guo, Zicheng Zhang, Xiangyang Zhu, Yuan Tian, Ning Liu, Guangtao Zhai

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15839 2025-08-25 cs.CR cs.AI 57%

CIA+TA Risk Assessment for AI Reasoning Vulnerabilities

Yuksel Aydin

机构 * Independent Researcher(独立研究者)

专题命中 推理与问题求解 :LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15817 2025-08-25 cs.CL cs.CY 57%

Meet Your New Client: Writing Reports for AI -- Benchmarking Information Loss in Market Research Deliverables

Paul F. Simmering, Benedikt Schulz, Oliver Tabino, Georg Wittenburg

机构 * Agentur für Forschung GmbH(研究机构) Inspirient GmbH(研究机构)

专题命中 推理与问题求解 :LLM(abstract);分类 cs.CL

Comments 16 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 评测与基准 34 篇

2503.24102 2025-08-25 cs.CL 90%

Is Small Language Model the Silver Bullet to Low-Resource Languages Machine Translation?

Yewei Song, Lujun Li, Cedric Lothritz, Saad Ezzini, Lama Sleem, Niccolo Gentile, Radu State, Tegawendé F. Bissyandé, Jacques Klein

专题命中 评测与基准 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15810 2025-08-25 cs.CL cs.AI cs.LG 89%

Detecting Hope, Hate, and Emotion in Arabic Textual Speech and Multi-modal Memes Using Large Language Models

Nouar AlDahoul, Yasir Zaki

机构 * Computer Science Department, New York University Abu Dhabi(纽约大学阿布扎克分校计算机科学系)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 26 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16081 2025-08-25 cs.CL cs.LG 88%

CEQuest: Benchmarking Large Language Models for Construction Estimation

Yanzhao Wu, Lufan Wang, Rui Liu

机构 * Florida International University(佛罗里达国际大学) University of Florida(佛罗里达大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏