arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-07-28 至 2025-07-28 共收录 112 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 23 篇

2507.19427 2025-07-28 cs.LG cs.AI 79%

Step-3 is Large yet Affordable: Model-system Co-design for Cost-effective Decoding

StepFun, :, Bin Wang, Bojun Wang, Changyi Wan, Guanzhe Huang, Hanpeng Hu, Haonan Jia, Hao Nie, Mingliang Li, Nuo Chen, Siyu Chen, Song Yuan, Wuxun Xie, Xiaoniu Song, Xing Chen, Xingping Yang, Xuelin Zhang, Yanbo Yu, Yaoyu Wang, Yibo Zhu, Yimin Jiang, Yu Zhou, Yuanwei Lu, Houyi Li, Jingcheng Hu, Ka Man Lo, Ailin Huang, Binxing Jiao, Bo Li, Boyu Chen, Changxin Miao, Chang Lou, Chen Hu, Chen Xu, Chenfeng Yu, Chengyuan Yao, Daokuan Lv, Dapeng Shi, Deshan Sun, Ding Huang, Dingyuan Hu, Dongqing Pang, Enle Liu, Fajie Zhang, Fanqi Wan, Gulin Yan, Han Zhang, Han Zhou, Hanghao Wu, Hangyu Guo, Hanqi Chen, Hanshan Zhang, Hao Wu, Haocheng Zhang, Haolong Yan, Haoran Lv, Haoran Wei, Hebin Zhou, Heng Wang, Heng Wang, Hongxin Li, Hongyu Zhou, Hongyuan Wang, Huiyong Guo, Jia Wang, Jiahao Gong, Jialing Xie, Jian Zhou, Jianjian Sun, Jiaoren Wu, Jiaran Zhang, Jiayu Liu, Jie Cheng, Jie Luo, Jie Yan, Jie Yang, Jieyi Hou, Jinguang Zhang, Jinlan Cao, Jisheng Yin, Junfeng Liu, Junhao Huang, Junzhe Lin, Kaijun Tan, Kaixiang Li, Kang An, Kangheng Lin, Kenkun Liu, Lei Yang, Liang Zhao, Liangyu Chen, Lieyu Shi, Liguo Tan, Lin Lin, Lin Zhang, Lina Chen, Liwen Huang, Liying Shi, Longlong Gu, Mei Chen, Mengqiang Ren, Ming Li, Mingzhe Chen, Na Wang, Nan Wu, Qi Han, Qian Zhao, Qiang Zhang, Qianni Liu, Qiaohui Chen, Qiling Wu, Qinglin He, Qinyuan Tan, Qiufeng Wang, Qiuping Wu, Qiuyan Liang, Quan Sun, Rui Li, Ruihang Miao, Ruosi Wan, Ruyan Guo, Shangwu Zhong, Shaoliang Pang, Shengjie Fan, Shijie Shang, Shilei Jiang, Shiliang Yang, Shiming Hao, Shuli Gao, Siming Huang, Siqi Liu, Tiancheng Cao, Tianhao Cheng, Tianhao Peng, Wang You, Wei Ji, Wen Sun, Wenjin Deng, Wenqing He, Wenzhen Zheng, Xi Chen, Xiangwen Kong, Xianzhen Luo, Xiaobo Yang, Xiaojia Liu, Xiaoxiao Ren, Xin Han, Xin Li, Xin Wu, Xu Zhao, Yanan Wei, Yang Li, Yangguang Li, Yangshijie Xu, Yanming Xu, Yaqiang Shi, Yeqing Shen, Yi Yang, Yifei Yang, Yifeng Gong, Yihan Chen, Yijing Yang, Yinmin Zhang, Yizhuang Zhou, Yuanhao Ding, Yuantao Fan, Yuanzhen Yang, Yuchu Luo, Yue Peng, Yufan Lu, Yuhang Deng, Yuhe Yin, Yujie Liu, Yukun Chen, Yuling Zhao, Yun Mou, Yunlong Li, Yunzhou Ju, Yusheng Li, Yuxiang Yang, Yuxiang Zhang, Yuyang Chen, Zejia Weng, Zhe Xie, Zheng Ge, Zheng Gong, Zhenyi Lu, Zhewei Huang, Zhichao Chang, Zhiguo Huang, Zhirui Wang, Zidong Yang, Zili Wang, Ziqi Wang, Zixin Zhang, Binxing Jiao, Daxin Jiang, Heung-Yeung Shum, Xiangyu Zhang

机构 * StepFun Inc(StepFun公司)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18997 2025-07-28 cs.CV 78%

UPP: Unified Point-Level Prompting for Robust Point Cloud Analysis

Zixiang Ai, Zhenyu Cui, Yuxin Peng, Jiahuan Zhou

机构 * Wangxuan Institute of Computer Technology, Peking University(计算机技术研究院,北京大学)

专题命中 效率与部署 :prompting(title,abstract)

Comments Accepted by ICCV 2025 as a Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16229 2025-07-28 cs.AI cs.CY cs.ET cs.HC cs.SE 77%

Voice-based AI Agents: Filling the Economic Gaps in Digital Health Delivery

Bo Wen, Chen Wang, Qiwei Han, Raquel Norel, Julia Liu, Thaddeus Stappenbeck, Jeffrey L. Rogers

机构 * 1 Digital Health, IBM T.J. Watson Research Center, Yorktown Heights, NY USA 2 AI Cloud Platform, IBM T.J. Watson Research Center, Yorktown Heights, NY USA 3 Nova School of Business Economics, Carcavelos, Portugal 4 Gastroenterology, Morehouse School of Medicine, Atlanta, GA USA 5 Inflammation

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments IEEE International Conference on Digital Health (ICDH) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14641 2025-07-28 cs.SE cs.SY eess.SY 75%

HLSTester: Efficient Testing of Behavioral Discrepancies with LLMs for High-Level Synthesis

Kangwei Xu, Bing Li, Grace Li Zhang, Ulf Schlichtmann

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Comments arXiv admin note: text overlap with arXiv:2407.03889

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10519 2025-07-28 cs.AI cs.CL cs.LG cs.MA 75%

Toward Super Agent System with Hybrid AI Routers

Yuhang Yao, Haixin Wang, Yibo Chen, Jiawen Wang, Min Chang Jordan Ren, Bosheng Ding, Salman Avestimehr, Chaoyang He

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19017 2025-07-28 cs.LG cs.AI 73%

MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster

Laingjun Feng, Chenyi Pan, Xinjie Guo, Fei Mei, Benzhe Ning, Jianxiang Zhang, Xinyang Liu, Beirong Zhou, Zeng Shu, Chang Liu, Guang Yang, Zhenyu Han, Jiangben Wang, Bo Wang

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18910 2025-07-28 cs.CL cs.LG 73%

A Systematic Review of Key Retrieval-Augmented Generation (RAG) Systems: Progress, Gaps, and Future Directions

Agada Joseph Oche, Ademola Glory Folashade, Tirthankar Ghosal, Arpan Biswas

机构 * Bredesen Center for Interdisciplinary Research, University of Tennessee, Knoxville, USA(跨学科研究中心,田纳西大学,肯塔基州 Knoxville) National Center for Computational Sciences, Oak Ridge National Laboratory, Oak Ridge, USA(计算科学国家中心,橡树岭国家实验室,橡树岭) University of Tennessee-Oak Ridge Innovation Institute, University of Tennessee, Knoxville, USA(田纳西大学橡树岭创新研究所,田纳西大学,肯塔基州 Knoxville)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 33 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18377 2025-07-28 cs.LG cs.AI 73%

Maximum Redundancy Pruning: A Principle-Driven Layerwise Sparsity Allocation for LLMs

Chang Gao, Kang Zhao, Runqi Wang, Jianfei Chen, Liping Jing

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19227 2025-07-28 cs.CL 70%

Jailbreaking Large Language Diffusion Models: Revealing Hidden Safety Flaws in Diffusion-Based Text Generation

Yuanhe Zhang, Fangzhou Xie, Zhenhong Zhou, Zherui Li, Hao Chen, Kun Wang, Yufei Guo

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14554 2025-07-28 cs.SE 67%

Emerging Trends in Software Architecture from the Practitioners Perspective: A Five Year Review

Ruoyu Su, Noman Ahmad, Matteo Esposito, Andrea Janes, Davide Taibi, Valentina Lenarduzzi

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19372 2025-07-28 cs.AI cs.LG 62%

Learning neuro-symbolic convergent term rewriting systems

Flavio Petruzzellis, Alberto Testolin, Alessandro Sperduti

机构 * Department One(部门一) Department Two(部门二) Department of Mathematics, University of Padova(帕多瓦大学数学系) Department of General Psychology, University of Padova(帕多瓦大学普通心理学系) Augmented Intelligence Center, Fondazione Bruno Kessler(布鲁诺·凯塞勒基金会增强智能中心)

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

Comments 48 pages, 31 figures. Submitted for review by Artificial Intelligence Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18742 2025-07-28 cs.CL cs.AI 62%

Specification Self-Correction: Mitigating In-Context Reward Hacking Through Test-Time Refinement

Víctor Gallego

机构 * Komorebi AI Technologies(Komorebi人工智能技术)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to SCALR Workshop @ COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19131 2025-07-28 cs.CV 50%

MixA-Q: Revisiting Activation Sparsity for Vision Transformers from a Mixed-Precision Quantization Perspective

Weitian Wang, Rai Shubham, Cecilia De La Parra, Akash Kumar

机构 * Robert Bosch GmbH(博世公司) Ruhr University Bochum(博尔塔尔大学波恩)

专题命中 效率与部署 :post-training(abstract)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15300 2025-07-28 cs.AR 50%

GCC: A 3DGS Inference Architecture with Gaussian-Wise and Cross-Stage Conditional Processing

Minnan Pei, Gang Li, Junwen Si, Zeyu Zhu, Zitao Mo, Peisong Wang, Zhuoran Song, Xiaoyao Liang, Jian Cheng

专题命中 效率与部署 :prompting(abstract)

Comments Accepted to MICRO 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 15 篇

2503.06512 2025-07-28 cond-mat.mtrl-sci 91%

LLM-Feynman: Leveraging Large Language Models for Universal Scientific Formula and Theory Discovery

Zhilong Song, Qionghua Zhou, Chunjin Ren, Chongyi Ling, Minggang Ju, Jinlan Wang

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18380 2025-07-28 cs.AI cs.LG 86%

RedactOR: An LLM-Powered Framework for Automatic Clinical Data De-Identification

Praphul Singh, Charlotte Dzialo, Jangwon Kim, Sumana Srivatsa, Irfan Bulu, Sri Gadde, Krishnaram Kenthapadi

机构 * Oracle Health & AI(Oracle健康与人工智能)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to ACL 2025 Industry Track. To appear

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18949 2025-07-28 cs.CY cs.CL 85%

Adaptive Learning Systems: Personalized Curriculum Design Using LLM-Powered Analytics

Yongjie Li, Ruilin Nong, Jianan Liu, Lucas Evans

机构 * University of Utah(犹他大学) Tianjin University(天津大学) University of Pennsylvania(宾夕法尼亚大学) Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19254 2025-07-28 cs.DB 85%

DBMS-LLM Integration Strategies in Industrial and Business Applications: Current Status and Future Challenges

Zhengtong Yan, Gongsheng Yuan, Qingsong Guo, Jiaheng Lu

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05157 2025-07-28 cs.CL 79%

Ensemble Debiasing Across Class and Sample Levels for Fairer Prompting Accuracy

Ruixi Lin, Ziqiao Wang, Yang You

机构 * Department of Computer Science(计算机科学系) National University of Singapore(新加坡国立大学)

专题命中 领域大模型 :prompting(title);language model(abstract);分类 cs.CL

Comments Published as a conference paper at COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13470 2025-07-28 cs.CL 79%

How Important is Domain Specificity in Language Models and Instruction Finetuning for Biomedical Relation Extraction?

Aviv Brokman, Ramakanth Kavuluru

机构 * University of Kentucky, Lexington, KY USA(肯塔基大学)

专题命中 领域大模型 :language model(title,abstract);分类 cs.CL

Comments A version of this paper has appeared in the proceedings of NLDB 2025 with a slightly different title. The corresponding DOI is also listed below in the metadata

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19062 2025-07-28 cs.SD eess.AS 78%

From Continuous to Discrete: Cross-Domain Collaborative General Speech Enhancement via Hierarchical Language Models

Zhaoxi Mu, Rilin Chen, Andong Li, Meng Yu, Xinyu Yang, Dong Yu

机构 * Xi'an Jiaotong University(西安交通大学) Tencent AI Lab(腾讯AI实验室) Institute of Acoustics, Chinese Academy of Sciences(中国科学院声学研究所)

专题命中 领域大模型 :language model(title,abstract)

Comments ACMMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19011 2025-07-28 q-bio.BM 78%

PKAG-DDI: Pairwise Knowledge-Augmented Language Model for Drug-Drug Interaction Event Text Generation

Ziyan Wang, Zhankun Xiong, Feng Huang, Wen Zhang

专题命中 领域大模型 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19303 2025-07-28 cs.CL 77%

Identifying Fine-grained Forms of Populism in Political Discourse: A Case Study on Donald Trump's Presidential Campaigns

Ilias Chalkidis, Stephanie Brandl, Paris Aslanidis

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19340 2025-07-28 eess.SY cs.SY 75%

Adaptive Self-Improvement for Smarter Energy Systems using Agentic Policy Search

Alexander Sommer, Peter Bazan, Behnam Babaeian, Jonathan Fellerer, Warren B. Powell, Reinhard German

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21019 2025-07-28 cs.CL cs.AI 73%

Kill two birds with one stone: generalized and robust AI-generated text detection via dynamic perturbations

Yinghan Zhou, Juan Wen, Wanli Peng, Yiming Xue, Ziwei Zhang, Zhengxian Wu

机构 * China Agricultural University(中国农业大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by NAACL 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.08423 2025-07-28 cs.LG physics.comp-ph 70%

Artificial Intelligence for Science in Quantum, Atomistic, and Continuum Systems

Xuan Zhang, Limei Wang, Jacob Helwig, Youzhi Luo, Cong Fu, Yaochen Xie, Meng Liu, Yuchao Lin, Zhao Xu, Keqiang Yan, Keir Adams, Maurice Weiler, Xiner Li, Tianfan Fu, Yucheng Wang, Alex Strasser, Haiyang Yu, YuQing Xie, Xiang Fu, Shenglong Xu, Yi Liu, Yuanqi Du, Alexandra Saxton, Hongyi Ling, Hannah Lawrence, Hannes Stärk, Shurui Gui, Carl Edwards, Nicholas Gao, Adriana Ladera, Tailin Wu, Elyssa F. Hofgard, Aria Mansouri Tehrani, Rui Wang, Ameya Daigavane, Montgomery Bohde, Jerry Kurtin, Qian Huang, Tuong Phung, Minkai Xu, Chaitanya K. Joshi, Simon V. Mathis, Kamyar Azizzadenesheli, Ada Fang, Alán Aspuru-Guzik, Erik Bekkers, Michael Bronstein, Marinka Zitnik, Anima Anandkumar, Stefano Ermon, Pietro Liò, Rose Yu, Stephan Günnemann, Jure Leskovec, Heng Ji, Jimeng Sun, Regina Barzilay, Tommi Jaakkola, Connor W. Coley, Xiaoning Qian, Xiaofeng Qian, Tess Smidt, Shuiwang Ji

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Published in Foundations and Trends in Machine Learning. Identical to the journal version except for formatting

Journal ref Foundations and Trends in Machine Learning: Vol. 18: No. 4, pp 385-912 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17841 2025-07-28 physics.soc-ph cond-mat.stat-mech cs.IT math.IT physics.ed-ph 67%

Quantifying interdisciplinary synergy in higher STEM education

Gahyoun Gim, Jinhyuk Yun, Sang Hoon Lee

专题命中 领域大模型 :large language model(abstract);language model(abstract)

Comments 24 pages, 9 figures, 3 supplementary tables

Journal ref EPJ Data Sci. 14, 56 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20719 2025-07-28 cs.LG cs.AI 62%

Generating Clinically Realistic EHR Data via a Hierarchy- and Semantics-Guided Transformer

Guanglin Zhou, Sebastiano Barbieri

机构 * University of Queensland(昆士兰大学)

专题命中 领域大模型 :language model(abstract);分类 cs.AI、cs.LG

Comments The camera ready version for ECAI-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19155 2025-07-28 eess.IV 50%

RegScore: Scoring Systems for Regression Tasks

Michal K. Grzeszczyk, Tomasz Szczepański, Pawel Renc, Siyeop Yoon, Jerome Charton, Tomasz Trzciński, Arkadiusz Sitek

专题命中 领域大模型 :pretraining(abstract)

Comments Accepted for the 28th International Conference on Medical Image Computing and Computer Assisted Intervention (MICCAI) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 知识编辑与模型理解 4 篇

2507.19156 2025-07-28 cs.CL cs.AI cs.CY cs.HC 90%

An Empirical Investigation of Gender Stereotype Representation in Large Language Models: The Italian Case

Gioele Giachino, Marco Rondina, Antonio Vetrò, Riccardo Coppola, Juan Carlos De Martin

机构 * Politecnico di Torino(都灵理工大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 16 pages, European Conference on Machine Learning and Principles and Practice of Knowledge Discovery in Databases (ECML PKDD 2025) - 5th Workshop on Bias and Fairness in AI (BIAS25)

详情

展开后加载摘要…

URL PDF HTML 收藏