arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-27 至 2025-10-27 共收录 36 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 36 篇

2510.21258 2025-10-27 cs.CL cs.AI nlin.CD 90%

Correlation Dimension of Auto-Regressive Large Language Models

Xin Du, Kumiko Tanaka-Ishii

机构 * Waseda University(早稻田大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02720 2025-10-27 cs.AI cs.CL 88%

LocalGPT: Benchmarking and Advancing Large Language Models for Local Life Services in Meituan

Xiaochong Lan, Jie Feng, Jiahuan Lei, Xinlei Shi, Yong Li

机构 * Department of Electronic\ , BNRist,\ University Beijing, China Department of Electronic\ , BNRist,\ University

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21604 2025-10-27 cs.CL 88%

RETuning: Upgrading Inference-Time Scaling for Stock Movement Prediction with Large Language Models

Xueyuan Lin, Cehao Yang, Ye Ma, Ming Li, Rongjunchen Zhang, Yang Ni, Xiaojun Wu, Chengjin Xu, Jian Guo, Hui Xiong

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) IDEA Research(IDEA研究院) Hithink RoyalFlush Information Network Co., Ltd(慧思皇家Flush信息网络有限公司) DataArc Tech Ltd(DataArc科技有限公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01420 2025-10-27 cs.CL cs.LG 88%

Self-Refining Language Model Anonymizers via Adversarial Distillation

Kyuyoung Kim, Hyunjun Jeon, Jinwoo Shin

机构 * KAIST AI(韩国科学技术院人工智能研究所)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);small language model(abstract)

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21425 2025-10-27 cs.AI 86%

Advancing Symbolic Integration in Large Language Models: Beyond Conventional Neurosymbolic AI

Maneeha Rani, Bhupesh Kumar Mishra, Dhavalkumar Thakker

机构 * Data Science, AI & Modelling Centre (DAIM)(数据科学、人工智能与建模中心) School of Digital and Physical Sciences(数字与物理科学学院) University of Hull(霍尔大学)

专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19947 2025-10-27 cs.LG cs.AI cs.SY eess.SY 86%

MESS+: Dynamically Learned Inference-Time LLM Routing in Model Zoos with Service Level Guarantees

Herbert Woisetschläger, Ryan Zhang, Shiqiang Wang, Hans-Arno Jacobsen

机构 * Technical University of Munich(慕尼黑技术大学) Horace Greeley High School(霍雷肖·格里利高中) IBM Research(IBM研究院) University of Toronto(多伦多大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2025. Code: https://github.com/laminair/mess-plus

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18789 2025-10-27 cs.DC cs.CL cs.LG 86%

FlexLLM: Token-Level Co-Serving of LLM Inference and Finetuning with SLO Guarantees

Gabriele Oliaro, Xupeng Miao, Xinhao Cheng, Vineeth Kada, Mengdi Wu, Ruohan Gao, Yingyi Huang, Remi Delacourt, April Yang, Yingcheng Wang, Colin Unger, Zhihao Jia

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments NSDI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13665 2025-10-27 cs.LG cs.AI 84%

Axial Neural Networks for Dimension-Free Foundation Models

Hyunsu Kim, Jonggeon Park, Joan Bruna, Hongseok Yang, Juho Lee

机构 * KAIST(韩国科学技术院) New York University(纽约大学)

专题命中 效率与部署 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

Journal ref NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21184 2025-10-27 cs.LG cs.AI cs.CL stat.ML 82%

Reducing the Probability of Undesirable Outputs in Language Models Using Probabilistic Inference

Stephen Zhao, Aidan Li, Rob Brekelmans, Roger Grosse

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01637 2025-10-27 cs.CL cs.LG 81%

Scaling Embedding Layers in Language Models

Da Yu, Edith Cohen, Badih Ghazi, Yangsibo Huang, Pritish Kamath, Ravi Kumar, Daogao Liu, Chiyuan Zhang

机构 * Google(谷歌)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments NeurIPS 2025 camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17495 2025-10-27 cs.LG cs.AI cs.CL 80%

ProxySPEX: Inference-Efficient Interpretability via Sparse Feature Interactions in LLMs

Landon Butler, Abhineet Agarwal, Justin Singh Kang, Yigit Efe Erginbas, Bin Yu, Kannan Ramchandran

机构 * Department of EECS UC Berkeley(电子工程与计算机科学系,伯克利大学) Department of Statistics UC Berkeley(统计学系,伯克利大学) Departments of Statistics and EECS UC Berkeley(统计学系和电子工程与计算机科学系,伯克利大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Algorithm available at: https://github.com/mmschlk/shapiq

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18522 2025-10-27 cs.CL 79%

How Does Sequence Modeling Architecture Influence Base Capabilities of Pre-trained Language Models? Exploring Key Architecture Design Principles to Avoid Base Capabilities Degradation

Xin Lu, Yanyan Zhao, Si Wei, Shijin Wang, Bing Qin, Ting Liu

机构 * Research Center for Social Computing and Interactive Robotics(社会计算与交互机器人研究中心) Harbin Institute of Technology(哈尔滨工业大学) iFLYTEK Co., Ltd(iFLYTEK公司)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13866 2025-10-27 cs.CL 79%

Reasoning Path Compression: Compressing Generation Trajectories for Efficient LLM Reasoning

Jiwon Song, Dongwon Jo, Yulhwa Kim, Jae-Joon Kim

机构 * Seoul National University(首尔国立大学) Sungkyunkwan University(成均馆大学)

专题命中 效率与部署 :LLM(title);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13181 2025-10-27 cs.CL cs.SD eess.AS 79%

Efficient Speech Language Modeling via Energy Distance in Continuous Latent Space

Zhengrui Ma, Yang Feng, Chenze Shao, Fandong Meng, Jie Zhou, Min Zhang

机构 * Key Laboratory of Intelligent Information Processing Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所智能信息处理重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Pattern Recognition Center, WeChat AI, Tencent Inc(腾讯人工智能研究院模式识别中心) School of Future Science and Engineering, Soochow University(苏州大学未来科学与工程学院)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

Comments NeurIPS 2025; Demos and code are available at https://github.com/ictnlp/SLED-TTS

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01084 2025-10-27 cs.CL cs.LG 79%

zip2zip: Inference-Time Adaptive Tokenization via Online Compression

Saibo Geng, Nathan Ranchin, Yunzhen yao, Maxime Peyrard, Chris Wendler, Michael Gastpar, Robert West

机构 * EPFL(瑞士联邦理工学院) Northeastern University(东北大学) Université Grenoble Alpes(格勒诺布尔阿尔卑斯大学) CNRS(法国国家科学研究中心) Grenoble INP(格勒诺布尔INP) LIG(图灵研究所)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21606 2025-10-27 cs.CV 78%

Modest-Align: Data-Efficient Alignment for Vision-Language Models

Jiaxiang Liu, Yuan Wang, Jiawei Du, Joey Tianyi Zhou, Mingkun Xu, Zuozhu Liu

机构 * Guangdong Institute of Intelligence Science and Technology(广东智能科学与技术研究院) ZJU-Angelalign R&D Center for Intelligence Healthcare(浙大天使align智能医疗研发中心) Centre for Frontier AI Research (CFAR)(前沿人工智能研究中心) Agency for Science, Technology and Research (A*STAR)(科技研究局) Institute of High Performance Computing (IHPC)(高性能计算研究所)

专题命中 效率与部署 :language model(title);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13254 2025-10-27 cs.CL 77%

HeteroSpec: Leveraging Contextual Heterogeneity for Efficient Speculative Decoding

Siran Liu, Yang Ye, Qianchao Zhu, Zane Cao, Yongchao He

机构 * Peking University(北京大学) SCITIX (SGP) TECH PTE. LTD.(SCITIX(SGP)技术有限公司)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20930 2025-10-27 cs.CR cs.AI 77%

Security Logs to ATT&CK Insights: Leveraging LLMs for High-Level Threat Understanding and Cognitive Trait Inference

Soham Hans, Stacy Marsella, Sophia Hirschmann, Nikolos Gurney

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01957 2025-10-27 cs.CV cs.SD eess.AS 75%

VITA-1.5: Towards GPT-4o Level Real-Time Vision and Speech Interaction

Chaoyou Fu, Haojia Lin, Xiong Wang, Yi-Fan Zhang, Yunhang Shen, Xiaoyu Liu, Haoyu Cao, Zuwei Long, Heting Gao, Ke Li, Long Ma, Xiawu Zheng, Rongrong Ji, Xing Sun, Caifeng Shan, Ran He

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院) Tencent Youtu Lab(腾讯优图实验室) XMU(厦门大学) CASIA(中国科学院自动化研究所)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Comments NeurIPS 2025 Spotlight, Code 2.4K Stars: https://github.com/VITA-MLLM/VITA

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01508 2025-10-27 cs.CL cs.LG 73%

Disentangling Latent Shifts of In-Context Learning with Weak Supervision

Josip Jukić, Jan Šnajder

机构 * TakeLab Faculty of Electrical Engineering and Computing University of Zagreb(TakeLab 电子工程与计算学院 霍尔扎布大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20878 2025-10-27 cs.LG cs.AI 73%

HA-RAG: Hotness-Aware RAG Acceleration via Mixed Precision and Data Placement

Danying Ge, Jianhua Gao, Yixue Yang, Weixing Ji

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 13 pages,16 figures,2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06278 2025-10-27 cs.LG cs.AI 73%

Distillation Robustifies Unlearning

Bruce W. Lee, Addie Foote, Alex Infanger, Leni Shor, Harish Kamath, Jacob Goldman-Wetzler, Bryce Woodworth, Alex Cloud, Alexander Matt Turner

机构 * University of Pennsylvania(宾夕法尼亚大学) Massachusetts Institute of Technology(麻省理工学院) Brown University(布朗大学)

专题命中 效率与部署 :LLM(abstract);pretraining(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2025 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19949 2025-10-27 cs.AI 70%

Surfer 2: The Next Generation of Cross-Platform Computer Use Agents

Mathieu Andreux, Märt Bakler, Yanael Barbier, Hamza Benchekroun, Emilien Biré, Antoine Bonnet, Riaz Bordie, Nathan Bout, Matthias Brunel, Aleix Cambray, Pierre-Louis Cedoz, Antoine Chassang, Gautier Cloix, Ethan Connelly, Alexandra Constantinou, Ramzi De Coster, Hubert de la Jonquiere, Aurélien Delfosse, Maxime Delpit, Alexis Deprez, Augustin Derupti, Mathieu Diaz, Shannon D'Souza, Julie Dujardin, Abai Edmund, Michael Eickenberg, Armand Fatalot, Wissem Felissi, Isaac Herring, Xavier Koegler, Erwan Le Jumeau de Kergaradec, Aurélien Lac, Maxime Langevin, Corentin Lauverjat, Antonio Loison, Avshalom Manevich, Axel Moyal, Axel Nguyen Kerbel, Marinela Parovic, Julien Revelle, Guillaume Richard, Mats Richter, Ronan Riochet, María Santos, Romain Savidan, Laurent Sifre, Maxime Theillard, Marc Thibault, Ivan Valentini, Tony Wu, Laura Yie, Kai Yuan, Jevgenij Zubovskij

专题命中 效率与部署 :language model(abstract);foundation model(abstract);分类 cs.AI

Comments 21 pages, 9 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07851 2025-10-27 cs.CL 70%

Learning to Focus: Causal Attention Distillation via Gradient-Guided Token Pruning

Yiju Guo, Wenkai Yang, Zexu Sun, Ning Ding, Zhiyuan Liu, Yankai Lin

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at NeurIPS 2025, camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10116 2025-10-27 cs.LG cs.SI 70%

Preference-driven Knowledge Distillation for Few-shot Node Classification

Xing Wei, Chunchun Chen, Rui Fan, Xiaofeng Cao, Sourav Medya, Wei Ye

机构 * College of Electronic and Information Engineering, Tongji University, China(同济大学电子与信息学院) Shanghai Research Institute for Intelligent Autonomous Systems, Tongji University, China(上海智能自主系统研究院) National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Xi’an Jiaotong University, China(人机混合增强智能国家级重点实验室) School of Computer Science and Technology, Tongji University, China(同济大学计算机科学与技术学院) Department of Computer Science, University of Illinois Chicago, USA(伊利诺伊大学芝加哥分校计算机科学系)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14025 2025-10-27 cs.LG 70%

Large Language Bayes

Justin Domke

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21106 2025-10-27 cs.SE 67%

R2ComSync: Improving Code-Comment Synchronization with In-Context Learning and Reranking

Zhen Yang, Hongyi Lin, Xiao Yu, Jacky Wai Keung, Shuo Liu, Pak Yuen Patrick Chan, Yicheng Sun, Fengji Zhang

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21094 2025-10-27 cs.SE 67%

BDiff: Block-aware and Accurate Text-based Code Differencing

Yao Lu, Wanwei Liu, Tanghaoran Zhang, Kang Yang, Yang Zhang, Wenyu Xu, Longfei Sun, Xinjun Mao, Shuzheng Gao, Michael R. Lyu

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17470 2025-10-27 cs.DB cs.AI cs.LG 62%

Transformer-Gather, Fuzzy-Reconsider: A Scalable Hybrid Framework for Entity Resolution

Mohammadreza Sharifi, Danial Ahmadzadeh

机构 * Department of Computer Engineering Ferdowsi University of Mashhad(费萨尔大学计算机工程系) Iranserver Inc.(Iranserver公司)

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

Comments Accepted at ICCKE 2025 Conference. 6 tables, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21520 2025-10-27 cs.CL 57%

Brain-tuning Improves Generalizability and Efficiency of Brain Alignment in Speech Models

Omer Moussa, Mariya Toneva

机构 * Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

Comments Published at the 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏