arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-30 至 2025-10-30 共收录 32 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 32 篇

2510.01225 2025-10-30 cs.CE cs.AI cs.CL cs.SE 92%

Utilizing Modern Large Language Models (LLM) for Financial Trend Analysis and Digest Creation

Andrei Lazarev, Dmitrii Sedov

专题命中 效率与部署 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments This is the version of the article accepted for publication in SUMMA 2024 after peer review. The final, published version is available at IEEE Xplore: 10.1109/SUMMA64428.2024.10803746

Journal ref 2024 6th International Conference on Control Systems, Mathematical Modeling, Automation and Energy Efficiency (SUMMA), Lipetsk, Russian Federation, 2024, pp. 317-321

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14257 2025-10-30 cs.LG cs.AI 90%

Revisiting Service Level Objectives and System Level Metrics in Large Language Model Serving

Zhibin Wang, Shipeng Li, Yuhang Zhou, Xue Li, Zhonghui Zhang, Nguyen Cam-Tu, Rong Gu, Chen Tian, Guihai Chen, Sheng Zhong

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Alibaba Group(阿里巴巴集团)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14872 2025-10-30 cs.SE 88%

Efficient Function Orchestration for Large Language Models

Xiaoxia Liu, Peng Di, Cong Li, Jun Sun, Jingyi Wang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract)

Comments Accepted for publication in IEEE Transactions on Software Engineering (TSE), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19902 2025-10-30 cs.CL 85%

WEST: LLM based Speech Toolkit for Speech Understanding, Generation, and Interaction

Binbin Zhang, Chengdong Liang, Shuai Wang, Xuelong Geng, Zhao Guo, Haoyu Li, Hao Yin, Xipeng Yang, Pengshen Zhang, Changwei Ma, Lei Xie

机构 * Northwestern Polytechnical University(西北工业大学) Nanjing University(南京大学) Shanghai Jiao Tong University(上海交通大学) GuaSemi Speech A Team(GuaSemi语音团队) WeNet Community(WeNet社区)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15721 2025-10-30 cs.LG 85%

Bohdi: Heterogeneous LLM Fusion with Automatic Data Exploration

Junqi Gao, Zhichang Guo, Dazhi Zhang, Dong Li, Runze Liu, Pengfei Li, Kai Tian, Biqing Qi

机构 * School of Mathematics, Harbin Institute of Technology(哈尔滨工业大学数学学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Shanghai Innovation Institute(上海创新研究院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted by NeurIPS2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25297 2025-10-30 cs.SE 85%

Understanding the Characteristics of LLM-Generated Property-Based Tests in Exploring Edge Cases

Hidetake Tanaka, Haruto Tanaka, Kazumasa Shimari, Kenichi Matsumoto

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted for publication in 2nd IEEE/ACM international conference on AI-powered Software (AIware 2025) : 8 pages, 1 table, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25017 2025-10-30 cs.DB cs.AI cs.CL 81%

StorageXTuner: An LLM Agent-Driven Automatic Tuning Framework for Heterogeneous Storage Systems

Qi Lin, Zhenyu Zhang, Viraj Thakkar, Zhenjie Sun, Mai Zheng, Zhichao Cao

机构 * Arizona State University(亚利桑那州立大学) Iowa State University(爱荷华州立大学)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.CL、cs.AI

Comments ArXiv version; Affiliations: Arizona State University (Lin, Zhang, Thakkar, Sun, Cao) and Iowa State University (Zheng)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25257 2025-10-30 cs.CV 78%

RT-DETRv4: Painlessly Furthering Real-Time Object Detection with Vision Foundation Models

Zijun Liao, Yian Zhao, Xin Shan, Yu Yan, Chang Liu, Lei Lu, Xiangyang Ji, Jie Chen

机构 * School of Electronic and Computer Engineering, Peking University, Shenzhen, China(北京大学电子与计算机工程学院,深圳,中国) Department of Automation and BNRist, Tsinghua University, Beijing, China(清华大学自动化系及BNRist,北京,中国)

专题命中 效率与部署 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25412 2025-10-30 cs.CL 77%

Serve Programs, Not Prompts

In Gim, Lin Zhong

机构 * Yale University(耶鲁大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments HotOS 2025. Follow-up implementation work (SOSP 2025) is available at arXiv:2510.24051

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00418 2025-10-30 cs.DC cs.AI 77%

Serving LLMs in HPC Clusters: A Comparative Study of Qualcomm Cloud AI 100 Ultra and NVIDIA Data Center GPUs

Mohammad Firas Sada, John J. Graham, Elham E Khoda, Mahidhar Tatineni, Dmitry Mishin, Rajesh K. Gupta, Rick Wagner, Larry Smarr, Thomas A. DeFanti, Frank Würthwein

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 8 pages, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24999 2025-10-30 cs.CR 75%

SLIP-SEC: Formalizing Secure Protocols for Model IP Protection

Racchit Jain, Satya Lokam, Yehonathan Refael, Adam Hakim, Lev Greenberg, Jay Tenenbaum

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06204 2025-10-30 cs.LG cs.AI cs.CL 75%

Differential Mamba

Nadav Schneider, Itamar Zimerman, Eliya Nachmani

机构 * School of Electrical and Computer Engineering, Ben-Gurion University of the Negev(电气与计算机工程学院,内盖夫本· Gurion大学) IAEC Tel-Aviv University(特拉维夫大学) IBM Research(IBM研究院)

专题命中 效率与部署 :LLM(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments AACL 2025. We provide the code at https://github.com/NadavSc/Diff-Mamba

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25602 2025-10-30 cs.LG cs.AI 73%

INT v.s. FP: A Comprehensive Study of Fine-Grained Low-bit Quantization Formats

Mengzhao Chen, Meng Wu, Hui Jin, Zhihang Yuan, Jing Liu, Chaoyi Zhang, Yunshui Li, Jie Huang, Jin Ma, Zeyue Xue, Zhiheng Liu, Xingyan Bin, Ping Luo

机构 * The University of Hong Kong(香港大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16714 2025-10-30 quant-ph cs.AI cs.CL 73%

Quantum Transformer: Accelerating model inference via quantum linear algebra

Naixu Guo, Zhan Yu, Matthew Choi, Yizhan Han, Aman Agrawal, Kouhei Nakaji, Alán Aspuru-Guzik, Patrick Rebentrost

机构 * Centre for Quantum Technologies, National University of Singapore(新加坡国立大学量子技术中心) Department of Computer Science, University of Toronto(多伦多大学计算机科学系) Vector Institute for Artificial Intelligence(人工智能向量研究所) School of Computing, National University of Singapore(新加坡国立大学计算机学院) Department of Mathematics, National University of Singapore(新加坡国立大学数学系) NVIDIA Corporation(NVIDIA公司) Department of Chemistry, University of Toronto(多伦多大学化学系) Research Center for Emerging Computing Technologies, National Institute of Advanced Industrial Science and Technology (AIST)(新兴计算技术研究中心,日本国家先进工业科学与技术研究院) Quantum Computing Center, Keio University(Keio大学量子计算中心) Department of Materials Science & Engineering, University of Toronto(多伦多大学材料科学与工程系) Department of Chemical Engineering & Applied Chemistry, University of Toronto(多伦多大学化学工程与应用化学系) Lebovic Fellow, Canadian Institute for Advanced Research(加拿大高级研究研究院Lebovic研究员)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 45 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23323 2025-10-30 cs.LG cs.NE 70%

Towards Scaling Deep Neural Networks with Predictive Coding: Theory and Practice

Francesco Innocenti

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25150 2025-10-30 cs.CL 70%

Explainable Disentanglement on Discrete Speech Representations for Noise-Robust ASR

Shreyas Gopal, Ashutosh Anshul, Haoyang Li, Yue Heng Yeo, Hexin Liu, Eng Siong Chng

机构 * College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Awarded Best Student Paper at APSIPA ASC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24824 2025-10-30 cs.CL 70%

Parallel Loop Transformer for Efficient Test-Time Computation Scaling

Bohong Wu, Mengzhao Chen, Xiang Luo, Shen Yan, Qifan Yu, Fan Xia, Tianqi Zhang, Hongrui Zhan, Zheng Zhong, Xun Zhou, Siyuan Qiao, Xingyan Bin

机构 * ByteDance Seed(字节跳动种子)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21710 2025-10-30 cs.CV 67%

FOCUS: Internal MLLM Representations for Efficient Fine-Grained Visual Question Answering

Liangyu Zhong, Fabio Rosenthal, Joachim Sicking, Fabian Hüger, Thorsten Bagdonat, Hanno Gottschalk, Leo Schwinn

机构 * Technical University of Berlin(柏林技术大学) Technical University of Munich(慕尼黑技术大学) CARIAD SE Volkswagen AG(大众集团)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Comments Accepted by NeurIPS 2025 - main track. Project page: https://focus-mllm-vqa.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08388 2025-10-30 cs.LG cs.AI cs.CL 67%

Reinforcement Learning Teachers of Test Time Scaling

Edoardo Cetin, Tianyu Zhao, Yujin Tang

机构 * Sakana AI, Japan(日本Sakana AI)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25278 2025-10-30 cs.AR 67%

DIRC-RAG: Accelerating Edge RAG with Robust High-Density and High-Loading-Bandwidth Digital In-ReRAM Computation

Kunming Shao, Zhipeng Liao, Jiangnan Yu, Liang Zhao, Qiwei Li, Xijie Huang, Jingyu He, Fengshi Tian, Yi Zou, Xiaomeng Wang, Tim Kwang-Ting Cheng, Chi-Ying Tsui

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Comments Accepted by 2025 IEEE/ACM ISLPED

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25258 2025-10-30 cs.DC 67%

MoEntwine: Unleashing the Potential of Wafer-scale Chips for Large-scale Expert Parallel Inference

Xinru Tang, Jingxiang Hou, Dingcheng Jiang, Taiquan Wei, Jiaxin Liu, Jinyi Deng, Huizheng Wang, Qize Yang, Haoran Shang, Chao Li, Yang Hu, Shouyi Yin

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24801 2025-10-30 cs.LG cs.AI cs.CL cs.MA 67%

Fortytwo: Swarm Inference with Peer-Ranked Consensus

Vladyslav Larin, Ihor Naumenko, Aleksei Ivashov, Ivan Nikitin, Alexander Firsov

专题命中 效率与部署 :prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25220 2025-10-30 cs.IR cs.AI cs.LG 62%

GReF: A Unified Generative Framework for Efficient Reranking via Ordered Multi-token Prediction

Zhijie Lin, Zhuofeng Li, Chenglei Dai, Wentian Bao, Shuai Lin, Enyun Yu, Haoxiang Zhang, Liang Zhao

机构 * Shanghai University(上海大学) Emory University(埃默里大学)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI、cs.LG

Comments Accepted by CIKM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24949 2025-10-30 cs.RO cs.AI cs.CV cs.LG 62%

SCOUT: A Lightweight Framework for Scenario Coverage Assessment in Autonomous Driving

Anil Yildiz, Sarah M. Thornton, Carl Hildebrandt, Sreeja Roy-Singh, Mykel J. Kochenderfer

机构 * Department of Aeronautics and Astronautics, Stanford University(航空航天工程系,斯坦福大学) Nuro Inc.(Nuro公司)

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19898 2025-10-30 cs.SE cs.AI cs.CL 62%

BugPilot: Complex Bug Generation for Efficient Learning of SWE Skills

Atharv Sonwane, Isadora White, Hyunji Lee, Matheus Pereira, Lucas Caccia, Minseon Kim, Zhengyan Shi, Chinmay Singh, Alessandro Sordoni, Marc-Alexandre Côté, Xingdi Yuan

机构 * Cornell University(康奈尔大学) University of California San Diego(加州大学圣地亚哥分校) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Microsoft Research(微软研究院)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20762 2025-10-30 cs.LG math.OC 57%

ASGO: Adaptive Structured Gradient Optimization

Kang An, Yuxing Liu, Rui Pan, Yi Ren, Shiqian Ma, Donald Goldfarb, Tong Zhang

机构 * Rice University(里士大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Meta Platforms, Inc.(Meta平台公司) Columbia University(哥伦比亚大学)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25032 2025-10-30 cs.CV cs.AI 57%

Efficient License Plate Recognition via Pseudo-Labeled Supervision with Grounding DINO and YOLOv8

Zahra Ebrahimi Vargoorani, Amir Mohammad Ghoreyshi, Ching Yee Suen

专题命中 效率与部署 :language model(abstract);分类 cs.AI

Comments 6 pages, 8 figures. Presented at 2025 IEEE International Workshop on Machine Learning for Signal Processing (MLSP), August 31 - September 3, 2025, Istanbul, Turkey

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24787 2025-10-30 cs.CV cs.AI 57%

ESCA: Enabling Seamless Codec Avatar Execution through Algorithm and Hardware Co-Optimization for Virtual Reality

Mingzhi Zhu, Ding Shang, Sai Qian Zhang

机构 * Tandon School of Engineering, New York University(纽约大学工程学院) Courant Institute of Mathematical Sciences, New York University(纽约大学数学科学学院) Rensselaer Polytechnic Institute(拉特格斯理工学院)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01984 2025-10-30 cs.CV 50%

Lifelong Whole Slide Image Analysis: Online Vision-Language Adaptation and Past-to-Present Gradient Distillation

Doanh C. Bui, Hoai Luan Pham, Vu Trung Duong Le, Tuan Hai Vu, Van Duy Tran, Khang Nguyen, Yasuhiko Nakashima

机构 * Nara Institute of Science and Technology(奈良科学技术大学) University of Information Technology, Ho Chi Minh city Vietnam National University(信息技术大学)

专题命中 效率与部署 :foundation model(abstract)

Comments IEEE Access (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25145 2025-10-30 cs.NI 50%

ML-Based Preamble Collision Detection in the Random Access Procedure of Cellular IoT Networks

Giancarlo Maldonado Cardenas, Diana C. Gonzalez, Judy C. Guevara, Carlos A. Astudillo, Nelson L. S. da Fonseca

专题命中 效率与部署 :post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏