arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-15 至 2026-01-15 共收录 34 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 34 篇

2601.09385 2026-01-15 cs.SD cs.CL cs.MM 92%

SLAM-LLM: A Modular, Open-Source Multimodal Large Language Model Framework and Best Practice for Speech, Language, Audio and Music Processing

SLAM-LLM: 一种模块化、开源的多模态大语言模型框架及语音、语言、音频和音乐处理的最佳实践

Ziyang Ma, Guanrou Yang, Wenxi Chen, Zhifu Gao, Yexing Du, Xiquan Li, Zhisheng Zheng, Haina Zhu, Jianheng Zhuo, Zheshu Song, Ruiyang Xu, Tiranrui Wang, Yifan Yang, Yanqiao Zhu, Zhikang Niu, Liumeng Xue, Yinghao Ma, Ruibin Yuan, Shiliang Zhang, Kai Yu, Eng Siong Chng, Xie Chen

机构 * X-LANCE Lab, School of Computer Science, MoE Key Lab of Artificial Intelligence Shanghai Jiao Tong University(X-LANCE实验室,计算机科学学院,人工智能教育部重点实验室,上海交通大学) Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团) Peng Cheng Laboratory(鹏城实验室) University of Texas at Austin(德克萨斯大学奥斯汀分校) Tianjin University(天津大学) Hong Kong University of Science and Technology(香港科学大学) Queen Mary University of London(伦敦玛丽女王大学) Nanyang Technological University(南洋理工大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 效率与部署 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 SLAM-LLM是一种开源多模态大语言模型框架,专注于语音、语言、音频和音乐处理,提供模块化配置和高性能检查点以加速研究开发。

Comments Published in IEEE Journal of Selected Topics in Signal Processing (JSTSP)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07227 2026-01-15 cs.CL cs.AI 90%

Where to Begin: Efficient Pretraining via Subnetwork Selection and Distillation

从何处开始:通过子网络选择和蒸馏实现高效的预训练

Arjun Krishnakumar, Rhea Sanjay Sukthanker, Hannan Javed Mahadik, Gabriela Kadlecová, Vladyslav Moroshan, Timur Carstensen, Frank Hutter, Aaron Klein

机构 * University of Freiburg, Germany(弗赖堡大学) ELLIS Institute Tübingen, Germany(图宾根ELLIS研究所) Charles University, Faculty of Mathematics and Physics(查尔斯大学数学与物理系) PriorLabs The Czech Academy of Sciences, Institute of Computer Science(捷克科学院计算机科学研究所)

专题命中 效率与部署 :pretraining(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出一种高效预训练框架,通过子网络选择和蒸馏技术,使小型语言模型在资源消耗上显著低于大型模型,同时保持相近的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09306 2026-01-15 cs.IR cs.AI 89%

On-Device Large Language Models for Sequential Recommendation

设备端的大语言模型用于序列推荐

Xin Xia, Hongzhi Yin, Shane Culpepper

机构 * The University of Queensland(昆士兰大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出OD-LLM框架,通过低秩压缩和分词归一化技术,实现设备端高效准确的序列推荐模型部署。

Comments WSDM'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08833 2026-01-15 cs.PF cs.AI cs.AR cs.DC 89%

Revisiting Disaggregated Large Language Model Serving for Performance and Energy Implications

重新审视解耦大规模语言模型服务的性能和能耗影响

Jiaxi Li, Yue Zhu, Eun Kyung Lee, Klara Nahrstedt

机构 * IBM Research Yorktown Heights, New York(IBM研究院约克镇高地,纽约)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文重新评估了预填充-解码解耦服务的性能和能耗影响,发现其性能优势依赖于请求负载和KV传输介质,且解耦服务本身能耗较高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09069 2026-01-15 cs.CL cs.AI 88%

From Symbolic to Natural-Language Relations: Rethinking Knowledge Graph Construction in the Era of Large Language Models

从符号关系到自然语言关系:在大语言模型时代重新思考知识图谱构建

Kanyao Han, Yushang Lai

机构 * Walmart Global Tech(沃尔玛全球科技)

专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract);prompting(abstract)

AI总结 本文探讨在大语言模型时代,知识图谱构建应从符号关系转向自然语言关系描述,提出混合设计原则以实现更灵活的关系表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06399 2026-01-15 eess.SY cs.AI cs.SY 88%

An AI-Driven Thermal-Fluid Testbed for Advanced Small Modular Reactors: Integration of Digital Twin and Large Language Models

面向先进小型模块化反应堆的AI驱动热-流体测试平台:数字孪生与大语言模型的集成

Doyeong Lim, Yang Liu, Zavier Ndum Ndum, Christian Young, Yassin Hassan

机构 * organization= Department of Nuclear Engineering, Texas A\&M University , city= College Station , postcode= 77843 , state= TX , country= USA

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出一个结合数字孪生与大语言模型的AI驱动热-流体测试平台,用于加速小型模块化反应堆的创新与部署。

Journal ref AI Thermal Fluids, 100023 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05278 2026-01-15 hep-ex 88%

Large Language Model Integration for Knowledge Retrieval and Interaction for the DUNE Experiment

大型语言模型整合用于DUNE实验的知识检索与交互

A. Rafique, A. Singh, R. Srinivas

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract)

AI总结 DUNE-GPT利用大型语言模型和检索增强生成技术,实现对DUNE实验内部文档的自然语言查询,提升协作效率与数据隐私保护。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03697 2026-01-15 cs.LG cs.AI cs.AR 86%

AnaFlow: Agentic LLM-based Workflow for Reasoning-Driven Explainable and Sample-Efficient Analog Circuit Sizing

AnaFlow: 基于代理的LLM工作流:以推理驱动的可解释且样本高效的模拟电路尺寸设计

Mohsen Ahmadzadeh, Kaichang Chen, Georges Gielen

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 AnaFlow通过基于代理的LLM工作流实现高效、可解释的模拟电路尺寸设计,利用人类可理解的推理和自适应仿真策略,提升设计效率和透明度。

Comments This article was accepted by 2025 International Conference on Computer-Aided Design (ICCAD 2025) and was presented in Munich, October 2025

Journal ref Proc. 2025 IEEE/ACM International Conference on Computer-Aided Design (ICCAD) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19385 2026-01-15 cs.LG 85%

Beyond Uniform SVD:Dual-Level Optimization across Columns and Modules for LLM Compression

超越统一SVD:跨列和模块的双层优化用于LLM压缩

Lin Xv, Xian Gao, Ting Li, Yuzhuo Fu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 Duo-SVD通过双层优化提升LLM压缩效率,有效解决分解误差差异和权重矩阵重要性评估问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09694 2026-01-15 cs.CL cs.AI cs.CV 85%

LLMs can Compress LLMs: Adaptive Pruning by Agents

LLMs可以压缩LLMs:通过代理的自适应剪枝

Sai Varun Kodathala, Rakesh Vunnam

机构 * Research and Development, Sports Vision, Inc.(研发部,Sports Vision公司) Research and Development, Vizworld Inc.(研发部,Vizworld公司)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 本文提出通过代理引导的自适应剪枝方法,有效压缩LLMs,提升事实知识保留和模型性能。

Comments 17 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15553 2026-01-15 cs.DC 85%

Efficient Routing of Inference Requests across LLM Instances in Cloud-Edge Computing

在云边计算环境中高效路由推理请求跨LLM实例

Shibo Yu, Mohammad Goudarzi, Adel Nadjaran Toosi

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于NSGA-II的路由算法,用于在云边计算环境中高效分配LLM推理请求,提升响应质量并降低推理成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15676 2026-01-15 cs.AI cs.CL 82%

AutoToM: Scaling Model-based Mental Inference via Automated Agent Modeling

AutoToM: 通过自动化代理建模实现基于模型的心理推理扩展

Zhining Zhang, Chuanyang Jin, Mung Yao Jia, Shunchi Zhang, Tianmin Shu

机构 * Peking University(北京大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 AutoToM通过自动化代理建模实现可扩展、稳健且可解释的心理推理,优于现有方法并支持在线心理推理。

Comments NeurIPS 2025 (Spotlight). 42 pages, 11 figures, 15 tables. Website at https://chuanyangjin.com/AutoToM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09186 2026-01-15 eess.SP 82%

WiFo-E: A Scalable Wireless Foundation Model for End-to-End FDD Precoding in Communication Networks

WiFo-E:一种用于通信网络端到端FDD预编码的可扩展无线基础模型

Weibo Wen, Shijian Gao, Haotian Zhang, Xiang Cheng, Liuqing Yang

专题命中 效率与部署 :foundation model(title,abstract);pretraining(abstract)

AI总结 WiFo-E通过多任务预训练和稀疏MoE架构,实现大规模MIMO系统中端到端FDD预编码的高效可扩展解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16682 2026-01-15 cs.CL cs.AI cs.LG cs.PF 82%

Bench360: Benchmarking Local LLM Inference from 360 Degrees

Bench360:从360度角度评估本地LLM推理

Linus Stuhlmann, Mauricio Fadel Argerich, Jonathan Fürst

机构 * Zurich University of Applied Sciences(苏黎世应用科学大学) Universidad Politécnica de Madrid(马德里理工大学)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 Bench360提供了一种综合评估本地LLM推理性能的框架,通过多任务、多引擎和多指标的测试,揭示了不同设计选择对效率和输出质量的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04971 2026-01-15 cs.LG cs.AI cs.DC cs.MA 82%

Incentivizing Multi-Tenant Split Federated Learning for Foundation Models at the Network Edge

在网络边缘激励多租户分割联邦学习以实现基础模型

Songyuan Li, Jia Hu, Geyong Min, Haojun Huang

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出PRINCE机制,通过价格激励协调多租户SFL租户,提升基础模型微调效率。

Comments Accepted for publication in IEEE/ACM Transactions on Networking. Index Terms: Foundation models, Edge computing, Split federated learning, Multi-tenant system, Incentive mechanism

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09527 2026-01-15 cs.LG cs.AI cs.PF 81%

Private LLM Inference on Consumer Blackwell GPUs: A Practical Guide for Cost-Effective Local Deployment in SMEs

在消费级Blackwell GPU上进行私有LLM推理:为中小企业实现低成本本地部署的实用指南

Jonathan Knoop, Hendrik Holtmann

机构 * IE Business University(IE商学院)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI、cs.LG

AI总结 本文评估了消费级Blackwell GPU在LLM推理中的性能,证明其在多数中小企业工作负载中可替代云服务,但长上下文RAG任务仍需高端GPU。

Comments 15 pages, 18 tables, 7 figures. Includes link to GitHub repository and Docker image for reproducibility

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09059 2026-01-15 cs.CL 79%

Efficient Multilingual Dialogue Processing via Translation Pipelines and Distilled Language Models

通过翻译流水线和压缩语言模型实现高效的多语言对话处理

Santiago Martínez Novoa, Nicolás Rozo Fajardo, Diego Alejandro González Vargas, Nicolás Bedoya Figueroa

机构 * Universidad de los Andes(洛斯安第斯大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

AI总结 本文提出通过翻译流水线和压缩语言模型实现多语言对话处理,展示在低资源语言上无需微调即可取得高性能的成果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09703 2026-01-15 cs.SE cs.AI cs.CL 79%

ShortCoder: Knowledge-Augmented Syntax Optimization for Token-Efficient Code Generation

ShortCoder: 用于令牌高效代码生成的知识增强语法优化

Sicong Liu, Yanxian Huang, Mingwei Liu, Jiachi Chen, Ensheng Shi, Yuchi Ma, Hongyu Zhang, Yin Zhang, Yanlin Wang

机构 * Sun Yat-sen University, China(中山大学) Huawei Cloud Computing Technologies Co., Ltd., China(华为云计算技术有限公司) Chongqing University, China(重庆大学) University of Electronic Science and Technology of China, China(电子科技大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 ShortCoder通过语法优化和知识增强提升代码生成效率,实现18.1%-37.8%的效率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20975 2026-01-15 cs.CV 78%

SPOT!: Map-Guided LLM Agent for Unsupervised Multi-CCTV Dynamic Object Tracking

SPOT!: 多CCTV动态目标跟踪的映射引导LLM代理

Yujin Roh, Inho Jake Park, Chigon Hwang

专题命中 效率与部署 :LLM(title,abstract)

AI总结 SPOT通过映射引导LLM代理在多CCTV环境中实现无先验训练的动态目标跟踪,有效解决盲区导致的轨迹丢失问题。

Comments 33 pages, 27figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09570 2026-01-15 cs.CL 77%

Dialogue Telemetry: Turn-Level Instrumentation for Autonomous Information Gathering

对话 telemetry:面向自主信息收集的回合级仪器化

Dimitris Panagopoulos, Adolfo Perrusquia, Weisi Guo

机构 * Faculty of Engineering and Applied Science, Cranfield University(工程与应用科学学院,克兰菲尔德大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出对话 telemetry 框架,通过生成进度估计器和停滞指数,实现对自主信息收集对话的回合级监控与优化。

Comments 16 pages, 9 Figures, Version submitted to IEEE for publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22256 2026-01-15 cs.CR cs.AI cs.OS 77%

Secure and Efficient Access Control for Computer-Use Agents via Context Space

通过上下文空间实现计算机使用代理的安全高效访问控制

Haochen Gong, Chenxiao Li, Rui Chang, Wenbo Shen

机构 * Zhejiang University(浙江大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 CSAgent通过引入意图和上下文感知策略,实现对计算机使用代理的安全高效访问控制,有效抵御攻击并保持系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09434 2026-01-15 cs.MA 75%

SC-MAS: Constructing Cost-Efficient Multi-Agent Systems with Edge-Level Heterogeneous Collaboration

SC-MAS:构建具有边缘级异构协作的低成本多智能体系统

Di Zhao, Longhui Ma, Siwei Wang, Miao Wang, Yi Kong

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 SC-MAS通过异构协作提升多智能体系统的效率与准确性,实现成本降低与性能提升的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02316 2026-01-15 cs.LG cs.AI 73%

DatBench: Discriminative, Faithful, and Efficient VLM Evaluations

DatBench:具有辨别性、忠实性和效率的视觉语言模型评估

DatologyAI, :, Siddharth Joshi, Haoli Yin, Rishabh Adiga, Ricardo Monti, Aldo Carranza, Alex Fang, Alvin Deng, Amro Abbas, Brett Larsen, Cody Blakeney, Darren Teh, David Schwab, Fan Pan, Haakon Mongstad, Jack Urbanek, Jason Lee, Jason Telanoff, Josh Wills, Kaleigh Mentzer, Luke Merrick, Parth Doshi, Paul Burstein, Pratyush Maini, Scott Loftin, Spandan Das, Tony Jiang, Vineeth Dorna, Zhengping Wang, Bogdan Gaza, Ari Morcos, Matthew Leavitt

专题命中 效率与部署 :language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

AI总结 DatBench通过转换和过滤现有基准,提升视觉语言模型评估的忠实性和效率,实现13倍加速并保持辨别性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09043 2026-01-15 stat.ML cs.LG 70%

Horseshoe Mixtures-of-Experts (HS-MoE)

马蹄混合专家(HS-MoE)模型

Nick Polson, Vadim Sokolov

机构 * Booth School of Business University of Chicago(芝加哥大学商学院) Volgenau School of Engineering, George Mason University(乔治·马歇尔大学工程学院) Department of Systems Engineering and Operations Research George Mason University(乔治·马歇尔大学系统工程与运营管理系)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 HS-MoE模型通过结合马蹄先验和输入依赖门控,实现数据自适应的稀疏专家选择,并提出粒子学习算法用于顺序推断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19540 2026-01-15 cs.CL 70%

Do LLMs Encode Frame Semantics? Evidence from Frame Identification

大型语言模型编码框架语义了吗?来自框架识别的证据

Jayanth Krishna Chundru, Rudrashis Poddar, Jie Cao, Tianyu Jiang

机构 * University of Cincinnati(辛辛那提大学) University of Oklahoma(俄克拉荷马大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究通过框架识别任务验证大型语言模型对框架语义的编码能力,发现模型在无监督情况下能有效识别框架并生成语义连贯的定义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09350 2026-01-15 cs.CV 67%

See More, Store Less: Memory-Efficient Resolution for Video Moment Retrieval

看清更多,存储更少:视频时刻检索的内存高效解决方案

Mingyu Jeon, Sungjin Han, Jinkwon Hwang, Minchol Kwon, Jonghee Kim, Junyeong Kim

机构 * Department of Artificial Intelligence, Chung-Ang University(人工智能系, Chung-Ang 大学) Electronics and Telecommunications Research Institute (ETRI)(电子与电信研究院)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 SMORE通过查询引导的描述和自适应压缩技术,在视频时刻检索中实现高信息分辨率与内存效率的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20580 2026-01-15 cs.LG q-bio.NC 57%

Training Large Neural Networks With Low-Dimensional Error Feedback

利用低维误差反馈训练大型神经网络

Maher Hanut, Jonathan Kadmon

专题命中 效率与部署 :prompting(abstract);分类 cs.LG

AI总结 本文提出了一种基于反馈对齐的新型局部学习规则,利用低维误差信号高效训练大型神经网络,证明低维误差信号可媲美传统反向传播。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09136 2026-01-15 cs.CV cs.AI 57%

SkinFlow: Efficient Information Transmission for Open Dermatological Diagnosis via Dynamic Visual Encoding and Staged RL

SkinFlow: 通过动态视觉编码和分阶段强化学习实现开放性皮肤病诊断的高效信息传输

Lijun Liu, Linwei Chen, Zhishou Zhang, Meng Tian, Hengfu Cui, Ruiyang Li, Zhaocheng Liu, Qiang Ju, Qianxi Li, Hong-Yu Zhou

机构 * Baichuan Inc.(百川公司) Department of Dermatology Peking University First Hospital(北京大学第一医院皮肤科) Beijing Key Laboratory of Molecular Diagnosis on Dermatoses(北京分子皮肤病诊断重点实验室) National Clinical Research Center for Skin and Sexually Transmitted Diseases(国家皮肤及性传播疾病临床医学研究中心) NMPA Key Laboratory for Quality Control and Evaluation of Cosmetics(国家药监局化妆品质量控制与评价重点实验室) School of Biomedical Engineering Tsinghua University(清华大学生物医学工程学院) University of Hong Kong(香港大学)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 SkinFlow通过动态视觉编码和分阶段强化学习提升皮肤病诊断效率,实现比通用模型更优的准确率

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09083 2026-01-15 cs.LG 57%

SRT: Accelerating Reinforcement Learning via Speculative Rollout with Tree-Structured Cache

SRT:通过树结构缓存的推测式回滚加速强化学习

Chi-Chih Chang, Siqi Zhu, Zhichen Zeng, Haibin Lin, Jiaxuan You, Mohamed S. Abdelfattah, Ziheng Jiang, Xuehai Qian

机构 * Cornell University(康奈尔大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Tsinghua University(清华大学) University of Washington(华盛顿大学) ByteDance(字节跳动)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 SRT通过树结构缓存的推测式回滚方法,有效加速语言模型的在线强化学习,提升生成效率并降低推理成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09076 2026-01-15 cs.LG cs.DC cs.IT cs.NI eess.SP math.IT 57%

Lean Clients, Full Accuracy: Hybrid Zeroth- and First-Order Split Federated Learning

轻量客户端,全精度:混合零阶和一阶分裂联邦学习

Zhoubin Kou, Zihan Chen, Jing Yang, Cong Shen

机构 * Charles L. Brown Department of Electrical and Computer Engineering, University of Virginia(弗吉尼亚大学电气与计算机工程系查尔斯·L·布朗部门)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 HERON-SFL通过结合零阶和一阶优化,实现高效客户端计算和减少通信开销,提升边缘设备模型训练效率。

详情

展开后加载摘要…

URL PDF HTML 收藏