arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-21 至 2026-01-21 共收录 80 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 80 篇

2601.11579 2026-01-21 cs.CL cs.AI 90%

Bielik 11B v3: Multilingual Large Language Model for European Languages

Bielik 11B v3:面向欧洲语言的多语言大语言模型

Krzysztof Ociepa, Łukasz Flis, Remigiusz Kinas, Krzysztof Wróbel, Adrian Gwoździej

专题命中 效率与部署 :language model(title,abstract);large language model(title);SFT(abstract);preference optimization(abstract)

AI总结 Bielik 11B v3是一款针对波兰语优化,同时支持多种欧洲语言的高性能大语言模型,通过深度扩展和四阶段训练流程实现了高效参数利用和广泛任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13443 2026-01-21 cs.AI 89%

Explicit Cognitive Allocation: A Principle for Governed and Auditable Inference in Large Language Models

显式认知分配:一种用于受控和可审计的大语言模型推理的原则

Héctor Manuel Manzanilla-Granados, Zaira Navarrete-Cazales, Miriam Pescador-Rojas, Tonahtiu Ramírez-Romero

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出显式认知分配原则,通过认知通用代理架构实现结构化推理,提升大语言模型在高责任场景下的可追溯性和可审计性。

Comments Preprint. This version corresponds to the initial public release of the CUA architecture and associated evaluation metrics

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14051 2026-01-21 cs.CL cs.AI cs.LG 89%

Kakugo: Distillation of Low-Resource Languages into Small Language Models

Kakugo:通过低资源语言名称训练通用小型语言模型的蒸馏方法

Peter Devine, Mardhiyah Sanni, Farid Adilazuarda, Julieta Gil Loizaga, Barry Haddow

机构 * School of Informatics, University of Edinburgh(信息学院,爱丁堡大学)

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 Kakugo通过仅使用语言名称作为输入,利用大型教师模型生成合成数据,有效训练小型语言模型以处理低资源语言,从而在多种NLP任务中提升性能,成本低于50美元每种语言。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24624 2026-01-21 cs.CR 89%

PRIVMARK: Private Large Language Models Watermarking with MPC

PRIVMARK: 基于MPC的私有大语言模型水印技术

Thomas Fargues, Ye Dong, Tianwei Zhang, Jin-Song Dong

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 PRIVMARK通过MPC技术实现大语言模型的隐私保护水印,无需暴露模型权重,有效抵御攻击并保持性能。

Comments 8 pages, 4 figures, under peer-review

Journal ref ICC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03160 2026-01-21 cs.SE 89%

Assessing Small Language Models for Code Generation: An Empirical Study with Benchmarks

评估小型语言模型用于代码生成:基于基准的实证研究

Md Mahade Hasan, Muhammad Waseem, Kai-Kristian Kemell, Jussi Rasku, Juha Ala-Rantala, Pekka Abrahamsson

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);large language model(abstract)

AI总结 本研究评估了多种小型语言模型在代码生成中的性能,发现紧凑模型在效率与性能间取得平衡,但进一步提升需转向更大模型。

Comments 17 pages, 10 Tables, 57 figures. Includes benchmarks and multilingual evaluation. Submitted to the Journal of Systems and Software

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13143 2026-01-21 cs.LG 88%

FastAV: Efficient Token Pruning for Audio-Visual Large Language Model Inference

FastAV: 面向音频视觉大语言模型推理的高效令牌修剪

Chaeyoung Jung, Youngjoon Jang, Seungwoo Lee, Joon Son Chung

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 FastAV通过两阶段令牌修剪策略,针对音频视觉大语言模型实现高效推理,减少FLOPs超过40%并保持性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13383 2026-01-21 cs.AI 86%

A Lightweight Modular Framework for Constructing Autonomous Agents Driven by Large Language Models: Design, Implementation, and Applications in AgentForge

基于大语言模型的轻量模块化框架:用于AgentForge中的设计、实现与应用

Akbar Anbar Jafari, Cagri Ozcinar, Gholamreza Anbarjafari

机构 * University of Tartu(塔尔图大学) S Holding OÜ(3S控股公司)

专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract);分类 cs.AI

AI总结 AgentForge是一种基于大语言模型的轻量模块化框架,通过可组合的技能抽象、统一的LLM后端接口和声明性配置系统,提升自主代理的开发效率和灵活性。

Comments 15 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11663 2026-01-21 cs.LG cs.AI 86%

Activation Sensitivity as a Unifying Principle for Post-Training Quantization

激活敏感性作为后训练量化方法的统一原则

Bruce Changlong Xu

专题命中 效率与部署 :post-training(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出激活敏感性作为后训练量化的统一原则,通过理论框架解释AWQ和GPTQ等方法,并揭示其与经典剪枝技术的关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15439 2026-01-21 cs.LG cs.SE 85%

Combating Toxic Language: A Review of LLM-Based Strategies for Software Engineering

对抗有毒语言:基于大语言模型的软件工程策略综述

Hao Zhuo, Yicheng Yang, Kewen Peng

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文综述了基于大语言模型的软件工程中对抗有毒语言的策略,评估了检测、预处理和缓解方法,并通过实验验证了LLM重写在减少毒性中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11676 2026-01-21 cs.DC cs.AI cs.NI 85%

HALO: Semantic-Aware Distributed LLM Inference in Lossy Edge Network

HALO:语义感知的分布式LLM推理在失真边缘网络中

Peirong Zheng, Wenchao Xu, Haozhao Wang, Jinyu Chen, Xuemin Shen

机构 * Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算机系) Division of Integrative Systems and Design, The Hong Kong University of Science and Technology(香港理工大学系统与设计学院) School of Computer Science and Technology, Huazhong University of Science and Technology(华中科技大学计算机科学与技术学院) Department of Electrical and Computer Engineering, University of Waterloo(滑铁卢大学电气与计算机工程系)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 HALO通过语义感知预测和负载平衡调度,提升失真边缘网络中LLM推理的效率与性能。

Comments Accepted by IEEE International Conference on Computer Communications (INFOCOM) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14904 2026-01-21 cs.CL cs.AI 85%

Efficient Switchable Safety Control in LLMs via Magic-Token-Guided Co-Training

通过魔法令牌引导的协同训练实现LLM中的高效可切换安全控制

Jianfeng Si, Lin Sun, Zhewen Tan, Xiangzheng Zhang

机构 * Qiyuan Tech, Beijing, China(北京奇元科技)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

AI总结 本文提出通过魔法令牌引导的协同训练框架,实现LLM内容安全的高效可切换控制,提升安全性能并降低训练与部署成本。

Comments 15 pages,3 figures,5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11546 2026-01-21 cs.DB 85%

RelServe: Fast LLM Inference Serving on Relational Data

RelServe: 在关系数据上实现快速大语言模型推理服务

Xin Zhang, Shihong Gao, Yanyan Shen, Haoyang Li, Lei Chen

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 RelServe通过动态优先级更新和自适应批处理优化,显著提升了关系数据查询的LLM推理效率,降低了延迟。

Comments Paper Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12904 2026-01-21 cs.CL cs.AI 84%

From Prefix Cache to Fusion RAG Cache: Accelerating LLM Inference in Retrieval-Augmented Generation

从前缀缓存到融合RAG缓存:加速检索增强生成中的LLM推理

Jiahao Wang, Weiyu Xie, Mingxing Zhang, Boxing Zhang, Jianwei Dong, Yuening Zhu, Chen Lin, Jinqi Tang, Yaochen Han, Zhiyuan Ai, Xianglin Chen, Yongwei Wu, Congfeng Jiang

机构 * Hangzhou Dianzi University(杭州电子科技大学) Tsinghua University(清华大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 FusionRAG通过优化RAG的预处理和重处理阶段,在保持生成质量的同时提升推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12785 2026-01-21 cs.LG cs.AI 84%

Distilling Time Series Foundation Models for Efficient Forecasting

压缩时间序列基础模型以实现高效预测

Yuqi Li, Kuiye Ding, Chuanguang Yang, Szu-Yu Chen, Yingli Tian

机构 * The City College of New York, City University of New York, USA(纽约城市学院,纽约城市大学) Institute of Computing Technology, Chinese Academy of Sciences, China(中国科学院计算技术研究所) Stevens Institute of Technology, USA(史蒂文斯理工学院)

专题命中 效率与部署 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

AI总结 DistilTS是一种专为时间序列基础模型设计的蒸馏框架,通过时间跨度加权目标和时间对齐策略,在减少参数量的同时保持预测性能。

Comments Accepted by ICASSP-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12376 2026-01-21 cs.CL 83%

LR-DWM: Efficient Watermarking for Diffusion Language Models

LR-DWM: 用于扩散语言模型的高效水印技术

Ofek Raban, Ethan Fetaya, Gal Chechik

机构 * Bar-Ilan University(巴伊兰大学) NVIDIA(英伟达)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 LR-DWM是一种用于扩散语言模型的高效水印技术,通过利用左右邻居信息偏移生成令牌,实现低开销的高可检测性水印方案。

Comments Submitted to ACL Rolling Review (ARR). 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15907 2026-01-21 cs.DC 82%

Decentralized LLM Inference over Edge Networks with Energy Harvesting

基于边缘网络的分布式大语言模型推理与能量收集

Aria Khoshsirat, Giovanni Perin, Michele Rossi

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract)

AI总结 本文提出了一种基于能量收集的边缘网络中分布式大语言模型推理方法,利用半马尔可夫模型优化调度算法以提高能效和网络吞吐量。

Journal ref Proceedings of IEEE Global Communications Conference (GLOBECOM), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12272 2026-01-21 cs.CV 82%

AgenticPruner: MAC-Constrained Neural Network Compression via LLM-Driven Strategy Search

AgenticPruner: 通过LLM驱动的策略搜索实现MAC约束的神经网络压缩

Shahrzad Esmat, Mahdi Banisharif, Ali Jannesari

机构 * Iowa State University(爱荷华州立大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract)

AI总结 AgenticPruner通过LLM驱动策略搜索实现MAC约束的神经网络压缩,通过三个专门代理协调优化,提升收敛成功率并实现精确的MAC预算控制。

Comments 38 pages, 2 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12988 2026-01-21 cs.LG 81%

PaperGuide: Making Small Language-Model Paper-Reading Agents More Efficient

PaperGuide: 使小型语言模型论文阅读代理更加高效

Zijian Wang, Tiancheng Huang, Hanqi Li, Da Ma, Lu Chen, Kai Yu

机构 * X-LANCE Lab, School of Computer Science, MoE Key Lab of Artificial Intelligence, SJTU AI Institute, Shanghai Jiao Tong University, Shanghai, China(X-LANCE实验室、计算机科学学院、人工智能关键实验室、SJTU人工智能研究所、上海交通大学、上海,中国) Suzhou Laboratory, Suzhou, China(苏州实验室、苏州,中国)

专题命中 效率与部署 :large language model(abstract);language model(abstract);SFT(abstract);prompting(abstract)

AI总结 PaperCompass通过分离高层规划与细粒度执行,提升小型语言模型在论文阅读任务中的效率,实现高效且可靠的训练过程。

Comments 35 pages, 9 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02751 2026-01-21 cs.LG cs.AI 81%

SmallKV: Small Model Assisted Compensation of KV Cache Compression for Efficient LLM Inference

SmallKV: 小模型辅助补偿KV缓存压缩以实现高效大语言模型推理

Yi Zhao, Yajuan Peng, Cam-Tu Nguyen, Zuchao Li, Xiaoliang Wang, Hai Zhao, Xiaoming Fu

机构 * AGI Institute, School of Computer Science, Shanghai Jiao Tong University(AGI研究院,计算机科学学院,上海交通大学) Shanghai Key Laboratory for Intelligent Information Processing, Fudan University(上海智能信息处理重点实验室,复旦大学) State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) School of Artificial Intelligence, Wuhan University(人工智能学院,武汉大学) Institute of Computer Science, University of Göttingen(计算机科学研究所,哥廷根大学)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI、cs.LG

AI总结 SmallKV通过小模型辅助补偿KV缓存压缩,提升大语言模型在资源受限环境下的推理效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20861 2026-01-21 cs.LG cs.AI 81%

Memory-Efficient Acceleration of Block Low-Rank Foundation Models on Resource Constrained GPUs

基于资源受限GPU的块低秩基础模型的内存高效加速

Pierre Abillama, Changwoo Lee, Juechu Dong, David Blaauw, Dennis Sylvester, Hun-Seok Kim

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种内存高效的块低秩基础模型加速方法,通过自定义Triton内核优化,显著提升了在资源受限GPU上的推理速度和模型压缩效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08604 2026-01-21 cs.CV cs.AI cs.LG 81%

Transferable Model-agnostic Vision-Language Model Adaptation for Efficient Weak-to-Strong Generalization

可迁移的模型无关视觉-语言模型适应方法用于高效的弱到强泛化

Jihwan Park, Taehoon Song, Sanghyeok Lee, Miso Choi, Hyunwoo J. Kim

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 TransMiter是一种轻量级适配器,通过无监督方式提升视觉-语言模型的泛化能力,实现高效的知识迁移。

Comments AAAI2026 Oral (camera ready version)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13559 2026-01-21 cs.AI 79%

AgentGC: Evolutionary Learning-based Lossless Compression for Genomics Data with LLM-driven Multiple Agent

AgentGC: 基于进化学习的无损基因组数据压缩方法与LLM驱动的多智能体

Sun Hui, Ding Yanfeng, Huidong Ma, Chang Xu, Keyan Jin, Lizheng Zu, Cheng Zhong, xiaoguang Liu, Gang Wang, Wentong Cai

机构 * Nankai University(南开大学) Nanyang Technology University(南阳技术大学) Microsoft Research Asia(微软亚洲研究院) Macao Polytechnic University(澳门理工学院) Guangxi University(广西大学)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI

AI总结 AgentGC通过LLM驱动的多智能体架构,实现基因组数据的高效无损压缩,提升压缩比和吞吐量,解决传统方法的适应性和用户友好性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09258 2026-01-21 cs.DC cs.LG cs.OS 79%

LatencyPrism: Online Non-intrusive Latency Sculpting for SLO-Guaranteed LLM Inference

LatencyPrism: 一种在线非侵入式延迟塑形系统以保证LLM推理的SLA

Yin Du, Jiayi Ren, Xiayu Sun, Tianyao Zhou, Haizhu Zhou, Ruiyan Ma, Danyang Zhang

机构 * Alibaba Cloud Computing(阿里云计算)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.LG

AI总结 LatencyPrism是一种非侵入式延迟塑形系统,通过实时监控和异常检测保证LLM推理的SLA要求。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15566 2026-01-21 cs.SD cs.AI cs.NE 79%

SpikeVox: Towards Energy-Efficient Speech Therapy Framework with Spike-driven Generative Language Models

SpikeVox: 向能量高效的言语治疗框架迈进:基于脉冲的生成语言模型

Rachmad Vidya Wicaksana Putra, Aadithyan Rajesh Nair, Muhammad Shafique

机构 * eBrain Lab, New York University (NYU) Abu Dhabi(eBrain实验室,纽约大学阿布扎赫尔分校) Pune University(普纳大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

AI总结 SpikeVox通过基于脉冲的生成语言模型实现能量高效的言语治疗框架,提供高精度语音识别和完整的治疗反馈。

Comments Accepted at the IEEE Biomedical Circuits and Systems Conference (BioCAS) 2025, Abu Dhabi, UAE

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13238 2026-01-21 cs.CV cs.AI 79%

A Semantic Decoupling-Based Two-Stage Rainy-Day Attack for Revealing Weather Robustness Deficiencies in Vision-Language Models

基于语义解耦的两阶段雨天攻击:揭示视觉-语言模型在天气鲁棒性方面的缺陷

Chengyin Hu, Xiang Chen, Zhe Jia, Weiwen Shi, Fengyu Zhang, Jiujiang Guo, Yiwei Wei

机构 * Chengyin Hu(独立研究者) Xiang Chen(独立研究者) Zhe Jia(独立研究者) Weiwen Shi(独立研究者) Fengyu Zhang(独立研究者) Jiujiang Guo(独立研究者) Yiwei Wei(独立研究者)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

AI总结 本文提出了一种基于语义解耦的两阶段雨天攻击框架,揭示了视觉-语言模型在天气鲁棒性方面的缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12150 2026-01-21 cs.CV cs.AI 79%

Enhanced Diagnostic Performance via Large-Resolution Inference Optimization for Pathology Foundation Models

通过大规模分辨率推断优化提升诊断性能的病理基础模型

Mengxuan Hu, Zihan Guan, John Kang, Sheng Li, Zhongliang Zhou

机构 * University of Virginia(弗吉尼亚大学) Merck & Co., Inc. Biometrics Research(默克公司生物医学研究)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI

AI总结 本文提出了一种高效推断策略,通过稀疏化注意力和过滤非信息性标记,在保持性能的同时提升高分辨率WSI推断效率。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12042 2026-01-21 cs.CR cs.AI 79%

Less Is More -- Until It Breaks: Security Pitfalls of Vision Token Compression in Large Vision-Language Models

少即是多——直到它破裂:大视觉-语言模型中视觉标记压缩的安全隐患

Xiaomei Zhang, Zhaoxi Zhang, Leo Yu Zhang, Yanjun Zhang, Guanhong Tao, Shirui Pan

机构 * Griffith University(格里菲斯大学) University of Technology Sydney(悉尼技术大学) University of Utah(犹他大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

AI总结 本研究揭示了视觉标记压缩在大视觉-语言模型中显著降低鲁棒性的问题,并提出压缩感知攻击以系统研究该漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22007 2026-01-21 math.ST cs.CL cs.CR cs.LG stat.ML stat.TH 79%

Optimal Detection for Language Watermarks with Pseudorandom Collision

语言水印的最优检测与伪随机碰撞

T. Tony Cai, Xiang Li, Qi Long, Weijie J. Su, Garrett G. Wen

机构 * University of Pennsylvania(宾夕法尼亚大学) Yale University(耶鲁大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出了一种基于最小单位的统计框架,用于在不完美伪随机性下优化语言水印检测,通过理论分析和实验验证提升了检测能力并严格控制类型I错误。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20156 2026-01-21 cs.CL cs.AI cs.SD eess.AS 79%

Fun-Audio-Chat Technical Report

Fun-Audio-Chat 技术报告

Tongyi Fun Team, Qian Chen, Luyao Cheng, Chong Deng, Xiangang Li, Jiaqing Liu, Chao-Hong Tan, Wen Wang, Junhao Xu, Jieping Ye, Qinglin Zhang, Qiquan Zhang, Jingren Zhou

机构 * Alibaba Group(阿里巴巴集团)

专题命中 效率与部署 :LLM(abstract);language model(abstract);post-training(abstract);分类 cs.CL、cs.AI

AI总结 Fun-Audio-Chat通过双分辨率语音表示和核心鸡尾酒训练,解决语音-文本模型的时间分辨率不匹配和灾难性遗忘问题,实现高效且高质量的音频理解与生成。

Comments Authors are listed in alphabetical order, 21 pages, open-source at https://github.com/FunAudioLLM/Fun-Audio-Chat

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17272 2026-01-21 cs.LG cs.CL 79%

Zebra-Llama: Towards Extremely Efficient Hybrid Models

Zebra-Llama:迈向极高效混合模型

Mingyu Yang, Mehdi Rezagholizadeh, Guihong Li, Vikram Appia, Emad Barsoum

机构 * Advanced Micro Devices, Inc. (AMD)(先进微器件公司(AMD))

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL、cs.LG

AI总结 Zebra-Llama通过结合状态空间模型和多头潜在注意力层,构建高效混合模型,以极低成本实现接近Transformer的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏