arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 2014 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 2014 篇

2606.09012 2026-06-09 cs.LG cs.AI math.OC stat.ML 新提交 73%

Understanding Quantization-Aware Training: Gradients at Quantized Weights Bias to the Low-Loss Basin

理解量化感知训练:量化权重的梯度偏向低损失盆地

Hanyang Li, Jianhao Ma, Ying Cui

机构 * University of California, Berkeley(加州大学伯克利分校) University of Pennsylvania(宾夕法尼亚大学)

专题命中 效率与部署 :language model(abstract);post-training(abstract);分类 cs.AI、cs.LG

AI总结 提出统一几何框架解释后训练量化失败与量化感知训练恢复机制,揭示量化感知训练通过梯度感知谷壁使量化点返回低损失盆地。

Comments 31 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07710 2026-06-09 cs.LG cs.AI 新提交 73%

WhiFlash: Accelerating Speculative Decoding with Token-Level Cross-Paradigm Routing

WhiFlash: 通过令牌级跨范式路由加速推测解码

Young D. Kwon, Miles Williams, Rui Li, Alexandros Kouris, Stylianos I. Venieris

机构 * Samsung AI Center, Cambridge, UK(三星AI中心,剑桥,英国)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出WhiFlash,首个统一自回归与扩散并行草稿的跨范式推测解码方法,通过细粒度路由和缓存优化实现高达69.6%的吞吐量提升。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07074 2026-06-08 cs.LG cs.AI 新提交 73%

SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating

SlimSearcher: 通过自适应奖励门控实现训练效率感知的Web代理

Zequn Xie, Junjie Wang, Dan Yang, Jie Feng, Yue Shen, Jian Wang, Jinjie Gu

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团)

专题命中 效率与部署 :SFT(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 提出SlimSearcher框架,通过帕累托高效过滤和自适应奖励门控,在保持或提升准确率的同时将工具调用轮次减少17%-58%。

Comments 17 pages, 8 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06743 2026-06-08 cs.SD cs.AI cs.CL 新提交 73%

HybridCodec: Fast Dual-Stream, Semantically Enhanced Neural Audio Codec

HybridCodec: 快速双流、语义增强的神经音频编解码器

Arjun Gangwar, S Umesh

机构 * Indian Institute of Technology, Madras(印度理工学院马德拉斯分校)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出HybridCodec,一种结合语义蒸馏与双流架构的统一神经音频编解码器,实现强解耦、跨语言鲁棒性及3倍速度提升。

Comments 5 pages, 5 tables, 1 figure, Accepted at Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15962 2026-08-18 cs.CL cs.CV 新提交 72%

SEER: Long-Context Reasoning via Selective Visual-Text Compression

SEER:基于选择性视觉-文本压缩的长上下文推理

Jiawei Xu, Zhilin Zhai, Jinrui Fang, Ruohan Xu, Mingfei Lu, Yi Zhang, Guanchu Wang, Tianlong Chen, Ying Ding

机构 * The University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) University of Cambridge(剑桥大学) University of Technology Sydney(悉尼科技大学) The University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 效率与部署 :language model(abstract,comments);large language model(abstract);分类 cs.CL

AI总结 SEER是结合视觉压缩效率与文本推理精度的框架,经监督微调后在LongBench等长上下文基准测试中,准确率优于Glyph-9B、Qwen3-8B等基线模型,可提升提取精度并保留提示token节省量。

Comments COLM 2026, Third Conference on Language Modeling

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15075 2026-08-18 cs.CV 新提交 71%

SA-GEM: Scale-Adaptive and Geospatial Evidence-Modulated Token Pruning for Efficient Remote Sensing Large Vision-Language Models

SA-GEM:面向高效遥感大视觉语言模型的尺度自适应与地理空间证据调制型令牌剪枝

Kexin Ma, Jing Xiao, Bowen Xing, Liang Liao, Chia-Wen Lin

专题命中 效率与部署 :language model(title)

AI总结 本文针对遥感大视觉语言模型高分辨率处理效率低的问题,提出SA-GEM即插即用剪枝框架,通过尺度自适应与地理空间证据调制实现效率与精度提升,在XLRS-Bench上超GeoLLaVA-8K 2.3%且推理提速2.4倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11663 2026-08-13 cs.CV 新提交 71%

Zero-OVCD: Bridging Training-Free Foundation Models and Pseudo-Label Learning for Open-Vocabulary Change Detection

Zero-OVCD:连接无训练基础模型与伪标签学习的开放词汇变化检测方法

Daifeng Peng, Yuanke Peng, Haiyan Guan

机构 * School of Remote Sensing and Geomatics Engineering, Nanjing University of Information Science and Technology(南京信息工程大学遥感与测绘工程学院)

专题命中 效率与部署 :foundation model(title)

AI总结 本文提出Zero-OVCD框架,结合无训练基础模型推理与感知噪声的伪标签学习,在多个遥感变化检测数据集上显著提升了开放词汇变化检测性能,且无需目标域像素级标注。

Comments 10 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06188 2026-08-07 cs.DC cs.PF 新提交 71%

Routing LLM Inference to the Cleanest Grid in Real Time

实时将大语言模型推理路由至清洁电网

Aleks Bernhard, Arif Baran Yardimci

专题命中 效率与部署 :LLM(title)

AI总结 本研究提出基于边际运行排放率(MOER)信号的碳感知大语言模型推理路由方法,通过多区域GPU测试平台实时验证,可减少50.9%的GPU归因运行排放,优于轮询及静态年平均MOER策略。

Comments 18 pages, 4 figures. Live multi-region GPU validation plus a one-year historical marginal-emissions replay

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02980 2026-08-05 cs.CV 新提交 71%

Qwen-3D: A Generalist 3D Vision-Language Model for Spatial Understanding

Qwen-3D:用于空间理解的通用三维视觉语言模型

Lucy Lin, Ayush Jain, Yifan Liu, Katerina Fragkiadaki

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :language model(title)

AI总结 本研究提出 Qwen-3D 三维视觉语言模型,通过多视角几何线索与三维旋转位置嵌入提升空间推理,在三维任务上超越现有 3D LMM,还保持二维任务性能。

Comments Project Page: https://qwen-3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00110 2026-08-04 cs.CV 新提交 71%

Distill What RGB Can Recover: Privileged 3D Evidence for RGB-Only Vision-Language Models

蒸馏RGB可恢复的内容:面向仅RGB视觉-语言模型的特权3D证据

Yanbin Hu, Jin Cui, Jun Ye, Jiepeng Zhou, Jiangcheng Song, Boran Zhao, Pengju Ren

专题命中 效率与部署 :language model(title)

AI总结 本研究提出特权3D证据蒸馏框架,将训练时的3D证据转化为仅RGB视觉-语言模型的空间推理能力,使仅RGB学生模型在11项指标上均优于基线,验证了该方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23080 2026-06-23 eess.AS cs.SD 新提交 71%

AudioCALM: Continuous Autoregressive Language Modeling for Universal Audio Generation

AudioCALM:面向通用音频生成的连续自回归语言建模

Huadai Liu, Kaicheng Luo, Wen Wang, Qian Chen, Bin Ma, Xiangang Li, Wei Xue

机构 * Hong Kong University of Science and Technology (HKUST)(香港科技大学) Tongyi Fun Team, Alibaba Group(阿里云团队,阿里巴巴集团)

专题命中 效率与部署 :language model(title)

AI总结 提出AudioCALM框架,通过连续音频潜变量的自回归预测和不对称模态专家架构,统一语音、声音和音乐生成,在三个任务上达到或超越专用模型性能。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20316 2026-08-21 cs.AI 新提交 70%

Pandora's AI Model Routing Box: Efficient Allocation with Costly Value Estimation

潘多拉的AI模型路由盒:带代价价值估计的高效分配

Adam Fisch, Shubhendu Trivedi, Fantine Huot, William W. Cohen, Michael Kaisers, Mirella Lapata, Kate Larson, Jacob Eisenstein

机构 * Google DeepMind(谷歌DeepMind)

专题命中 效率与部署 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究针对异构AI系统的查询路由问题,提出带代价价值估计的Pandora's Router集中式策略及Pandora's Bidder去中心化策略,可在保证路由质量的同时减少高成本估计器的使用,还能在不同场景优化分配效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19285 2026-08-21 cs.CV cs.LG 新提交 70%

Clustering and Token Denoising for Faster and More Robust VLMs

用于更快、更鲁棒的视觉语言模型(VLM)的聚类与令牌去噪

Baptiste Rossigneux, Inna Kucher, Vincent Lorrain, Emmanuel Casseau

机构 * Université Paris-Saclay(巴黎-萨克雷大学) Univ. Rennes(雷恩大学) Vsora(沃索拉公司)

专题命中 效率与部署 :LLM(abstract_cn);language model(abstract);分类 cs.LG

AI总结 本研究提出无需训练的ClustRS算法,通过聚类与残差收缩剪枝VLM的视觉令牌,在基准测试中实现显著性能提升,为高效抗噪VLM部署提供新方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18656 2026-08-20 cs.LG cs.PF 新提交 70%

FlashAttention for Scalable Vector Architectures

面向可扩展向量架构的FlashAttention

Sonia Rani Gupta, Nikela Papadopoulou, Miquel Pericàs

机构 * Chalmers University of Technology(查尔姆斯理工大学) University of Glasgow(格拉斯哥大学)

专题命中 效率与部署 :language model(abstract);small language model(abstract);分类 cs.LG

AI总结 本文提出面向可扩展向量架构的FlashAttention-V,将其集成到ggml并在多模型与平台上评估,该方法在预填充、解码阶段均实现显著加速,但Q8_0量化线性层的结构性瓶颈制约了长向量可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18182 2026-08-20 cs.CL 新提交 70%

Efficient INT8 Inference of Small NLP Models on Server CPUs with PyTorch Native Stack

基于PyTorch原生栈在服务器CPU上实现小型NLP模型的高效INT8推理

Weiwen Xia, Yuxin Cui, E Cao

机构 * Intel Corporation(英特尔公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 该研究将SmoothQuant集成到TorchAO,优化PyTorch原生栈在服务器CPU上的INT8推理,使小型NLP模型获最高5.8倍吞吐量加速且精度损失可忽略,已上游到PyTorch和TorchAO便于部署。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18058 2026-08-19 cs.AI 新提交 70%

Delegation Asymmetry in Agentic Recommender Systems: Measuring Two-Sided Receptivity in Online Dating

智能体推荐系统中的委托不对称性:在线约会中的双边接受度测量

Daria Leshchikova, Valentina V. Kuskova, Dmitry Zaytsev, Valerii Klimov

机构 * Fleamily, Inc.(弗利米利公司) Lucy Family Institute for Data & Society(露西数据与社会研究所) University of Notre Dame(圣母大学)

专题命中 效率与部署 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究针对约会平台智能体推荐系统,开发测量双边智能体接受度的模型,发现存在委托不对称性,量化了相关倾向及设计杠杆,为智能体推荐设计提供启示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17866 2026-08-19 cs.CL 新提交 70%

BayesPrompt: human readable prompts that make sense

BayesPrompt:符合人类可读性且有意义的提示词

Franky Kevin Nando Tezoh, Ali Hussaini Umar, Alessandro Laio, Guido Sanguinetti, Riccardo Rende

机构 * Scuola Internazionale Superiore di Studi Avanzati (SISSA)(国际高等研究学院(SISSA)) Flatiron Institute(弗拉蒂伦研究所)

专题命中 效率与部署 :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 针对提示词优化任务的不适定性,本文提出BayesPrompt算法,将提示词优化重定义为贝叶斯后验推断以生成可读提示词,在真实数据集上较当前最优方法有显著指标提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17393 2026-08-19 cs.AI 新提交 70%

LEGO-RL: Harness-Native Reinforcement Learning for Coding Agents

LEGO-RL:利用原生强化学习实现编码智能体

Yiming Du, Yuxin Jiang, Tao Yuan, Jianbo Dai, Shaowei Wang, Jierun Chen, Chaofan Tao, Xianzhi Yu, Lifeng Shang, Kam-Fai Wong, Xiaohui Li, Haoli Bai

机构 * Huawei Technologies Co., Ltd(华为技术有限公司) The Chinese University of Hong Kong(香港中文大学)

专题命中 效率与部署 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 LEGO-RL 是桥接原生编码智能体 harness 与策略梯度优化的框架,通过三大支柱解决训练不匹配问题,提升 Qwen3.5-35B-A3B 在三个编码基准上的性能,且保持高概率相关性。

Comments Webpage: https://lego-rl.pages.dev

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17360 2026-08-19 cs.CR cs.AI 新提交 70%

Fair ASR: Re-Evaluating Black-Box Jailbreaks under Shared Target-Call Budgets

Fair ASR:在共享目标调用预算下重新评估黑盒越狱攻击

Zhida He, Xiaoyu Wen, Han Qi, Ziyuan Zhou, Peng Yu, Jiajia Li, Chaochao Lu, Qiaosheng Zhang

专题命中 效率与部署 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本研究提出Fair-ASR评估协议,重新评估11种黑盒越狱攻击,发现攻击排名随预算变化,进而提出ReCode攻击,在20次目标调用预算下于GPT-5实现85% ASR且效率优异。

Comments 29 pages, 8 figures, 13 tables. Code: https://github.com/xsddys/Fair-ASR

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16763 2026-08-18 cs.AI 新提交 70%

LAVA: Logic-Aware Validation and Augmentation Framework for Large-Scale Financial Document Auditing

LAVA:面向大规模财务文档审计的逻辑感知验证与增强框架

Ruoqi Shu, Xuhui Wang, Isaac Wang, Yanming Mai, Bo Wan

机构 * BMO Financial Group(蒙特利尔银行金融集团)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对财务文档验证的异构性与业务规则处理难题,提出基于多模态大语言模型的LAVA框架,通过四阶段设计提升幻觉控制与边缘案例处理能力,适用于高风险财务审计场景。

Journal ref Proceedings of The 10th Workshop on Financial Technology and Natural Language Processing (FinNLP 2025), Association for Computational Linguistics, pp. 75-92, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15857 2026-08-18 cs.AI 新提交 70%

RAGas: Retrieval-Augmented Gas Optimization for Smart Contracts with Continuous Knowledge Integration

RAGas:结合持续知识整合的智能合约检索增强型 Gas 优化

Yishun Wang, Wenjin Yi, Wenkai Li, Zongwei Li, Xiaoqi Li

机构 * School of Cyberspace Security, Hainan University(海南大学网络空间安全学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对智能合约 Gas 优化的需求,研究人员提出 RAGas 三阶段检索增强型生成框架,分析导致 Gas 过度使用的反模式,实验显示其可降低多达 11% 的 Gas 使用量,且检测精度和召回率较高。

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14651 2026-08-18 cs.AI cs.HC 新提交 70%

Evaluating Multimodal LLMs across Text and Audio Modalities for Accessible Disaster Assistance

评估面向无障碍灾害援助的跨文本与音频模态多模态大语言模型

Anuridhi Gupta, Samara Mansoor, Hemant Purohit

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文评估了开放权重多模态大语言模型在灾害援助场景下跨文本与音频模态的响应一致性,发现其存在模态依赖的不公平性,为构建公平的灾害沟通AI工具提供了设计建议。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14586 2026-08-18 cs.DC cs.AI 新提交 70%

Efficient Block-Layer Parallel Inference for Vision-Language-Action on Hybrid Architectures

面向混合架构的视觉-语言-动作(VLA)高效块级并行推理

Haibo HU, Lianming Huang, Qiao Li, Nan Guan, Chun Jason Xue

专题命中 效率与部署 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究针对VLA模型部署于车载平台的延迟与内存压力问题,提出混合CPU-GPU推理框架,通过块级划分实现资源调度,在Bench2Drive数据集及实车部署中均取得性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12724 2026-08-14 cs.LG 新提交 70%

MAG: MAnifold Guided Semi-Supervised Multi-modal In-Context Learning

MAG:流形引导的半监督多模态上下文学习

Zirui Cheng, Xun Xu, Tiankai Chen, Fady Rezk, Bowen Zheng, Xiaodong Shi, Shijie Li, Kangkang Lu, Bharadwaj Veeravalli, Nancy F. Chen

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本研究提出MAG框架,通过将未标记多模态数据用于半监督传播的演示选择,提升多模态大语言模型的上下文学习性能,在8个基准的标签稀缺场景下优于强基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13510 2026-08-14 math.ST cs.LG stat.TH 新提交 70%

On the Structural Limits of Machine Learning Decision Systems: An Information-Theoretic, Interaction-Based, and Stochastic-Dynamical Perspective

机器学习决策系统的结构极限:基于信息论、交互与随机动力学的视角

Nestor R. Barraza, Gabriel Pena

专题命中 效率与部署 :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 本研究从信息论等视角分析机器学习决策系统的结构极限,通过Fano型边界等方法推导分类与参数估计的性能极限,指出合适的数据模型是拓展预测能力的前提。

Journal ref JAIIO 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11758 2026-08-13 cs.CL 新提交 70%

AWARe: Mitigating Catastrophic Forgetting via Activation-Weighted Adaptive REtention

AWARe:基于激活加权的自适应保留缓解灾难性遗忘

Juncheng Liao, Jinfan Lv, Guoming Wang, Jupeng Zheng, Ling Xiao, Siliang Tang

机构 * School of Software Technology, Zhejiang University(浙江大学软件学院) College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) School of Artificial Intelligence, Sun Yat-Sen University(中山大学人工智能学院) Graduate School of Information Science, Hokkaido University(北海道大学信息科学研究院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对多模态大语言模型微调时的灾难性遗忘问题,提出无需修改架构的AWARe方法,通过激活加权控制参数更新,在保留上游能力的同时提升下游性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11604 2026-08-13 cs.AI 新提交 70%

Learning from Online User Feedback for Shopping Agents

从在线用户反馈中学习购物智能体

Haobo Zhang, Kelong Mao, Sulong Xu, Simiu Gu, Zhicheng Dou

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出LOFA框架,结合强化学习与反馈感知的策略内蒸馏,利用真实在线用户反馈改进购物智能体,在电商日志实验中提升了推荐质量、回复有用性及用户满意度对齐效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10760 2026-08-12 cs.CR cs.AI 新提交 70%

A Gateway Architecture for Enterprise MCP Authentication: Unifying Heterogeneous Auth, Identity Delegation, and the User / Non-User Persona Problem

企业MCP认证的网关架构:统一异构认证、身份委托与用户/非用户角色问题

Suraj Kumar, Amy Wang, Srinivasan Manoharan

专题命中 效率与部署 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出一种集中式MCP网关架构,通过双轴认证模型、多SSO授权与令牌供应模式、三类身份流及部署演进方案,解决企业MCP认证碎片化问题,已在数十个MCP服务器场景投入生产。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10743 2026-08-12 cs.CL 新提交 70%

Mitigating Context Interference for Reliable and Efficient Search Agents

缓解可靠高效搜索智能体的上下文干扰

Boyang Xue, Bin Wu, Shuofei Qiao, Sheng Wang, Rui Wang, Yiming Du, Hongru Wang, Jeff Z. Pan, Emine Yilmaz, Kam-Fai Wong, Aldo Lipani

机构 * The Chinese University of Hong Kong(香港中文大学) University College London(伦敦大学学院) Zhejiang University(浙江大学) The University of Hong Kong(香港大学) The University of Edinburgh(爱丁堡大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文针对多轮搜索智能体的上下文干扰问题,提出基于蒸馏的上下文优化器,将其纳入RL训练后可显著提升搜索智能体的可靠性与效率,开创了AI智能体“先优化上下文再生成”的新范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09119 2026-08-11 cs.AI 新提交 70%

Motif 3: Technical Report

Motif 3:技术报告

Junghwan Lim, Joon Son Chung, Sungmin Lee, Wai Ting Cheung, Gihun Cho, Minsu Ha, Sangho Kang, Beomgyu Kim, Dongseok Kim, Jangwoong Kim, Taehyun Kim, Taewhan Kim, Jeesoo Lee, Jeongdoo Lee, Junhyeok Lee, Dongpin Oh, Hyeyeon Cho, Dahye Choi, Jaeheui Her, Hanbin Jung, Changjin Kang, Minjae Kim, Youngrok Kim, Hyukjin Kweon, Hongjoo Lee, Yeongjae Park, Bokki Ryu

机构 * Motif Technologies(Motif科技公司)

专题命中 效率与部署 :language model(abstract);post-training(abstract);分类 cs.AI

AI总结 本研究推出仅解码器的MoE语言模型Motif 3,采用GDLA等技术,经万亿token预训练及多阶段后训练,在长上下文、推理等任务上性能与领先开源模型相当。

详情

展开后加载摘要…

URL PDF HTML 收藏