Litespark Technical Report: High-Throughput, Energy-Efficient LLM Training Framework
机构 * Mindbeam AI
专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);post-training(abstract)
Comments 14 pages
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
机构 * Mindbeam AI
专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);post-training(abstract)
Comments 14 pages
机构 * Tencent AI Lab(腾讯人工智能实验室)
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);pretraining(abstract)
Comments Accepted by ASRU 2025
机构 * AIML, University of Adelaide(人工智能实验室,阿德莱德大学)
专题命中 效率与部署 :prompting(title,abstract);large language model(abstract);language model(abstract);small language model(abstract)
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);small language model(abstract)
Comments ICML 2025
机构 * McGill University, Canada(麦吉尔大学) ; Huawei Noah's Ark Lab, Canada(华为诺亚实验室) ; Mila – Quebec AI Institute, Canada(魁北克AI研究院)
专题命中 效率与部署 :post-training(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
Comments Accepted at ECAI 2025 (European Conference on Artificial Intelligence)
专题命中 效率与部署 :language agent(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
Comments Accepted to ACL 2025. 20 pages
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
Comments ICML 2025, Project Page: https://deepauto-ai.github.io/automl-agent
机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) ; Huawei Noah’s Ark Lab(华为诺亚实验室)
专题命中 效率与部署 :post-training(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);small language model(abstract)
Comments arXiv admin note: text overlap with arXiv:2411.18010
机构 * Shanghai Jiao Tong University(上海交通大学) ; Meituan(美团) ; Intelligent Game and Decision Laboratory(智能游戏与决策实验室)
专题命中 效率与部署 :language agent(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
Comments Accepted by ACL 2025 Main. Camera Ready Version
专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);small language model(abstract)
Comments accepted by ICCCS 2025
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)
Comments 30 pages, 14 figures
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)
Comments 20 pages, 6 figures
专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);pretraining(abstract)
专题命中 效率与部署 :language model(title,abstract);LLM(abstract);foundation model(abstract);instruction tuning(abstract)
Comments To appear at the 13th International Conference on Learning Representations (ICLR 2025) as a Spotlight presentation
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)
Comments ICLR 2025
专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);small language model(abstract)
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
Comments ICLR 2025 Accepted
专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract)
Comments Efficient Video Large Language Models
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
专题命中 效率与部署 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)
专题命中 效率与部署 :post-training(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
Comments 19 pages
专题命中 效率与部署 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
Comments 22 Pages
知识盲区:一种用于审计LLM辅助分析中先验污染的推理时协议
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
AI总结 本文提出了一种在代理系统中用于审计LLM辅助分析中先验污染的推理时协议,通过替换实体标识符以匿名代码并比较输出与未盲对照组,以恢复审计性。
Comments code and LLM skill at: https://github.com/mcuccarese/epistemic-blinding 7 pages 3 figures
专题命中 效率与部署 :LLM(title,abstract);foundation model(abstract,comments);large language model(abstract);language model(abstract)
Comments Accepted at International Workshop on Foundation Models for Cyber-Physical Systems & Internet of Things (FMSys) 2024, Co-located at CPS-IoT Week 2024
COMIC:面向多模态大语言模型的参考感知安全门控
专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI
AI总结 本研究针对多模态大语言模型的参考依赖型安全缺陷,提出COMIC参考感知安全门控,通过解析操作-目标对评估安全性,提升了模型鲁棒性且保留良性效用。
大语言模型:数学表述
机构 * Statistical Sciences, University of Toronto(多伦多大学统计科学系) ; Vector Institute(向量研究所) ; Amazon Search(亚马逊搜索) ; Computing and Mathematical Sciences, California Institute of Technology(加州理工学院计算与数学科学系)
专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG
AI总结 本文提出了一种大语言模型的数学框架,涵盖文本编码、模型架构、学习过程及部署方法,旨在提升算法的准确性、效率和鲁棒性。
Comments 56 pages, 2 figures
超越二元优先级:面向大语言模型服务的多层级SLA调度
专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract,abstract_cn);分类 cs.LG
AI总结 本研究扩展Llumnix的优先级模型支持任意层级,在Vidur模拟器中对比多基线,发现四层优先级调度成本效益最优,10层时仍能维持收益且无尾部延迟崩溃。
Comments 13 pages, 9 figures, 4 tables
波纹枢轴搜索:扩散大语言模型的主动并行解码
机构 * Cooperative Medianet Innovation Center, Shanghai Jiao Tong University(上海交通大学合作中位数网络创新中心) ; Alibaba Group TMLR Group(阿里巴巴集团TMLR团队) ; Hong Kong Baptist University(香港浸会大学) ; A*STAR CFAR and Nanyang Technological University(新加坡科研局计算科学中心和南洋理工大学) ; School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)
专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL
AI总结 提出RPS方法,利用dLLM解码的波纹效应,在保持生成质量的同时,大幅提升解码速度与准确率,适用于推理及代码生成任务。