Accelerating Masked Diffusion Large Language Models: A Survey of Efficient Inference Techniques
加速掩码扩散大语言模型:高效推理技术综述
机构 * KAIST AI(韩国科学技术院人工智能研究所) ; Yonsei University(延世大学)
AI总结 综述介绍用于扩散大语言模型的统一延迟分解框架,以理清算法、架构和系统因素对推理速度的影响,将加速技术分类,提供可重复基准测试指导方针并强调实现并行生成潜力的挑战。
Comments Accepted at IJCAI-ECAI 2026 (Survey Track)