Analyzing Latency Hiding and Parallelism in an MLIR-based AI Kernel Compiler
分析基于MLIR的AI内核编译器中的延迟隐藏与并行性
机构 * Qualcomm Technologies International, Ltd.(高通技术国际有限公司) ; Qualcomm Technologies, Inc.(高通技术公司)
AI总结 本文研究了基于MLIR的AI内核编译器中延迟隐藏与并行性的优化方法,通过实验验证了向量化、多线程和双缓冲技术对不同内核性能的影响。
Comments Accepted at MLBench workshop as part of ASPLOS'26