Up to 36x Speedup: Mask-based Parallel Inference Paradigm for Key Information Extraction in MLLMs
最高36倍提速:面向MLLMs关键信息提取的基于掩码的并行推断范式
机构 * Shanghai Jiao Tong University(上海交通大学) ; Ant Info Security Lab, Ant Group(蚂蚁集团信息安全部实验室) ; Inner Mongolia Research Institute, Shanghai Jiao Tong University(内蒙古研究院,上海交通大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CL、cs.AI
AI总结 本文提出基于掩码的并行推断范式,通过并行生成提升MLLMs关键信息提取的效率,实现最高36倍的提速。
Comments Accepted by ICASSP 2026