FastGRPO: Accelerating Policy Optimization via Concurrency-aware Speculative Decoding and Online Draft Learning
机构 * Lanzhou University(兰州大学) ; The University of Hong Kong(香港大学) ; National University of Singapore(新加坡国立大学)
专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
Comments Submitted to ICLR 2026