Learning Unmasking Policies for Diffusion Language Models
学习扩散语言模型的去掩码策略
机构 * Apple(苹果公司) ; University of Amsterdam(阿姆斯特丹大学) ; Massachusetts Institute of Technology(麻省理工学院)
AI总结 针对扩散语言模型中的去掩码采样问题,提出基于强化学习训练轻量级策略,以替代手动调优的启发式方法,在保持性能的同时提升鲁棒性。
Comments V4: Accepted as an oral spotlight at ICML 2026