ParetoSlider: Diffusion Models Post-Training for Continuous Reward Control
ParetoSlider:扩散模型后训练用于连续奖励控制
机构 * Tel Aviv University(特拉维夫大学) ; Lightricks(Lightricks公司) ; Adobe Research(Adobe研究)
专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV
AI总结 ParetoSlider提出多目标强化学习框架,通过连续变化的偏好权重训练单个扩散模型,实现推理时对冲突目标的精细控制。
Comments Project page: https://shelley-golan.github.io/ParetoSlider-webpage/