GARDO: Reinforcing Diffusion Models without Reward Hacking
GARDO:无需奖励黑客的扩散模型强化
Haoran He, Yuxiao Ye, Jie Liu, Jiajun Liang, Zhiyong Wang, Ziyang Yuan, Xintao Wang, Hangyu Mao, Pengfei Wan, Ling Pan
机构
*
Hong Kong University of Science and Technology(香港科学与技术大学)
;
Kuaishou Technology(快手科技)
;
CUHK MMLab(港中文大学MMLab)
;
The University of Edinburgh(爱丁堡大学)
Automatic Stage Lighting Control: Is it a Rule-Driven Process or Generative Task?
自动舞台照明控制:是规则驱动过程还是生成任务?
Zijian Zhao, Dian Jin, Zijing Zhou, Xiaoyu Zhang
机构
*
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
The Hong Kong Polytechnic University(香港理工大学)
;
The University of Hong Kong(香港大学)
;
City University of Hong Kong(香港城市大学)
机构
*
Shanghai AI Laboratory(上海人工智能实验室)
;
Soochow University(苏州大学)
;
Westlake University(西湖大学)
;
Peking University(北京大学)
;
Tongji University(同济大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
;
Tsinghua University(清华大学)
;
Huazhong University of Science and Technology(华中科技大学)
;
The Chinese University of Hong Kong(香港中文大学)