机构
*
Zhejiang University(浙江大学)
;
Zhongguancun Academy(中关村学院)
;
University of Science and Technology of China(中国科学技术大学)
;
National University of Singapore(新加坡国立大学)
REOPD: Reliability-Adaptive Reward Extrapolation for On-Policy Distillation
REOPD:面向在线策略蒸馏的可靠性自适应奖励外推
Yang Sun, Lichao Ma, Houyuan Qin, Yuxin Liu, Hanyang Lu, Yao Zhu, Pinlong Cai, Guohang Yan
机构
*
Peking University(北京大学)
;
Southwest Jiaotong University(西南交通大学)
;
University of Science and Technology of China(中国科学技术大学)
;
School of Computer Science and Technology,University of Science and Technology of China(中国科学技术大学计算机科学与技术学院)
;
University of Electronic Science and Technology of China(电子科技大学)
;
School of Automation Engineering,University of Electronic Science and Technology of China(电子科技大学自动化工程学院)
;
Renmin University of China(中国人民大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Autonomous Driving, Shanghai Artificial Intelligence Laboratory(上海人工智能实验室自动驾驶研究中心)
Checkerboard: Closed-Form and Data-Independent Trigger Design for Clean-Label Backdoor Attacks
Checkerboard:一种简单、有效、高效且无需学习的清洁标签后门攻击,具有低污染预算
Yi Yang, Jinyang Huang, Binbin Liu, Feng-Qi Cui, Xiaokang Zhou, Haiming Jin, Zhi Liu, Jie Zhang, Meng Li
机构
*
School of Computer Science and Information Engineering(计算机科学与信息工程学院)
;
Hefei University of Technology(合肥工业大学)
;
School of Information Science and Technology(信息科学与技术学院)
;
University of Science and Technology of China(中国科学技术大学)
;
Faculty of Business Data Science(商务数据科学学院)
;
Kansai University(大阪大学)
;
RIKEN Center for Advanced Intelligence Project(日本RIKEN先进人工智能研究中心)
;
The University of Electro-Communications(电通大学)
;
Agency for Science, Technology and Research (A*STAR)(科技研究局(A*STAR))