Step-Level On-Policy Distillation: Interpolating Between On-Policy Distillation and Supervised Fine-Tuning
步骤级在线策略蒸馏:在线策略蒸馏与监督微调的插值方法
Changhui Sun, Lanbo Liu, Hang Lei, Tong Ling, Jiahang Xie, Zhiyong Zheng, Yujia Wang, Hao Liu, Feng Xiao, Lu Liu, Yanlong Du, Zifeng Cheng, Ziwei Jiang, Qing Gu
机构
*
State Key Laboratory for Novel Software Technology, Nanjing University(南京大学现代软件技术国家重点实验室)
;
XingYun Lab, HUJING Digital Media & Entertainment Group(星云实验室,沪景数字媒体娱乐集团)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
School of Data Science, Fudan University(复旦大学数据科学学院)
机构
*
Cyberspace Institute of Advanced Technology, Guangzhou University(广州大学先进技术网络空间研究院)
;
Huangpu Research School of Guangzhou University(广州大学黄埔研究院)
;
Iwate Biotechnology Research Center(岩手生物技术研究中心)
;
Nanjing University of Posts and Telecommunications(南京邮电大学)
Ming Wen, Yuxuan Liu, Kun Yang, Yunhao Feng, Zhuoer Xu, Yuhao Sun, Shiwen Cui, Xiang Zheng, Yi Liu, Xingjun Ma, Yu-Gang Jiang
机构
*
Institute of Trustworthy Embodied AI(可信具身人工智能研究院)
;
Fudan University(复旦大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Ant Group(蚂蚁集团)
;
Zhejiang University(浙江大学)
;
City University of Hong Kong(香港城市大学)
In-context superposition: human-like working memory interference in large language models
类人工作记忆干扰在大语言模型中
Hua-Dong Xiong, Li Ji-An, Jiaqi Huang, Robert C. Wilson, Kwonjoon Lee, Xue-Xin Wei
机构
*
School of Psychological and Brain Sciences, Georgia Tech(佐治亚理工学院心理与脑科学学院)
;
Department of Psychology, New York University(纽约大学心理学系)
;
Department of Cognitive Science, Indiana University Bloomington(印第安纳大学布卢明顿分校认知科学系)
;
Honda Research Institute(本田研究所)
;
Center of Excellence for Computational Cognition, Georgia Tech(佐治亚理工学院计算认知卓越中心)
;
Departments of Neuroscience and Psychology, The University of Texas at Austin(德克萨斯大学奥斯汀分校神经科学和心理学系)
Jenny Y. Huang, Leshem Choshen, Wei Sun, Omar Khattab, Ramón Fernandez Astudillo, Mehul Damani, Tamara Broderick, Jacob Andreas
机构
*
Department of Electrical Engineering and Computer Science, Massachusetts Institute of Technology(麻省理工学院电子工程与计算机科学系)
;
MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室)
;
IBM Research(IBM研究院)
Evolving Safety Landscape of Multi-modal Large Language Models: A Survey of Emerging Threats and Safeguards
多模态大语言模型的演进安全态势:新兴威胁与防护措施综述
Xi Li, Shu Zhao, Xiaohan Zou, Fei Zhao, Fuxiao Liu, Yusen Zhang, Cheng Han, Yushun Dong, Jiaqi Wang
机构
*
University of Alabama at Birmingham(阿拉巴马大学伯明翰分校)
;
NVIDIA(英伟达公司)
;
Penn State University(宾夕法尼亚州立大学)
;
Columbia University(哥伦比亚大学)
;
University of Missouri-Kansas City(密苏里大学堪萨斯分校)
;
Florida State University(佛罗里达州立大学)
;
Auburn University(奥本大学)
机构
*
Department of Biomedical Informatics, Harvard Medical School(哈佛医学院生物医学信息学系)
;
Harvard College, Harvard University(哈佛大学哈佛学院)
;
Massachusetts Institute of Technology(麻省理工学院)
;
MIT Lincoln Laboratory(MIT林肯实验室)
;
Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University(哈佛大学自然与人工智能研究学院)
;
Broad Institute of MIT and Harvard(MIT与哈佛联合广谱研究所)
;
Harvard Data Science Initiative(哈佛数据科学计划)