Neurodivergent Influenceability as a Contingent Solution to the AI Alignment Problem
机构 * Oxford Immune Algorithmics(牛津免疫算法公司) ; Oxford University Innovation(牛津大学创新) ; London Institute for Healthcare Engineering(伦敦医疗工程研究所) ; University of Tokyo(东京大学) ; The Arrival Institute(抵达研究所) ; Cancer Research Group(癌症研究组) ; The Francis Crick Institute(弗朗西斯·克里克研究所) ; Cross Labs(交叉实验室) ; King’s Institute for Artificial Intelligence(国王人工智能研究所) ; King’s College London(伦敦国王学院) ; The Alan Turing Institute(艾伦·图灵研究所)
专题命中 越狱攻击 :alignment(title,abstract);分类 cs.AI
Comments 44 pages