Echo: Decoupling Inference and Training for Large-Scale RL Alignment on Heterogeneous Swarms
机构 * Peking University(北京大学)
专题命中 AI治理与伦理 :alignment(title);分类 cs.AI、cs.LG
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
机构 * Peking University(北京大学)
专题命中 AI治理与伦理 :alignment(title);分类 cs.AI、cs.LG
机构 * Department of Computer Science(计算机科学系) ; National University of Singapore(新加坡国立大学)
专题命中 AI治理与伦理 :alignment(abstract);safety(abstract);分类 cs.CL
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.LG
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY
Comments 2025 AAAI Conference on AI, Ethics, and Society
机构 * Microsoft Research AI for Science(微软研究院人工智能与科学研究中心) ; Novartis Biomedical Research(诺华生物医学研究) ; University of Cambridge(剑桥大学) ; Jagiellonian University(雅盖隆大学)
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.LG
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY
Comments Conference version: AIES 2025 (non-archival track), 12 pages
机构 * Indian Institute of Technology Madras(印度理工学院马德拉斯学院)
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
机构 * First Author Affiliation(第一作者机构) ; Second Author Affiliation(第二作者机构)
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
Comments 8 pages, 4 figures, Passau uni, Master thesis in NLP