Modular Techniques for Synthetic Long-Context Data Generation in Language Model Training and Evaluation
机构 * ServiceNow
专题命中 安全评测 :alignment(abstract);DPO(abstract);分类 cs.CL、cs.AI
Comments 26 pages, 4 figures
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
机构 * ServiceNow
专题命中 安全评测 :alignment(abstract);DPO(abstract);分类 cs.CL、cs.AI
Comments 26 pages, 4 figures
机构 * Mohamed Bin Zayed University of Artificial Intelligence(莫罕默德·本·扎耶德人工智能大学) ; Swiss Federal Institute of Technology Lausanne (EPFL)(洛桑联邦理工学院) ; Australian National University(澳大利亚国立大学)
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to EMNLP 2025
机构 * Huawei Translation Services Center(华为翻译服务中心)
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
Comments under preview
机构 * AI master(人工智能硕士) ; Universidad Politécnica de Madrid(马德里理工大学)
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
Comments Presented at NLMLT2025 (https://airccse.org/csit/V15N16.html), 15 pages, 5 figures
机构 * ByteDance Seed(字节跳动种子) ; Nanjing University(南京大学) ; Peking University(北京大学) ; Beijing University of Posts and Telecommunications(北京邮电大学)
专题命中 安全评测 :alignment(abstract);分类 cs.CL
专题命中 安全评测 :alignment(abstract);分类 cs.LG
机构 * University of Waterloo(滑铁卢大学) ; Toronto Metropolitan University(多伦多 Metropolitan 大学)
专题命中 安全评测 :alignment(abstract);分类 cs.CL
机构 * University of Chinese Academy of Sciences(中国科学院大学) ; Zhejiang University(浙江大学) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments Accepted to ACM MM 2025