A Scalable Framework for Safety Assurance of Self-Driving Vehicles based on Assurance 2.0
专题命中 AI治理与伦理 :safety(title,abstract)
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 AI治理与伦理 :safety(title,abstract)
机构 * Tencent(腾讯)
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.CY
机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(莫德尔·本·扎耶德人工智能大学) ; Michigan State University (MSU)(密歇根州立大学)
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.LG
Comments Published in TMLR 08/2025