MUSE: A Run-Centric Platform for Multimodal Unified Safety Evaluation of Large Language Models
MUSE:一种面向多模态统一安全评估的运行导向平台
机构 * Duke University(杜克大学) ; Virtue AI
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG
AI总结 MUSE提出一种多模态统一安全评估平台,通过多轮攻击和跨轮模态切换技术,评估大型语言模型在不同模态下的安全性能。
Comments Submitted to ACL 2026 System Demonstration Track