LinguaSafe: A Comprehensive Multilingual Safety Benchmark for Large Language Models
机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
专题命中 安全评测 :safety(title,abstract);alignment(abstract);分类 cs.CL、cs.AI
Comments 7pages, 5 figures
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
专题命中 安全评测 :safety(title,abstract);alignment(abstract);分类 cs.CL、cs.AI
Comments 7pages, 5 figures
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.CY
Comments 34 pages, 3 figures
机构 * Institute for Clarity in Documentation(文档清晰研究所) ; Inria Paris-Rocquencourt(巴黎-罗克琴特研究所) ; Rajiv Gandhi University(拉吉夫·甘地大学) ; Tsinghua University(清华大学) ; Palmer Research Laboratories(帕尔默研究实验室) ; Arizona State University(亚利桑那州立大学) ; Clemson University(克莱姆森大学)
专题命中 安全评测 :alignment(abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments 20 pages
机构 * University College London(伦敦大学学院)
专题命中 安全评测 :safety(abstract);分类 cs.AI
Comments 67 pages, 6 figures, 29 tables
机构 * Department of Computer Science, Florida State University(佛罗里达州立大学计算机科学系) ; Northeastern University(东北大学) ; University of Wisconsin-Madison(威斯康星大学麦迪逊分校) ; University of Notre Dame(诺丁汉大学) ; School of Information and Communication Technology, Griffith University(格里菲斯大学信息与通信技术学院)
专题命中 安全评测 :safety(abstract);分类 cs.AI
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI
Journal ref Biomed. Eng. Lett. 15 (2025)
机构 * Computer Vision Lab, CAIDAS \& IFI, University of W\"urzburg, W\"urzburg, Germany
专题命中 安全评测 :alignment(abstract)
专题命中 安全评测 :alignment(abstract)
Comments EMNLP2025 Findings
专题命中 安全评测 :safety(abstract)
Journal ref IEEE International Symposium on Personal, Indoor and Mobile Radio Communications (PIMRC), 2025