Utilizing AI for Aviation Post-Accident Analysis Classification
专题命中 安全评测 :safety(abstract);分类 cs.AI
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全评测 :safety(abstract);分类 cs.AI
机构 * University of Macau China(澳门大学) ; East China Normal University China(华东师范大学) ; Auckland University of Technology New Zealand(技术大学)
专题命中 安全评测 :alignment(abstract);分类 cs.CL
机构 * East China Normal University(华东师范大学) ; Meituan Inc.(美团公司) ; Donghua University(东华大学) ; Tsinghua University(清华大学)
专题命中 安全评测 :alignment(abstract);分类 cs.AI
Comments Accepted by ACL 2025 (Findings)
机构 * Central South University(中南大学) ; University of Electronic Science and Technology of China(电子科技大学) ; Peng Cheng Laboratory(鹏城实验室) ; Nanjing University(南京大学) ; Microsoft(微软公司)
专题命中 安全评测 :alignment(abstract);分类 cs.AI
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments 9 pages
机构 * Gaoling School of Artificial Intelligence(人工智能学院) ; Renmin University of China(中国人民大学) ; School of Information Technology and Management(信息科技与管理学院) ; University of International Business and Economics(国际经济贸易大学)
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
Journal ref Forty-second International Conference on Machine Learning. ICML 2025. Vancouver, Canada. July 13-19, 2025
机构 * Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室)
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL
专题命中 安全评测 :alignment(abstract);分类 cs.LG
Comments Accepted to ICML 2025
机构 * University of Cambridge(剑桥大学)
专题命中 安全评测 :safety(abstract);分类 cs.LG
机构 * University of New South Wales(新南威尔士大学) ; Data61, CSIRO
专题命中 安全评测 :safety(abstract);分类 cs.CL
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL
Comments Findings of ACL 2025; Project Page: https://github.com/LaVi-Lab/C2LEVA
机构 * Bitdefender ; Politehnica Bucharest(巴尔干理工大学)
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments Accepted as a highlight paper at the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2025
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL
机构 * Jilin University(吉林大学) ; Fudan University(复旦大学) ; Tongji University(同济大学)
专题命中 安全评测 :safety(abstract);分类 cs.AI
机构 * Georgia Institute of Technology(佐治亚理工学院)
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments 34 pages, 5 figures, 30 tables
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments 43 pages, including the Appendix, 19 tables and 13 figures
机构 * Vrije Universiteit Amsterdam(瓦赫宁海姆大学) ; University of Bielefeld(比勒菲尔德大学) ; NEC Laboratories Europe(NEC欧洲实验室) ; University of Bamberg(巴明翰大学) ; University of Groningen(格罗宁根大学) ; Università di Bologna(博洛尼亚大学) ; Meta Reality Labs(Meta现实实验室) ; CAIR, Ss. Cyril and Methodius University of Skopje(斯科普里塞尔维亚·克里尔和方法ius大学) ; Kansas State University(堪萨斯州立大学) ; KU Leuven(根特大学) ; University of Edinburgh(爱丁堡大学) ; University of Bremen(不莱梅大学) ; Paderborn University(帕德博恩大学) ; Carnegie Bosch Institute(卡内基·博施研究所) ; Università degli Studi di Milano Bicocca(米兰Bicocca大学) ; TU Wien(维也纳技术大学) ; Fondazione Bruno Kessler(布鲁诺·凯撒基金会) ; University College London(伦敦大学学院) ; University of British Columbia(不列颠哥伦比亚大学) ; Vector Institute(向量研究所) ; Duolingo(多邻国) ; University of St. Gallen, Institute of Behavioral Science and Technology(圣加尔文大学行为科学与技术研究所) ; University of Applied Sciences Mittweida(梅特维达应用科学大学) ; Technical University Freiberg(弗赖贝格技术大学)
专题命中 安全评测 :alignment(abstract);分类 cs.AI
机构 * University of Ottawa(渥太华大学) ; OpenText(OpenText公司)
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL
Journal ref 2025 IEEE Symposium on Security and Privacy (SP), 2025, pp. 2791-2809
机构 * School of Information Technology, Deakin University(信息科技学院,德堪大学) ; Instituto de Computação, Universidade Federal do Amazonas(计算学院,亚马逊联邦大学)
专题命中 安全评测 :safety(abstract);分类 cs.AI
Comments 50 pages, 13 figures, 56 references. Keywords: Neurosymbolic AI, Restricted Boltzmann Machines, Logical Reasoning, SAT solving, MaxSAT, Energy-based Learning, Constrained Optimization, Modular Deep Learning
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
机构 * Department of Computer Science(计算机科学系) ; Bar-Ilan University(巴伊兰大学) ; Faculty of Engineering(工程学院)
专题命中 安全评测 :alignment(abstract);分类 cs.LG
Journal ref Transactions on Machine Learning Research, 2025
机构 * College of EME, NUST(电子工程学院,纳沃伊大学) ; University of Galway(Galway大学)
专题命中 安全评测 :safety(abstract);分类 cs.AI
Comments Accepted at ICMLA 2024
Journal ref In 2024 International Conference on Machine Learning and Applications (ICMLA), pp.939-944
机构 * Carnegie Mellon University(卡内基梅隆大学) ; University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; University of Michigan - Ann Arbor(密歇根大学安娜堡分校)
专题命中 安全评测 :alignment(abstract);分类 cs.AI
机构 * University of Toronto(多伦多大学)
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments To appear in INTERSPEECH 2025
机构 * Queen Mary University of London(伦敦女王学院) ; The Alan Turing Institute(艾伦·图灵研究所)
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments ACL25 Main
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI
机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) ; Stanford University(斯坦福大学)
专题命中 安全评测 :alignment(abstract);分类 cs.AI
机构 * Shanghai Key Lab of Intell. Info. Processing, Fudan University(上海智能信息处理关键实验室,复旦大学) ; Shanghai Collaborative Innovation Center of Intelligent Visual Computing(上海智能视觉计算协同创新中心) ; School of Computer Science and Technology, East China Normal University(东华大学计算机科学与技术学院)
专题命中 安全评测 :alignment(abstract);分类 cs.AI
机构 * Shenzhen International Graduate School(深圳国际研究生院)
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments Accepted by Interspeech 2025