The Revolution of Multimodal Large Language Models: A Survey
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
Comments ACL 2024 (Findings)
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
Comments ACL 2024 (Findings)
专题命中 安全评测 :alignment(abstract);分类 cs.AI、cs.LG
Comments ICML 2024
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI
Comments Long paper, ACL 2024 Main
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI
Comments An extensive survey of the literature specifying algorithms and techniques enhancing the trustworthiness and understanding of Large Language Models (LLMs)
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI
Comments Accepted to ICML'24
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI
Comments Accepted by ACL-2024 main conference
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
Comments Accepted to AAAI 2024
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.AI、cs.LG
Comments Camera-ready version submitted to VISAPP 2024
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
Comments To appear at CogSci 2024
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :alignment(abstract);分类 cs.AI、cs.LG
Comments Accepted by KDD 2024
Journal ref KDD 2024
专题命中 安全评测 :safety(abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI
Comments There was a miscommunication among the co-authors, resulting in the accidental submission of this paper to arXiv. We are in need of withdrawing the paper from your platform
专题命中 安全评测 :alignment(abstract);分类 cs.CY、cs.LG
Comments BEA workshop NAACL 2024
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
Comments arXiv admin note: text overlap with arXiv:2402.09015
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI
Comments 18 pages, 2 tables
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
Comments Accepted by SIGIR'2024, full paper
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :alignment(abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
Comments 18 pages, 9 tables, 5 figures. v2 adds test IDs and image encoder citation. v3 fixes error in NPV/specificity
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.LG
Comments Published in the *Special Issue on Explainable and Interpretable Machine Learning and Data Mining* of the Springer *Data Mining and Knowledge Discovery* journal
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.LG
Comments added details about a human evaluation
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :safety(abstract);分类 cs.AI、cs.CY