ECOR: Explainable CLIP for Object Recognition
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.LG
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :jailbreak(abstract);分类 cs.CL、cs.AI
Comments Accepted by NAACL 2024. Jiabao, Bairu, Zhen, Guanhua contributed equally. This is an updated version of the paper: arXiv:2307.07171
专题命中 安全评测 :safety(abstract);分类 cs.AI、cs.LG
Comments 9 pages, 5 figures
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.LG
Comments Under review
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :alignment(abstract);分类 cs.AI、cs.LG
Comments Accepted in Machine Learning and the Physical Sciences Workshop at NeurIPS 2023; 9 pages, 2 figures, 1 table
专题命中 安全评测 :alignment(abstract);分类 cs.AI、cs.LG
Comments Accepted to 2024 CVPR 3rd Explainable AI for Computer Vision (XAI4CV) Workshop
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.CY
Comments This paper has been accepted by ACM ASIACCS 2024
专题命中 安全评测 :safety(abstract);分类 cs.AI、cs.CY
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.LG
Comments Paper accepted in Human-Centric Representation Learning workshop at AAAI 2024 (https://hcrl-workshop.github.io/2024/). Paper accepted and presented at Deployable AI Workshop at AAAI-2024 (https://sites.google.com/view/dai-2024/home)
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
Comments Data: https://github.com/seketeam/EvoCodeBench
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
Comments 22 pages, camera-ready version; references added, typos corrected, methodology section expanded, additional table
专题命中 安全评测 :alignment(abstract);分类 cs.AI、cs.CY
专题命中 安全评测 :safety(abstract);分类 cs.AI、cs.LG
Comments Accepted by CVPR-2024
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI
Comments 21 pages, 7 figures, 4 tables
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.LG
Comments Accepted to ICLR 2024
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
Comments CVPR 2024; project page: https://dpt-t2i.github.io/
专题命中 安全评测 :safety(abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.AI、cs.LG
Comments Manuscript under peer review
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.LG
Comments ICLR 2024
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :alignment(abstract);分类 cs.AI、cs.LG
Comments Accepted by CVPR 2024
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
Comments Accepted to CHI 2024
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI
Comments NeurIPS 2023 Outstanding Paper (Datasets and Benchmarks Track)
专题命中 安全评测 :alignment(abstract);分类 cs.AI、cs.LG
Comments Ongoing work; 41 pages (Main Text), 55 pages (Total), 11 Tables, 13 Figures, 619 citations; Paper list is available at https://github.com/zjukg/KG-MM-Survey