Evaluation and Enhancement of Semantic Grounding in Large Vision-Language Models
专题命中 安全评测 :safety(abstract);分类 cs.CL
Comments This paper has been accepted to the AAAI'24 Workshop on Responsible Language Models (ReLM 2024)
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全评测 :safety(abstract);分类 cs.CL
Comments This paper has been accepted to the AAAI'24 Workshop on Responsible Language Models (ReLM 2024)
专题命中 安全评测 :safety(abstract);分类 cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI
Comments 16 pages, 8 figures
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
Comments 15 pages, 7 figures
专题命中 安全评测 :safety(abstract);分类 cs.AI
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments ICASSP 2024
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments Accepted to AAAI 2024
专题命中 安全评测 :safety(abstract);分类 cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL
专题命中 安全评测 :safety(abstract);分类 cs.AI
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments Accepted to and presented at NeurIPS 2023, Datasets and Benchmarks Track; fixed link formatting in the abstract
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI
Comments Link to the revised file lists: https://github.com/Digital-Dermatology/SelfClean-Revised-Benchmarks
Journal ref Proceedings of the 3rd Machine Learning for Health Symposium, PMLR 225:101-128, 2023
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments AISTATS 2023 Oral
Journal ref AISTATS 2023
专题命中 安全评测 :alignment(abstract);分类 cs.AI
Comments Code available at https://github.com/WalBouss/GEM
专题命中 安全评测 :safety(abstract);分类 cs.AI
专题命中 安全评测 :safety(abstract);分类 cs.AI
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI
专题命中 安全评测 :alignment(abstract);分类 cs.AI
Comments 12 figures,6 tables, in Chinese language
专题命中 安全评测 :safety(abstract);分类 cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments 23 pages, 10 figures
专题命中 安全评测 :trustworthy(abstract);分类 cs.CY
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
Comments 5 pages (9 total), 1 figure, submitted to NeurIPS 2023 Workshop XAIA
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.CY
Comments 11 pages.8 figures, 2 tables
专题命中 安全评测 :safety(abstract);分类 cs.AI
专题命中 安全评测 :safety(abstract);分类 cs.CL
Comments EMNLP 2023 Workshop on Benchmarking Generalisation in NLP (GenBench)
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI
Journal ref Hybrid Artificial Intelligent Systems. HAIS 2023. Lecture Notes in Computer Science(), vol 14001. Springer, Cham
专题命中 安全评测 :alignment(abstract);分类 cs.LG
Comments R0-FoMo: Workshop on Robustness of Few-shot and Zero-shot Learning in Foundation Models at NeurIPS 2023