ELF-Gym: Evaluating Large Language Models Generated Features for Tabular Prediction
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);trustworthy(abstract)
Comments 20 Pages, 14 figure, Journal
专题命中 安全评测 :DPO(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.LG
Comments EMNLP 2024 Industry Track
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted by NeurIPS 2024
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.CY、cs.LG
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
Comments EMNLP 2024 Findings. This version extends the training with recent LLMs, evaluation with new metrics, and NLU tasks
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.CY
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI、cs.CY
Comments 17 pages
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Paper was accepted at ACM KDD -2024 -- Undergraduate Consortium. Please find the link: https://kdd2024.kdd.org/undergraduate-consortium/
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.AI、cs.CY、cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Survey paper
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.CY、cs.LG
Comments A preprint, 17 pages. 11 images
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI、cs.LG
Comments ACL 2024;Benchmark at https://github.com/c-box/StructEval ;Leaderboard at https://huggingface.co/spaces/Bowieee/StructEval_leaderboard
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Paper published at Machine Learning for Healthcare 2024 (MLHC'24)
专题命中 安全评测 :alignment(abstract);trustworthy(abstract)
Comments preprint
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
Comments ACL 2024 Workshop Towards Knowledgeable Language Models
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Survey Article for the ACM SIGKDD International Conference on Knowledge Discovery and Data Mining (KDD 2024) Tutorial
Journal ref Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD 2024)
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Code available at https://github.com/pliang279/HEMM
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.CY