Aligned at the Start: Conceptual Groupings in LLM Embeddings
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY、cs.LG
Comments Cooperative AI Foundation, Technical Report #1
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.CY
Comments 30 pages
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.CY
Comments Preprint to be published in Proceedings of PACLIC38
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY、cs.LG
Journal ref Transformers and large language models in healthcare: A review, Artificial Intelligence in Medicine, Volume 154, 2024, 102900,
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY、cs.LG
Comments 19 pages, 6 figures, submitted to Conference ICADCML2025
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY、cs.LG
Comments MICCAI 2024 Workshop on Fairness of AI in Medical Imaging
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY、cs.LG
Comments 28 pages, 4 figures, 2 tables
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY、cs.LG
Comments Accepted by ACM Multimedia 2024. The dataset and code can be found at https://github.com/achernarwang/LiVO
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Paper under review
专题命中 AI治理与伦理 :safety(abstract);trustworthy(abstract)
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY、cs.LG
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted in ICPR 2024
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY、cs.LG
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL、cs.AI、cs.CY
Comments Updated with fine-tuned model results to match CoLM accepted camera-ready version
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL、cs.AI、cs.CY
Comments Accepted at Artificial Intelligence, Ethics, and Society 2024
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 28 pages, 5 figures
专题命中 AI治理与伦理 :jailbreak(abstract);分类 cs.CL、cs.AI、cs.CY
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted by ACL 2024 findings, this is the camera-ready version; 21 pages, 22 figures
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.CY
Comments Findings of ACL 2024
专题命中 AI治理与伦理 :RLHF(abstract);分类 cs.AI、cs.CY、cs.LG
Comments 10 pages
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.CY
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.CY、cs.LG
专题命中 AI治理与伦理 :RLHF(abstract);分类 cs.AI、cs.CY、cs.LG
Comments TACL 2024. Presented at ACL 2024. 12 pages
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.CY
Comments Accepted by ICLR 2024
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY、cs.LG
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.CY
Comments 8 pages, 4 tables, 2 figures