XXAI: Towards eXplicitly eXplainable Artificial Intelligence
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments 18 pages, 1 graphical abstract, 1 figure, 72 references
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments 18 pages, 1 graphical abstract, 1 figure, 72 references
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI
Comments 5 pages, multimodal ethical dataset building, accepted in the NeurIPS 2023 MP2 workshop
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.CY
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI
Comments 14 pages, 9 figures
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CY
Comments This is an English version of the original article arXiv:2405.00225v1 [cs.CY] (Hacia una implementación ética e inclusiva de la Inteligencia Artificial en las organizaciones: un marco multidimensional)
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CY
Comments in Spanish language
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments to be published in 32nd IEEE International Requirements Engineering 2024 Conference (RE'24) - Doctoral Symposium. arXiv admin note: text overlap with arXiv:2404.14356
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments 109 pages, 5 figures, submitted to Automation in Construction
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments 17 pages, 9 figures
专题命中 AI治理与伦理 :safety(abstract);分类 cs.LG
Comments Changed hyper-parameter choice which affects some of the convergence rate results in the paper
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.CY
Comments Privacy Law Scholars Conference 2023; Common Market Law Review (forthcoming)
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
Comments The first two authors contribute equally
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.LG
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
Comments Figures can be accessed at: https://github.com/lheim/CPGAI-Figures
专题命中 AI治理与伦理 :safety(abstract);分类 cs.LG
Comments AI for Science Workshop, NeurIPS 2023. 11 pages, 5 figures, 4 tables
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI
Comments preprint
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
Comments Camera-ready for EACL 2024
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
Comments EACL 2024 SRW
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI
Comments IEEE ICCE 2024
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.LG
Comments Accepted to Machine Learning and the Physical Sciences Workshop, NeurIPS 2023
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.LG
Comments 15 pages, 4 figures, 3 tables. To appear in Algorithmic Fairness through the Lens of Time Workshop at NeurIPS 2023
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.CL
Comments 15 pages (incl Appendix), 4 figures, 8 tables
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL
Comments Accepted to EMNLP Industry Track 2023
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.LG
Comments 31 pages, 20 figures
Journal ref NeurIPS 2023
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments Working Paper
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.LG
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI