AI for Social Impact: Learning and Planning in the Data-to-Deployment Pipeline
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY、cs.LG
Comments AI Magazine, Winter 2020
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY、cs.LG
Comments AI Magazine, Winter 2020
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
Comments 17 pages, 4 Figures, 2 Tables
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY
Comments This paper is a curated version of my keynote at the Web Conference 2022. arXiv admin note: substantial text overlap with arXiv:2202.07446
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY
Comments Prepared for the Oxford Handbook of AI Governance (23 pages, 2 figures)
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL、cs.AI
Comments To appear at ACM FAccT'22
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
Comments 34 pages
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
Comments 9 pages
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY、cs.LG
Comments 40 pages, 4 figures, 2 tables, 7 supplementary figures, 4 supplementary tables; revised to improve clarity and discussion
Journal ref Nat Mach Intell 3, 896-904 (2021)
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY、cs.LG
Journal ref Equity and Access in Algorithms, Mechanisms, and Optimization (EAAMO 2021)
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI
Comments 17 pages including references and appendix. To appear in EMNLP 2021 (camera-ready ver.)
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI、cs.CY
Comments 45 pages, 8 figures
Journal ref Journal of Artificial Intelligence Research 71 (2021) 1137-1181
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.CL、cs.AI
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL、cs.AI
Comments Accepted to the 35th Conference on Neural Information Processing Systems (NeurIPS 2021) Track on Datasets and Benchmarks
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CY、cs.LG
Comments Originally presented at the ICML 2020 Participatory Approaches to Machine Learning workshop
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI、cs.CY
Comments 12 pages, 2 figures, 3 tables
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.LG
Comments (Nahian and Frazier contributed equally to this work)
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.LG
Comments In Proceedings of the AAAI 2021 Conference. Supersedes arXiv:1902.09980, arXiv:2001.07118
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.LG
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI、cs.CY
Comments A Computing Community Consortium (CCC) white paper, 5 pages
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI、cs.LG
Comments AISTATS 2020
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CY、cs.LG
Comments Where is the Human? Bridging the Gap Between AI and HCI, CHI Workshop 2019
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.CY、cs.LG
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY、cs.LG
Comments 4 pages, 4th Multidisciplinary Conference on Reinforcement Learning and Decision Making
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
Comments 31 pages
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CY、cs.LG
Comments To appear in the 2019 ACM CHI Conference on Human Factors in Computing Systems (CHI 2019)
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.LG
Comments Published in proceedings of the 16th International Conference on Autonomous Agents and Multi-agent Systems
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY
Comments 14 pages, typo fixed in v2
Journal ref Big Data & Society 4(2). 2017