Designing for Responsible Trust in AI Systems: A Communication Perspective
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI
Comments FAccT 2022 paper draft
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI
Comments FAccT 2022 paper draft
专题命中 安全评测 :safety(abstract);分类 cs.CL
Comments To be published in proceedings of ACL 2022
专题命中 安全评测 :safety(abstract);分类 cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI
专题命中 安全评测 :alignment(abstract);分类 cs.LG
Comments It is submitted to EMBC 2022 and is currently under review
专题命中 安全评测 :safety(abstract);分类 cs.CY
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments Long paper (multilingual track) to appear at ACL (Findings) 2022
专题命中 安全评测 :safety(abstract);分类 cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
Comments To appear in Proceeding of WWW 2022. This work extends our prior work (arXiv:1810.02923, arXiv:1906.09264, arXiv:1902.10658) and put them in perspectives along with many other ongoing research in this direction
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI
Comments 11 pages, 21 Figures (out of which 17 sub-figures), 1 table
Journal ref MDPI Sensors 2022
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
Comments Accepted by the AAAI2022 Workshop on Adversarial Machine Learning and Beyond as a competition paper
专题命中 安全评测 :alignment(abstract);分类 cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments 4 pages, 6 figures. Submitted to 2022 American Nuclear Society Annual Meeting
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments Accepted to 2022 IEEE International Conference on Robotics and Automation (ICRA)
专题命中 安全评测 :safety(abstract);分类 cs.AI
Comments 15 pages
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments 35 pages with 1.5 spacing, 6 figures
专题命中 安全评测 :alignment(abstract);分类 cs.LG
Comments Supplementary information: Supplementary data files are available as part of the GitHub repository
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments 12 pages, 25 figures, 2 tables
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments 21 pages, 9 figures, 5 tables. IEEE Transactions on Artificial Intelligence, 2021, early access
专题命中 安全评测 :alignment(abstract);分类 cs.AI
Comments Accepted to AAAI Workshop on Adversarial Machine Learning and Beyond 2022
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments Accepted at Adversarial Machine Learning (AdvML) workshop, AAAI 2022
专题命中 安全评测 :safety(abstract);分类 cs.LG
Journal ref Reinforcement Learning for Real Life Workshop, ICML 2021
专题命中 安全评测 :safety(abstract);分类 cs.AI
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI
Comments Preprint of paper accompanying keynote address at the 6th International Conference on Lean and Agile Software Development (Jan 22, 2022)
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments 31 pages, 17 figures
专题命中 安全评测 :alignment(abstract);分类 cs.AI