Gentopia: A Collaborative Platform for Tool-Augmented LLMs
专题命中 安全评测 :safety(abstract);分类 cs.AI
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全评测 :safety(abstract);分类 cs.AI
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
Comments Accepted to MIDL 2023
专题命中 安全评测 :safety(abstract);分类 cs.CL
专题命中 安全评测 :safety(abstract);分类 cs.AI
Comments 7 pages
Journal ref 2023
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments In Findings of the Association for Computational Linguistics: EACL 2023
专题命中 安全评测 :trustworthy(abstract);分类 cs.CY
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments Computer Vision and Natural Language Processing. 21 pages, 14 figures. CVPR-2023
专题命中 安全评测 :safety(abstract);分类 cs.AI
Comments Accepted at IEEE ITSC 2023
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
Journal ref Machine Learning, 2023
专题命中 安全评测 :safety(abstract);分类 cs.AI
Comments 22 pages,2 figures, IntelliSys 2023
专题命中 安全评测 :safety(abstract);分类 cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments Accepted for publication at the Journal of Machine Learning for Biomedical Imaging (MELBA) https://www.melba-journal.org/papers/2022:019.html
Journal ref https://www.melba-journal.org/papers/2022:019.html
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments Accepted to ACL 2023 as short paper
专题命中 安全评测 :safety(abstract);分类 cs.LG
Comments Submitted for publication to "Computer Methods in Applied Mechanics and Engineering." 25 pages, 20 figures. arXiv admin note: text overlap with arXiv:1505.05424 by other authors
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments Accepted at ACL 2023, Findings
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments Accepted for publication at the Second Workshop on Knowledge Augmented Methods for NLP, colocated with KDD 2023
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
Comments The paper has been published at TMLR (see https://openreview.net/forum?id=TSy0vuwQFN)
Journal ref Transactions on Machine Learning Research (06/2023)
专题命中 安全评测 :safety(abstract);分类 cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.AI
Comments 9 pages, 6 figures, published at the Thirteenth Symposium on Educational Advances in Artificial Intelligence (EAAI-23) in the Association for the Advancement of Artificial Intelligence Conference (AAAI), 2023
专题命中 安全评测 :alignment(abstract);分类 cs.AI
Comments 12 pages, 11 figures
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments Accepted at INTERSPEECH 2021
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.CL
Comments Working in progress
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI
专题命中 安全评测 :alignment(abstract);分类 cs.AI
Comments 17 pages, 4 figures and 10 tables
专题命中 安全评测 :alignment(abstract);分类 cs.LG
Comments Requires further polishing
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL
专题命中 安全评测 :trustworthy(abstract);分类 cs.LG
专题命中 安全评测 :alignment(abstract);分类 cs.CL
Comments Accepted by ACL 2023 Findings