Evaluating Intra-firm LLM Alignment Strategies in Business Contexts
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.CY
Comments 9 pages, 0 figures
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.CY
Comments 9 pages, 0 figures
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.CL
Comments 15 pages, 1 table, 1 figure
机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
专题命中 AI治理与伦理 :safety(title,abstract);分类 cs.CL
机构 * Metropolia University of Applied Sciences(梅拉利亚应用科学大学)
专题命中 AI治理与伦理 :safety(title,abstract);分类 cs.CL
Journal ref Proceedings of the 5th International Conference on Natural Language Processing for Digital Humanities, 2025
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.LG
专题命中 AI治理与伦理 :trustworthy(title,abstract);分类 cs.AI
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.AI
Comments 23 pages
专题命中 AI治理与伦理 :safety(title,abstract);分类 cs.AI
专题命中 AI治理与伦理 :safety(title,abstract);分类 cs.CL
专题命中 AI治理与伦理 :safety(title,abstract);分类 cs.AI
Comments IEEE Summit on Reliability, Availability and Serviceability, 2024
专题命中 AI治理与伦理 :safety(title,abstract);分类 cs.CL
Comments Accepted at AAAI Conference on Web and Social Media (ICWSM) 2025. [Dataset](https://huggingface.co/datasets/SoftMINER-Group/TechHazardQA)
专题命中 AI治理与伦理 :safety(title,abstract);分类 cs.AI
Comments 21 pages, 5 figures
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.CL
Comments Accepted to NeurIPS 2024, SoLaR workshop
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.AI
专题命中 AI治理与伦理 :safety(title,abstract);分类 cs.CY
Comments Tech Policy Press
专题命中 AI治理与伦理 :trustworthy(title,abstract);分类 cs.AI
Comments 44 pages, 2 figures
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.LG
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.LG
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.CL
Comments NAACL 2024; Our code is available at https://github.com/chongli17/CrossLingualAlignment
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.AI
Comments This paper has been accepted by ICML2024
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.LG
Comments Published at IEEE Big Data 2023
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.AI
专题命中 AI治理与伦理 :trustworthy(title,abstract);分类 cs.LG
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.AI
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.CY
专题命中 AI治理与伦理 :safety(title,abstract);分类 cs.LG
Comments Submitted to Journal:Accident Analysis and Prevention
专题命中 AI治理与伦理 :safety(title,abstract);分类 cs.AI
Comments In Proceedings AREA 2023, arXiv:2310.00333
Journal ref EPTCS 391, 2023, pp. 83-88
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.CL
专题命中 AI治理与伦理 :safety(title,abstract);分类 cs.CY
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.LG
Comments Accepted for publication in IEEE Global Communications Conferences (GLOBECOM), 2022