Large Language Model's Multi-Capability Alignment in Biomedical Domain
专题命中 安全训练 :alignment(title,abstract);safety(abstract);分类 cs.AI
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全训练 :alignment(title,abstract);safety(abstract);分类 cs.AI
机构 * Zhejiang University(浙江大学) ; Xiamen University(厦门大学) ; Shanghai Jiao Tong University(上海交通大学)
专题命中 安全训练 :safety(title,abstract);分类 cs.CL、cs.AI
机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) ; Nanyang Technological University(南洋理工大学) ; University of Chinese Academy of Sciences(中国科学院大学)
专题命中 安全训练 :safety(abstract);分类 cs.AI
专题命中 安全训练 :trustworthy(abstract);分类 cs.LG