Exploring Human-AI Conceptual Alignment through the Prism of Chess
机构 * Stanford University(斯坦福大学) ; Columbia University(哥伦比亚大学) ; Kaggle ; University of Washington(华盛顿大学) ; NYU(纽约大学)
专题命中 隐私与版权 :alignment(title);分类 cs.LG
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
机构 * Stanford University(斯坦福大学) ; Columbia University(哥伦比亚大学) ; Kaggle ; University of Washington(华盛顿大学) ; NYU(纽约大学)
专题命中 隐私与版权 :alignment(title);分类 cs.LG
专题命中 隐私与版权 :alignment(abstract)