Evaluating Proactive Risk Awareness of Large Language Models
评估大型语言模型的前瞻性风险意识
机构 * The Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) ; The Hong Kong Polytechnic University, Hong Kong(香港理工大学) ; Southern University of Science and Technology, Shenzhen(南方科技大学) ; Shenzhen Loop Area Institute, Shenzhen, China(深圳南山区研究院)
AI总结 本文提出前瞻性风险意识评估框架,通过Butterfly数据集评估LLMs在生态领域预见潜在危害的能力,发现响应长度限制和多模态保护盲点等问题,强调部署LLM时需加强主动防护。