Cognitive Edge Computing: A Comprehensive Survey on Optimizing Large Models and AI Agents for Pervasive Deployment
专题命中 安全评测 :alignment(abstract);safety(abstract);分类 cs.AI、cs.LG
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全评测 :alignment(abstract);safety(abstract);分类 cs.AI、cs.LG
机构 * Texas A&M University-San Antonio(德克萨斯A&M大学-圣安东尼奥分校) ; Washington University in St. Louis(华盛顿大学圣路易斯分校) ; University of Alabama(阿拉巴马大学) ; University of Kentucky(肯塔基大学)
专题命中 安全评测 :safety(abstract);trustworthy(abstract);分类 cs.AI
Comments Accepted to AAAI 2026
机构 * MIT Media Lab(MIT媒体实验室) ; MIT EECS(MIT电子工程与计算机科学系) ; MIT BCS(MIT生物科学系) ; MIT IDSS(MIT国际设计系统研究所) ; MIT CEE(MIT土木与环境工程系) ; MIT DUSP(MIT设计学教授职位) ; MIT Architecture(MIT建筑系) ; Northeastern University(东北大学) ; Brown University(布朗大学) ; McGill University(麦吉尔大学)
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.CY
Comments To appear in NeurIPS 2025 Workshop on Bridging Language, Agent, and World Models (LAW)
机构 * Salesforce AI Research(Salesforce AI研究院)
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI
Comments Technical report; 13 pages plus references and appendices
机构 * Oak Ridge National Laboratory(橡树岭国家实验室) ; Pacific Northwest National Laboratory(太平洋西北国家实验室)
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI
机构 * University of Oxford(牛津大学) ; EPFL(苏黎世联邦理工学院) ; Weizenbaum Institute Berlin(柏林Weizenbaum研究所) ; Technical University Munich(慕尼黑技术大学) ; Centre for Digital Governance, Hertie School(赫尔姆霍兹学院数字治理中心) ; Stanford University(斯坦福大学) ; UK AI Security Institute(英国人工智能安全研究所) ; SomosNLP ; Universdad Politécnica de Madrid(马德里理工大学) ; Yale University(耶鲁大学) ; Allen Institute for AI(人工智能研究所) ; University of Washington(华盛顿大学) ; Meedan ; UC Berkeley(加州大学伯克利分校)
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI
Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Track on Datasets and Benchmarks
机构 * Dublin City University(都柏林城市大学)
专题命中 安全评测 :alignment(abstract);分类 cs.AI
Comments Accepted for publication at MMM'26. Analysis code can be found here: https://github.com/allie-tran/clip-brittleness
机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; University of Chinese Academy of Sciences(中国科学院大学) ; ShanghaiTech University(上海科技大学) ; Kuaishou Technology(快手科技) ; Peng Cheng Laboratory(鹏城实验室)
专题命中 安全评测 :alignment(abstract);分类 cs.AI
Comments NeurIPS 2025 Accepted
机构 * International Institute of Information Technology, Hyderabad(国际信息科技研究所,海得拉巴) ; Microsoft Research, India(微软研究院,印度)
专题命中 安全评测 :safety(abstract);分类 cs.AI
Comments Accepted at ICML 2025 MAS Workshop. This version includes additional experiments and analysis
机构 * Kakaobank Seongnam-si Republic of Korea(韩国首尔市韩国 Kakao银行)
专题命中 安全评测 :alignment(abstract);分类 cs.AI
Comments Accepted(Oral) by ICAIF 2025. Hyunkyu Kim and Yeeun Yoo contributed equally to this work
专题命中 安全评测 :safety(abstract);分类 cs.CL
Comments 17 pages, in Spanish language
机构 * AI for Sensor Data Analytics Research Group(人工智能传感器数据解析研究组) ; Ulm University of Applied Sciences(乌尔姆应用科学大学) ; Biomechatronic Research Group(生物机械研究组) ; Institute of Computer Science(计算机科学研究所)
专题命中 安全评测 :alignment(abstract);分类 cs.AI
专题命中 安全评测 :safety(abstract);分类 cs.CL
机构 * KAIST(韩国科学技术院) ; Huazhong University of Science and Technology(华中科技大学) ; LG AI Research(LG人工智能研究) ; University of Illinois Chicago(伊利诺伊大学香槟分校)
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL
Comments EMNLP 2025 Oral