Safety in Embodied AI: A Survey of Risks, Attacks, and Defenses
具身人工智能的安全性:风险、攻击与防御综述
Xiao Li, Xiang Zheng, Yifeng Gao, Xinyu Xia, Yixu Wang, Xin Wang, Ye Sun, Yunhan Zhao, Ming Wen, Jiayu Li, Zixing Chen, Xun Gong, Yi Liu, Yige Li, Yutao Wu, Cong Wang, Jun Sun, Yixin Cao, Zhineng Chen, Jingjing Chen, Tao Gui, Qi Zhang, Zuxuan Wu, Xipeng Qiu, Xuanjing Huang, Tiehua Zhang, Zhipeng Wei, Kun Wang, Xinfeng Li, Hanxun Huang, Sarah Erfani, James Bailey, Jianping Wang, Chaowei Xiao, Ran He, Bo Li, Xingjun Ma, Yu-Gang Jiang
机构
*
Fudan University(复旦大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
City University of Hong Kong(香港城市大学)
;
Jilin University(吉林大学)
;
Singapore Management University(新加坡管理大学)
;
Deakin University(德肯大学)
;
Tongji University(同济大学)
;
Nanyang Technological University(南洋理工大学)
;
Chinese Academy of Sciences(中国科学院)
;
The University of Melbourne(墨尔本大学)
;
Johns Hopkins University(约翰霍普金斯大学)
CommentsSurvey paper; 75 pages, 4 figures, 18 tables; v2 expands embodied-specific coverage of agentic threats, World Action Model threats, and contextual risk mitigation, with over 100 new references added. Project page: https://x-zheng16.github.io/Awesome-Embodied-AI-Safety/
机构
*
Peking University(北京大学)
;
Renmin University of China(中国人民大学)
;
Tsinghua University(清华大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Tencent Hunyuan(腾讯混元)
机构
*
Australian National University(澳大利亚国立大学)
;
The University Of Queensland(昆士兰大学)
;
Peking University(北京大学)
;
GE research(通用电气研究院)
;
CSIRO(澳大利亚联邦科学与工业研究组织)
机构
*
The Hong Kong University of Technology and Science (Guangzhou)(香港科技与应用科技大学(广州))
;
East China Normal University(华东师范大学)
;
Shanghai Qi Zhi Institute(上海启智研究院)
;
Wuhan University(武汉大学)
;
Institute of Deep Perception Technology, JITRI(视觉感知技术研究院,JITRI)
;
CAIR, Hong Kong Institute of Science and Innovation (HKISI)(创新科技研究院,香港科学与创新研究院(HKISI))
;
MAIS, Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院)
Ge Shi, Jun Yin, Donglin Xie, Fangyi Liu, Yucan Li, Menglin Liu
机构
*
University of California, Davis(加州大学戴维斯分校)
;
The Renmin University of China(中国人民大学)
;
Independent Researcher(独立研究员)
;
Nankai University(南开大学)
;
Cornell University(康奈尔大学)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
One Jailbreak, Many Tongues: Learning Language-Insensitive Intention Representations for Multilingual Jailbreak Detection
一次越狱,多种语言:学习语言无关的意图表示用于多语言越狱检测
Shuyu Jiang, Kaiyu Xu, Xingshu Chen, Hao Ren, Rui Tang, Yi Zhang, Tianwei Zhang, Hongwei Li
机构
*
School of Cyber Science and Engineering, Sichuan University(四川大学网络空间安全学院)
;
School of Computer Science and Engineering, Nanyang Technological University(南洋理工大学计算机科学与工程学院)
;
School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院)
Zhanhao Hu, Xiao Huang, Patrick Mendoza, Emad A. Alghamdi, Basel Alomair, Raluca Ada Popa, David Wagner
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
HUMAIN
;
King Abdulaziz City for Science and Technology(国王阿卜杜勒阿齐兹科学与技术城)
;
University of Washington, Seattle(华盛顿大学(西雅图))
StructBreak: Structural Cognitive Overload-Induced Safety Failures in MLLMs
StructBreak: 多模态大语言模型中结构性认知过载引发的安全故障
Yang Luo, Xinran Liu, Tiantian Ji, Zhiyi Yin, Lingyun Peng, Shuyu Li
机构
*
Key Laboratory of Trustworthy Distributed Computing and Service (MoE), Beijing University of Posts and Telecommunications(可信分布式计算与服务重点实验室(MoE),北京邮电大学)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
EVA: Editing for Versatile Alignment against Jailbreaks
EVA:针对对抗性攻击的多功能对齐编辑
Yi Wang, Hongye Qiu, Yue Xu, Sibei Yang, Zhan Qin, Minlie Huang, Wenjie Wang
机构
*
ShanghaiTech University(上海科技大学)
;
Sun Yat-sen University(中山大学)
;
State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室)
;
Tsinghua University(清华大学)
Model-Agnostic Lifelong LLM Safety via Externalized Attack-Defense Co-Evolution
基于外部化攻击-防御共演的模型无关持续LLM安全
Xiaozhe Zhang, Chaozhuo Li, Hui Liu, Shaocheng Yan, Bingyu Yan, Qiwei Ye, Haoliang Li
机构
*
City University of Hong Kong(香港城市大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Wuhan University(武汉大学)
;
Beihang University(北京航空航天大学)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)