ARREST: Adversarial Resilient Regulation Enhancing Safety and Truth in Large Language Models
ARREST: 对抗鲁棒调节提升大语言模型的安全性与真实性
Sharanya Dasgupta, Arkaprabha Basu, Sujoy Nath, Swagatam Das
机构
*
Electronics and Communication Sciences Unit (ECSU), Indian Statistical Institute Kolkata, University of Surrey, and Indian Institute Of Technology Delhi(电子与通信科学单元(ECSU)、印度统计研究所科钦分校、萨里大学和印度理工学院德里)
A Framework for Responsible AI Systems: Building Societal Trust through Domain Definition, Trustworthy AI Design, Auditability, Accountability, and Governance
负责任人工智能系统的设计框架:通过领域定义、可信AI设计、可审计性、可问责性和治理建立社会信任
Andrés Herrera-Poyatos, Javier Del Ser, Marcos López de Prado, Fei-Yue Wang, Enrique Herrera-Viedma, Francisco Herrera
机构
*
Deparment of Computer Science and Artificial Intelligence and Andalusian Research Institute in Data Science and Computational Intelligence (DaSCI), University of Granada(计算机科学与人工智能系和安达卢西亚数据科学与计算智能研究所(DaSCI),格拉纳达大学)
;
TECNALIA (BRTA)(TECNALIA(BRTA))
;
University of the Basque Country (UPV/EHU)(巴斯克大学(UPV/EHU))
;
School of Engineering, Cornell University(工程学院,康奈尔大学)
;
ADIA Lab(ADIA实验室)
;
Computational Research Department, Lawrence Berkeley National Laboratory(计算研究部,劳伦斯伯克利国家实验室)
;
Intelligent Systems for Robotics and Automation Laboratory, Macau University of Science and Technology(机器人与自动化智能系统实验室,澳门科学技术大学)