ARREST: Adversarial Resilient Regulation Enhancing Safety and Truth in Large Language Models
ARREST: 对抗鲁棒调节提升大语言模型的安全性与真实性
Sharanya Dasgupta, Arkaprabha Basu, Sujoy Nath, Swagatam Das
机构
*
Electronics and Communication Sciences Unit (ECSU), Indian Statistical Institute Kolkata, University of Surrey, and Indian Institute Of Technology Delhi(电子与通信科学单元(ECSU)、印度统计研究所科钦分校、萨里大学和印度理工学院德里)
A Framework for Responsible AI Systems: Building Societal Trust through Domain Definition, Trustworthy AI Design, Auditability, Accountability, and Governance
负责任人工智能系统的设计框架:通过领域定义、可信AI设计、可审计性、可问责性和治理建立社会信任
Andrés Herrera-Poyatos, Javier Del Ser, Marcos López de Prado, Fei-Yue Wang, Enrique Herrera-Viedma, Francisco Herrera
机构
*
Deparment of Computer Science and Artificial Intelligence and Andalusian Research Institute in Data Science and Computational Intelligence (DaSCI), University of Granada(计算机科学与人工智能系和安达卢西亚数据科学与计算智能研究所(DaSCI),格拉纳达大学)
;
TECNALIA (BRTA)(TECNALIA(BRTA))
;
University of the Basque Country (UPV/EHU)(巴斯克大学(UPV/EHU))
;
School of Engineering, Cornell University(工程学院,康奈尔大学)
;
ADIA Lab(ADIA实验室)
;
Computational Research Department, Lawrence Berkeley National Laboratory(计算研究部,劳伦斯伯克利国家实验室)
;
Intelligent Systems for Robotics and Automation Laboratory, Macau University of Science and Technology(机器人与自动化智能系统实验室,澳门科学技术大学)
Safety-Utility Conflicts Are Not Global: Surgical Alignment via Head-Level Diagnosis
安全与效用冲突并非全球性:通过头部层面诊断的手术对齐
Wang Cai, Yilin Wen, Jinchang Hou, Du Su, Guoqiu Wang, Zhonghou Lv, Chenfu Bao, Yunfang Wu
机构
*
Baidu Inc.(百度公司)
;
School of Software and Microelectronics, Peking University(北京大学软件与微电子学院)
;
School of Computer Science, Peking University(北京大学计算机学院)
;
State Key Laboratory of AI Safety, Institute of Computing Technology, CAS(中国科学院计算技术研究所人工智能安全重点实验室)
CALM: A CKA-Guided Adaptive Layer-Wise Modularization Framework for LLM Quantization
CALM: 一种基于CKA的自适应层级模块化框架用于LLM量化
Jinhao Zhang, Yunquan Zhang, Daning Chen, JunSun, Zicheng Yan
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
Zhejiang University(浙江大学)
;
University of Science and Technology of China(中国科学技术大学)
CurricuLLM: Designing Personalized and Workforce-Aligned Cybersecurity Curricula Using Fine-Tuned LLMs
CurricuLLM: 利用微调大语言模型设计个性化且与劳动力市场对齐的网络安全课程
Arthur Nijdam, Harri Kähkönen, Valtteri Niemi, Paul Stankovski Wagner, Sara Ramezanian
机构
*
Lund University, Department of Electrical
;
University of Helsinki, Department of Computer Science, Helsinki, Finland
;
Helsinki Institute for Information Technology, Helsinki, Finland
;
Karlstad University, Department of Mathematics \& Computer Science, Karlstad, Sweden