A Concrete Roadmap towards Safety Cases based on Chain-of-Thought Monitoring
机构 * Meridian Research, Cambridge(梅迪安研究,剑桥)
专题命中 幻觉与事实性 :safety(title,abstract);分类 cs.AI、cs.LG
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
机构 * Meridian Research, Cambridge(梅迪安研究,剑桥)
专题命中 幻觉与事实性 :safety(title,abstract);分类 cs.AI、cs.LG
机构 * Department of Computer Engineering, LDRP Institute of Technology and Research(计算机工程系,LDRP技术与研究学院) ; University of Wollongong(沃林根大学) ; Monash University(莫纳什大学)
专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL、cs.AI
Comments Accepted for publication in the Proceedings of the 8th International Conference on Algorithms, Computing and Artificial Intelligence (ACAI 2025)
机构 * Wangxuan Institute of Computer Technology, Peking University(王轩计算机技术研究所,北京大学) ; Trustworthy Technology and Engineering Laboratory, Huawei(可信技术与工程实验室,华为)
专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL