arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2025-08-21 至 2025-08-21 共收录 2 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 安全训练 2 篇

2504.16133 2025-08-21 cs.CY cs.AI 62%

A Conceptual Framework for AI-based Decision Systems in Critical Infrastructures

Milad Leyli-abadi, Ricardo J. Bessa, Jan Viebahn, Daniel Boos, Clark Borst, Alberto Castagna, Ricardo Chavarriaga, Mohamed Hassouna, Bruno Lemetayer, Giulia Leto, Antoine Marot, Maroua Meddeb, Manuel Meyer, Viola Schiaffonati, Manuel Schneider, Toni Waefler

机构 * IRT SystemX(IRT系统X) INESC TEC TenneT SBB Delft University of Technology(代尔夫特理工大学) EnliteAI Zurich University of Applied Science(苏黎世应用科学大学) Réseau de Transport d’Electricité(电力传输网络) Flatland Association(Flatland协会) Politecnico di Milano(米兰理工大学) University of Applied Sciences Northwestern Switzerland(瑞士西北应用科学大学) Fraunhofer IEE(弗劳恩霍夫研究所)

专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.CY

Journal ref 2025 IEEE International Conference on Systems, Man, and Cybernetics (SMC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14235 2025-08-21 cs.RO 50%

SLAM-based Safe Indoor Exploration Strategy

Omar Mostafa, Nikolaos Evangeliou, Anthony Tzes

机构 * Center for Artificial Intelligence \& Robotics (CAIR) New York University Abu Dhabi (NYUAD) United Arab Emirates Robotics \& Intelligent Systems Control Lab NYUAD United Arab Emirates

专题命中 安全训练 :safety(abstract)

Comments 5 pages, 8 figures. Published in the 2025 11th International Conference on Automation, Robotics, and Applications (ICARA)

Journal ref 2025 11th International Conference on Automation, Robotics, and Applications (ICARA), pp. 375-379

详情

展开后加载摘要…

URL PDF HTML 收藏