arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2025-08-27 至 2025-08-27 共收录 35 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 8 篇

2508.19089 2025-08-27 cs.CL 57%

It's All About In-Context Learning! Teaching Extremely Low-Resource Languages to LLMs

Yue Li, Zhixue Zhao, Carolina Scarton

机构 * Department of Computer Science, University of Sheffield, UK(计算机科学系,谢菲尔德大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

Comments Accepted by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18954 2025-08-27 cs.LG 57%

On the Generalisation of Koopman Representations for Chaotic System Control

Kyriakos Hjikakou, Juan Diego Cardenas Cartagena, Matthia Sabatelli

专题命中 其他安全 :safety(abstract);分类 cs.LG

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18763 2025-08-27 cs.AI 57%

Dynamic Collaboration of Multi-Language Models based on Minimal Complete Semantic Units

Chao Hao, Zezheng Wang, Yanhua Huang, Ruiwen Xu, Wenzhe Niu, Xin Liu, Zitong Yu

专题命中 其他安全 :alignment(abstract);分类 cs.AI

Comments Accepted by EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18381 2025-08-27 cs.CL 57%

Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models

Yuchun Fan, Yilin Wang, Yongyu Mu, Lei Huang, Bei Li, Xiaocheng Feng, Tong Xiao, Jingbo Zhu

专题命中 其他安全 :alignment(abstract);分类 cs.CL

Comments Accepted by EMNLP 2025 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18675 2025-08-27 cs.SE 50%

Requirements Development and Formalization for Reliable Code Generation: A Multi-Agent Vision

Xu Lu, Weisong Sun, Yiran Zhang, Ming Hu, Cong Tian, Zhi Jin, Yang Liu

专题命中 其他安全 :alignment(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏