arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

2026-05-12 至 2026-05-12 共收录 3
2605.09973 2026-05-12 cs.CL cs.AI

GLiNER2-PII: A Multilingual Model for Personally Identifiable Information Extraction

GLiNER2-PII:一种多语言的个人可识别信息提取模型

Urchade Zaratiana, Ash Lewis, George Hurn-Maloney

机构 * OpenAI Zaratiana et al.(Zaratiana 等)

AI总结 GLiNER2-PII通过构建多语言合成语料库,实现了对42种PII实体类型的高效识别,在SPY基准测试中取得最高span-level F1分数。

Comments Under submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09493 2026-05-12 cs.AI cs.LG

Consensus Sampling for Safer Generative AI

共识采样用于更安全的生成式AI

Adam Tauman Kalai, Yael Tauman Kalai, Or Zamir

机构 * OpenAI MIT(麻省理工学院) Tel Aviv University(特拉维夫大学)

AI总结 本文提出共识采样算法,通过聚合多个概率分布提升生成模型安全性,其在保证安全性的前提下有效避免分歧,通过R-鲁棒性理论保障信息泄露和对抗影响的界限,实验验证了其在合成分布和图像生成中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02372 2026-05-12 cs.CR cs.AI cs.SE

Scam2Prompt: A Scalable Framework for Auditing Malicious Scam Endpoints in Production LLMs

Scam2Prompt: 一种可扩展的框架,用于审计生产LLM中的恶意诈骗端点

Zhiyang Chen, Tara Saba, Xun Deng, Xujie Si, Fan Long

机构 * OpenAI

AI总结 Scam2Prompt通过生成开发者风格提示来测试LLM生成恶意代码的能力,发现4.24%的LLM会生成恶意URL,且在2025年发布的七种LLM中,恶意代码生成率高达12.9%-47.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏