arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-01-13 至 2026-01-13 共收录 2 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 隐私与版权 2 篇

2601.06049 2026-01-13 cs.CY cs.AI 81%

The Violation State: Safety State Persistence in a Multimodal Language Model Interface

违规状态:多模态语言模型接口中的安全状态持续

Bentley DeVilling

专题命中 隐私与版权 :safety(title,abstract);分类 cs.AI、cs.CY

AI总结 研究发现多模态语言模型在面对版权拒绝后,会持续拒绝无关图像生成请求,揭示了会话级安全状态的持续性问题。

Comments 19 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06232 2026-01-13 cs.CR cs.AI 70%

Multi-Agent Framework for Controllable and Protected Generative Content Creation: Addressing Copyright and Provenance in AI-Generated Media

可控且受保护的生成内容创作多智能体框架:解决人工智能生成媒体中的版权和来源问题

Haris Khan, Sadia Asif, Shumaila Asif

机构 * National University of Sciences(国家科学与技术大学) Rensselaer Polytechnic Institute New York, United States(新泽西理工学院纽约分校)

专题命中 隐私与版权 :alignment(abstract);trustworthy(abstract);分类 cs.AI

AI总结 本文提出一种多智能体框架,通过集成水印和智能体角色解决生成内容的可控性和版权问题,提升语义对齐和水印恢复率。

Journal ref IEEE ICDM Visionary Innovation in Standards and Technology of GenAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏