arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

NeurIPS

Conference on Neural Information Processing Systems · 会议 · Machine Learning

2026-08-21 至 2026-08-21 共收录 2
2608.20338 2026-08-21 cs.CL 新提交

ConceptGuard: Benchmarking Context-Sensitive Unlearning in Large Language Models

ConceptGuard:评估大语言模型中上下文敏感的遗忘能力

Sahil Kale, Ian Harris

机构 * Pune Institute of Computer Technology(浦那计算机技术学院) University of California, Irvine(加州大学欧文分校)

AI总结 该研究针对大语言模型遗忘能力评估的缺陷,提出ConceptGuard基准,聚焦两用概念,发现现有遗忘技术存在性能缺陷,为实用安全的遗忘方法提供思路。

Comments Submitted to NeurIPS E&D Track 2026; 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19727 2026-08-21 cs.LG cs.AI 新提交

A Locally Tokenized Generative Model for Robust Time-Series Watermarking

用于鲁棒时间序列水印的局部分词生成模型

Dongbin Kim, Geonwoo Shin, Yujin Choi, Soyeon Park, Jaewook Lee

机构 * Nanyang Technological University(南洋理工大学) Seoul National University(首尔大学)

AI总结 针对多变量时间序列水印受后编辑攻击可靠性失效的问题,提出L-VQVAE生成模型与LVQMark水印方法,在保留生成质量的同时稳定了攻击下的检测能力与误报行为。

Comments Submitted to NeurIPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏