中文

极简文本水印

机器学习 2023-10-16 v1 人工智能 密码学与安全

摘要

我们提出 Easymark,一系列极简却有效的水印。随着大语言模型(LLM)的出现,文本水印正变得愈发重要。LLM 可生成无法与人类书写文本区分的文本。这对文本的可信度是严重问题。Easymark 是针对此问题的一个简单而有效的解决方案。Easymark 可在完全不改变文本含义的情况下注入水印,同时验证者能以高可信度检测某文本是否由采用了 Easymark 的系统生成。Easymark 极易于实现,仅需数行代码。Easymark 不需要访问 LLM,因而可在 LLM 提供方不提供带水印的 LLM 时于用户侧实现。尽管简单,它在检测准确率与 BLEU 分数上均优于最先进的文本水印方法。我们还证明了完美水印的不可能性定理,其本身具有价值。该定理表明无论水印多么精巧,恶意用户都能从文本中移除它,这促使我们使用如 Easymark 般的简单水印。我们用 LLM 生成文本开展实验,确认 Easymark 可被可靠检测且不造成 BLEU 与困惑度的任何下降,并在质量与可靠性上均超越最先进水印。

关键词

引用

@article{arxiv.2310.08920,
  title  = {Embarrassingly Simple Text Watermarks},
  author = {Ryoma Sato and Yuki Takezawa and Han Bao and Kenta Niwa and Makoto Yamada},
  journal= {arXiv preprint arXiv:2310.08920},
  year   = {2023}
}