Claude将会在生成的文本内加入水印

From chatgpt

为什么所有 LLM 还没有统一采用?

最大的障碍其实就是你刚才描述的算法的攻击面

假设原文:

The economic outlook remains uncertain because inflation continues to affect consumer spending.

里面存在精心安排的 token-level watermark。

我让另一个 LLM 改写:

Persistent inflation is still weighing on household expenditure, leaving the economic outlook unclear.

语义几乎一样,但 token 基本换掉了。

于是:

watermarked tokensparaphrase​new tokens

原来的统计信号可能迅速下降。

2026 年的一篇最新评估甚至专门测试了 KGW、Unigram 和 SynthID 类文本水印在 paraphrase attack 下的表现,发现改写仍然是非常严重的问题。