From chatgpt
为什么所有 LLM 还没有统一采用?
最大的障碍其实就是你刚才描述的算法的攻击面。
假设原文:
The economic outlook remains uncertain because inflation continues to affect consumer spending.
里面存在精心安排的 token-level watermark。
我让另一个 LLM 改写:
Persistent inflation is still weighing on household expenditure, leaving the economic outlook unclear.
语义几乎一样,但 token 基本换掉了。
于是:
watermarked tokensparaphrasenew tokens
原来的统计信号可能迅速下降。
2026 年的一篇最新评估甚至专门测试了 KGW、Unigram 和 SynthID 类文本水印在 paraphrase attack 下的表现,发现改写仍然是非常严重的问题。