你用Claude写的每一段字,都被盖了一个看不见的章
AI圈这几天最热闹的争论,不是哪家又发了新模型,而是一个你看不见的水印。
事情从8月11日说起。Anthropic官宣:8月2日之后发布的所有Claude模型,生成的文本会自动嵌入一层隐形统计水印——肉眼不可见,机器可检测,复制粘贴到别处也带得走。
覆盖范围是全家桶级别的:claude.ai网页版、API、Claude Code、Cowork,连AWS、Google Cloud、微软Foundry上调用的Claude模型也全部在内。文件类输出(PNG、JPG、SVG)则按C2PA标准附加签名溯源信息。

原因也不复杂:欧盟AI法案的透明度准则8月2日生效,要求AI生成内容必须可被机器识别,违者最高罚1500万欧元或全球年营收的3%。
值得注意的是,欧盟的合规要求,Anthropic直接全球生效——官方解释是暂时没有可靠的分区域方案,索性一步到位。
而且,用户关不掉。
8月14日,Anthropic进一步公开了技术细节:这套水印是Google DeepMind SynthID-Text方案的一个变体——通过微调模型选词时的采样过程,在文本里留下统计指纹。
争议的火苗,就是从这里烧起来的。
苹果圈第一博主,掀了桌子
8月16日,Daring Fireball博主John Gruber——苹果圈最有影响力的独立评论人——发了一篇檄文,标题火药味十足:
《Anthropic的"水印"式文本掺假,是对写作的亵渎》。

他的核心论点直指技术原理:既然水印靠偏置模型的选词来留指纹——那就意味着,为了埋水印,Claude有时会放弃"最准的那个词",改选"能配合水印的那个词"。
而Anthropic的官方文档写的是:"不可感知,不会改变回复的含义、质量或可读性。"
Gruber不买账。他的原话是:
任何同义词之间都不存在完全相同的含义。除了「我的需求」之外,任何东西都要在「为我生成的文本」里插一脚——这本身就是冒犯。
他还点出一个扎心的连锁反应:水印会作用于所有超过200 token的输出(据其文中描述),包括私人对话和润色场景——
从今以后,没人敢再用Claude给自己的文章做校对了,除非你能接受整篇文字被标记为"Claude生成"的风险。
最讽刺的一笔:Anthropic在解释水印时引用了奥威尔的《1984》,而Gruber认为,"具体的用词很重要"恰恰是奥威尔对语言腐蚀的核心警告。
他不是唯一开炮的大V。Stratechery的Ben Thompson随后也发文分析,标题的判断更直接:"比看起来更糟"。
技术圈吵成两派
Gruber的文章在Hacker News上冲到215赞、199条评论,评论区直接裂成两半。
反方替Gruber补刀。有人说"没人敢用Claude做校对"这个后果,恐怕就是设计意图本身;还有工程师提出更实际的问题:代码和结构化输出根本没有选词自由度,水印到底怎么打?
正方则认为Gruber根本搞错了原理。一条高赞评论毫不客气:
这么聪明的人竟然不理解Gumbel softmax技术。它可证明地不影响写作质量——正因为"下一个词"本来就没有100%确定的最优解,这个技巧才成立。

换句话说:LLM选词本来就是按概率分布抽签,水印只是换了一种抽签方式,并没有改变分布本身。
面对争议,有Anthropic工程师出面回应了三点:检测API正在路上;模型本身并不知道自己被打了水印;以及一句实在话——
它不完美,你可以通过编辑去掉它,但这是第一步。
两边说的都有道理,分歧其实在一个更根本的问题上:"统计上无损"和"每一个词都是我要的",是不是一回事?
值得一提的是,Anthropic自己的文档反倒相当克制——明确承认存在误报(Claude只是帮你翻译或校对过,也可能被检出水印)和漏报(重度编辑、格式转换都可能洗掉水印),检测结果只能说明内容"可能经过Claude处理",而非"由Claude创作"。
吵归吵,水印已经是既成事实——关不掉,8月2日后的新模型全部默认携带。
对日常用Claude处理中文内容的人来说,眼下真正要紧的其实只有一件事:重要文稿,留好自己写的底稿。"帮我润色"的文字同样可能被打上标记,原始版本单独存一份,将来能自证哪些是人写的。
检测API还没上线,中文场景的实际检出率是未知数,不必恐慌。但"AI参与了多少"这件事,以后会越来越藏不住——与其研究怎么洗掉水印,不如把"用了AI就大方说"变成习惯。这波监管,冲的是"藏",不是"用"。
对了。同一周,Claude的系统提示词(System Prompts)也在官网公开上线,HN上冲到642赞。
一边把"AI怎么想"摊开给你看,一边给"AI写了什么"盖上隐形章。透明这件事,Anthropic是认真的,也是强硬的。
至于你我手里的文字——从今往后,是人写的还是AI写的,纸上见真章。
参考链接:
[1] https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content
[2] https://daringfireball.net/2026/08/anthropics_watermark_text_adulteration_in_claude_is_a_perversion_of_writing
[3] https://stratechery.com/2026/anthropics-watermarking-how-it-probably-works-worse-than-it-seems/
[4] https://news.ycombinator.com/item?id=49324087
[5] https://techcrunch.com/2026/08/11/anthropic-says-it-will-watermark-text-generated-by-its-ai-models/
评论区