AI未开源软件工具

Claude 生成的文字现在带隐形水印:复制粘贴也洗不掉

2026年8月17日1 次阅读
Claude 生成的文字现在带隐形水印:复制粘贴也洗不掉

你用 Claude 写的每一句话,现在都悄悄带了一个"身份证"。

8 月 15 日,Anthropic 公布了 Claude 文本水印的更多技术细节:从现在起,Claude 生成的所有文字都内嵌了隐形水印——不是什么隐藏字符或特殊标记,而是一种编织在词选择中的统计模式。你肉眼完全看不出来,但专用检测工具可以识别。

水印怎么做到"看不见又洗不掉"?

这个水印基于 Google DeepMind 的 SynthID-Text 技术。原理并不复杂:大模型生成文字时,每一步都要从一堆候选词里选一个。SynthID-Text 会微妙地调整这个选择概率,让最终文本呈现出一种特定的统计"指纹"。

关键点:水印不改变文字的意思,也不影响可读性。它只是让"选词模式"变得可识别,就像笔迹鉴定一样——你写的内容没变,但写字的习惯留下了痕迹。

什么操作能活,什么会死?

根据 Anthropic 的说明和多家媒体验证:

  • 复制粘贴:水印完整存活。无论你复制到 Word、邮件还是社交媒体,水印都在。
  • 格式转换:存活。加粗、换行、改字体都不影响。
  • 轻度编辑:大部分存活。改几个错别字、调整语序,水印仍然可检测。
  • 让 Claude 润色你自己的文字:取决于编辑程度。如果 Claude 大幅改写,水印会留下;如果只是改了几个词,可能检测不到。
  • 完全重写:水印消失。如果你把每个词都替换了,统计模式就被破坏了。
  • 翻译:水印消失。换成另一种语言后,原始的词选择模式不复存在。
  • 文本太短:不可靠。几句话的长度不足以建立统计信号。

对普通用户意味着什么?

这件事的实际影响比听起来更大:

  1. 你用 Claude 写的东西,别人能查出来。 不管你是写论文、写邮件还是写文案,接收方如果有检测工具,就能知道这段文字来自 Claude。
  2. 即使你只是让 Claude "润色"一下,也可能被标记。 Anthropic 明确说了,如果 Claude 编辑得足够多,水印会留在文本里——哪怕原文是你自己写的。
  3. 模型自己不知道在加水印。 Anthropic 工程师确认,Claude 本身并不知道自己输出带水印,也无法利用水印传递信息。这排除了"AI 之间用水印秘密通信"的阴谋论。

为什么现在做这件事?

时机并非偶然。欧盟《AI 法案》对 AI 生成内容的标识提出了明确要求,违规罚款可达 1500 万欧元。Anthropic 此举既是技术探索,也是合规布局。

不过,水印目前并非强制开启,用户理论上可以选择关闭。Anthropic 将其定位为"来源追溯"(provenance)工具,而非监控手段。

还远不是完美方案

坦率说,这个水印的局限性很明显:能被完全重写绕过,翻译就失效,短文本不可靠。它更像是一个"防君子不防小人"的机制——对诚实标注的人有用,对刻意伪造的人无效。

但作为 AI 内容溯源的第一步,它的意义在于:至少有人开始认真解决这个问题了。当所有主流 AI 产品都加上类似机制,"这段文字是不是 AI 写的"才可能有一个靠谱的答案。

---

基于多家媒体转述整理,主要来源:TechCrunch、Forbes、IBTimes。

参考来源

评论

0 条已公开
登录注册后可以参与评论。

正在加载评论...