科技与AI

Anthropic给Claude生成的文本加隐形水印,8月2日后发布的模型全球通用

Anthropic 8月11日公布Claude文本隐形水印机制

Anthropic在8月11日公布,要给Claude生成的内容加上人眼看不见、机器读得出的水印,先覆盖2026年8月2日及之后发布的新模型,更早的模型随后补上。这个标记做在模型层,Claude聊天产品、Claude Code和开发者平台的输出都带,复制粘贴之后仍然保留,轻度改动也可能留存;大幅改写或整段转译则会把信号冲掉,文本太短同样读不出可靠结论。Engadget介绍了做法:方法改自Google DeepMind的SynthID-Text,模型本来会在若干合适的词里随机挑一个,开启水印后改由一把密钥决定挑哪个,选词模式本身就成了暗号,只有拿到密钥的一方解得开。这条路子不额外消耗token,不拖慢生成,也不影响文本质量。图片和其他文件走的是另一套:附加带密码学签名的元数据。Anthropic承诺放出带密钥的检测接口,供外部核验。改动的由头是欧盟《人工智能法案》第50条的透明度义务,8月2日已经生效,要求合成内容做到机器可读、可检测。但Anthropic没有只在欧盟境内开启,而是全球都铺上了。

过去一年多,AI内容标识大多停留在自愿承诺和图片元数据这一层,文本这块因为易改写、无载体,一直被认为难做。这次是把合规义务真正做进了模型的推理机制:不是在输出外面套一层声明,而是改掉模型选词的随机性来源,让标记长在文本本身。全球统一开启而不按地区分流,也说明对这类厂商来说,为欧盟单独养一套输出管线,成本比直接全量铺开还高。欧盟规则由此外溢成事实上的全球产品标准。

内容平台和媒体机构由此多了一条可机读的溯源线索,但它能回答的问题比想象中窄:查到水印只说明Claude经手过,不等于Claude写的。City A.M.和Fortune都点了同一处要害——人自己写完再让Claude校对、润色或翻译,成品照样带标记。第50条本身给"标准编辑的辅助功能"留了豁免口子,可技术上的水印不区分创作和编辑,两头对不上。开发者这边,Engadget提到代码类输出"通常水印更少",因为代码要求精确复现,能替换的词汇空间本就有限。产业侧的动作也在同一方向:Substack上线了AI检测扫描,YouTube收紧了AI内容的变现资格。

后续关注

一是检测接口何时开放、密钥怎么发——完全公开还是只给平台方,直接决定这套水印是公共基础设施还是Anthropic的单方声明;二是存量老模型的补齐时间表;三是欧盟AI办公室会不会认可"经Claude编辑"也算需要标识的合成内容,这关系到第50条辅助编辑豁免与技术实现之间的缺口怎么收;四是同样要满足第50条透明度义务的其他厂商,会不会跟进文本层面的水印。

信息来源

  1. Engadget媒体报道 · en · 2026年8月15日发布
  2. Fortune媒体报道 · en · 2026年8月11日发布
  3. City A.M.媒体报道 · en · 2026年8月11日发布

GFT Finance 整理归纳公开信息并总结要点,不构成投资建议。数据以来源原文为准。