文本隐形水印:企业如何履行AI Act义务
从8月2日起,生成式系统的开发者必须以机器可读的方式标注AI内容。Anthropic把水印标注扩展到更多Claude模型,但这一工具本身存在局限。

给AI生成的内容打标注,听起来是关乎对读者诚实的问题。实际操作中它却是个技术难题,行业内各家的应对方式并不一致。heise online报道了Anthropic如何把文本水印扩展到更多Claude模型,背景是欧盟人工智能条例的要求。
据heise报道,从2026年9月30日起,Claude Fable 5、Claude Sonnet 5和Claude Opus 4.8的输出也将带有隐形水印。目前已经打上水印的有Claude Fable 5.1、Claude Mythos 5.1、Claude Opus 5.5和Claude Opus 5。其中Claude Opus 5是在发布后的更新中加入标注的。到12月2日,较旧的模型也将补齐。这一信息来自Anthropic在9月24日发给客户的电子邮件。还有一个细节:水印在模型层面添加,用户无法关闭。
它如何运作
这种方法不是隐藏标记,也不是容易被删掉的元数据。Anthropic用的是Google DeepMind开发的SynthID-Text技术,并做了自己的改动。模型生成下一个token时,往往有几个同样合理的选择,这套机制会干预其中的取舍。文本一长,就会形成一种统计模式。只要分析片段足够长,用对应的密钥就能检测出来。公司称这不会降低文本质量。
局限比这个想法看上去的样子更严重,Anthropic自己也承认这一点。检测命中只能说明Claude可能参与了文本的生成。模型可以改写别人的片段,也可以加入自己的句子,或者翻译他人的文本,水印就会消失。所以它不是取证工具,而是一个概率信号。
义务从何而来
原因是监管。欧盟AI Act对生成式系统的开发者规定了透明度义务:从8月2日起,他们必须确保AI生成的内容,包括文本,以机器可读的方式标注,并可被识别为生成内容。Anthropic在全球范围内、在所有Claude平台上应用这套方案,尽管这一举措源自欧洲。
这里还要补上机构背景。欧盟委员会设有AI办公室,六个部门共125名以上工作人员,负责AI Act的落地,包括通用目的模型的规则。它可以对这类模型进行评估,要求提供信息,并实施处罚。标注义务只是模型供应商在生产流程中必须考虑的众多要求之一。
它到底管不管用
批评来自两个方向。一方面,从业者指出文本水印经不起普通编辑,通过翻译或摘要很容易去掉。另一方面则是一个反向的问题:如果水印出现在一个人自己写、只是用模型做校对的文本里,会怎样?那时“标注为AI”的含义就变模糊了,很容易造成错误指控。最稳妥的读法是把这个机制当作互联网规模上对内容做统计监测的工具,而不是判断某一段落作者身份的依据。
资料来源
2- 01heise: Wasserzeichen für KI-Texte – Anthropic weitet Anwendung ausDE
- 02European AI Office – European CommissionEN
本文所有数字与引语均来自下列来源,未添加来源之外的内容。
本内容由编辑部在人工智能辅助下制作完成。
评论
0- 还没有评论——来说两句吧。