跳到正文
世界时间EU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

关于人工智能与技术的门户事件 · 分析 · 访谈 · 技术背景

搜索
直播
›

文本隐形水印:企业如何履行AI Act义务

从8月2日起,生成式系统的开发者必须以机器可读的方式标注AI内容。Anthropic把水印标注扩展到更多Claude模型,但这一工具本身存在局限。

科技解释林晓雯发布: 2026年9月25日5 分钟阅读资料来源 2
文本隐形水印:企业如何履行AI Act义务

给AI生成的内容打标注,听起来是关乎对读者诚实的问题。实际操作中它却是个技术难题,行业内各家的应对方式并不一致。heise online报道了Anthropic如何把文本水印扩展到更多Claude模型,背景是欧盟人工智能条例的要求。

据heise报道,从2026年9月30日起,Claude Fable 5、Claude Sonnet 5和Claude Opus 4.8的输出也将带有隐形水印。目前已经打上水印的有Claude Fable 5.1、Claude Mythos 5.1、Claude Opus 5.5和Claude Opus 5。其中Claude Opus 5是在发布后的更新中加入标注的。到12月2日,较旧的模型也将补齐。这一信息来自Anthropic在9月24日发给客户的电子邮件。还有一个细节:水印在模型层面添加,用户无法关闭。

它如何运作

这种方法不是隐藏标记,也不是容易被删掉的元数据。Anthropic用的是Google DeepMind开发的SynthID-Text技术,并做了自己的改动。模型生成下一个token时,往往有几个同样合理的选择,这套机制会干预其中的取舍。文本一长,就会形成一种统计模式。只要分析片段足够长,用对应的密钥就能检测出来。公司称这不会降低文本质量。

局限比这个想法看上去的样子更严重,Anthropic自己也承认这一点。检测命中只能说明Claude可能参与了文本的生成。模型可以改写别人的片段,也可以加入自己的句子,或者翻译他人的文本,水印就会消失。所以它不是取证工具,而是一个概率信号。

义务从何而来

原因是监管。欧盟AI Act对生成式系统的开发者规定了透明度义务:从8月2日起,他们必须确保AI生成的内容,包括文本,以机器可读的方式标注,并可被识别为生成内容。Anthropic在全球范围内、在所有Claude平台上应用这套方案,尽管这一举措源自欧洲。

这里还要补上机构背景。欧盟委员会设有AI办公室,六个部门共125名以上工作人员,负责AI Act的落地,包括通用目的模型的规则。它可以对这类模型进行评估,要求提供信息,并实施处罚。标注义务只是模型供应商在生产流程中必须考虑的众多要求之一。

它到底管不管用

批评来自两个方向。一方面,从业者指出文本水印经不起普通编辑,通过翻译或摘要很容易去掉。另一方面则是一个反向的问题:如果水印出现在一个人自己写、只是用模型做校对的文本里,会怎样?那时“标注为AI”的含义就变模糊了,很容易造成错误指控。最稳妥的读法是把这个机制当作互联网规模上对内容做统计监测的工具,而不是判断某一段落作者身份的依据。

评论 0

资料来源

2
  1. 01heise: Wasserzeichen für KI-Texte – Anthropic weitet Anwendung ausDE
  2. 02European AI Office – European CommissionEN

本文所有数字与引语均来自下列来源,未添加来源之外的内容。

本内容由编辑部在人工智能辅助下制作完成。

林晓雯

林晓雯

人工智能、模型与技术

林晓雯负责FLASH24的人工智能、模型与技术方向,主要写科技、人工智能与模型、媒体与互联网三个领域。她习惯从论文预印本、开源代码库和厂商技术文档入手,先核对训练数据来源和评测口径,再决定是否落笔。遇到模型跑分,她会自己复现一遍小规模测试,并对照独立第三方榜单,确认数字没有注水。她常联系一线工程师和产品经理,也盯着各大会议截稿日,把不同版本的技术报告放在一起比。业余时间她玩3D打印、折腾老电脑,还关心模型从网络垃圾里学到的偏见问题,这让她对数据清洗格外敏感。她有一条原则:拿不到原始数据的性能宣称,不写。

编辑部 →

评论

0
  1. 还没有评论——来说两句吧。

写评论

评论公开展示。我们不发布辱骂、垃圾信息和广告内容。