欧盟《人工智能法案》
搜索文档
Claude 文本水印的工作原理
程序员的那些事· 2026-08-16 15:24
文章核心观点 Anthropic宣布为Claude模型生成的文本引入水印技术,该技术基于谷歌DeepMind的SynthID-Text改良版本,旨在遵守欧盟《人工智能法案》要求,同时不影响输出质量、用户成本或隐私 水印技术原理 - 水印利用文本中大量无关紧要的选词机会,在输出内容里埋入一套特征模式,人类肉眼无法察觉,但持有对应密钥的工具可检测[3] - 开启水印后,词汇依旧是随机选出,但随机数的来源从普通随机生成器改为结合密钥与前面部分上下文来决定最终选词[4] - 水印不会让模型刻意偏向某一个词,也不会逼迫模型选用它原本不会使用的生僻词[5] - 水印技术源自谷歌DeepMind2024年发表在《自然》期刊的SynthID-Text技术的改良版本,核心设计逻辑完全一致:水印只改变选词环节的随机源[8] 对输出质量的影响 - 水印不会降低输出质量,带水印和不带水印的输出没有任何区别[6] - 内部测试未观察到水印对文本内容、创意水平、可读性带来负面影响[6] - 谷歌在部分Gemini流量上部署水印版本,对比用户点赞、点踩反馈,水印版与普通版不存在统计学层面的显著差异[6] - 人工评审者并排阅读两份输出,也分辨不出质量差别[6] 水印特性 - 普通人阅读时完全分辨不出带水印和不带水印文本之间的区别[4] - 不会在文本中插入额外字符,不存在隐形隐藏字符[4] - 水印不需要消耗额外token,不会增加使用成本[4] - 水印不含任何身份信息,无法溯源定位到个人、机构或是某一条对话会话[4] - 水印并非Claude独有,自8月2日起欧盟要求面向欧盟市场提供服务的AI服务商必须对AI生成内容做标记[4] 水印检测局限性 - 水印检测仅能回答"这份文本有多大概率部分由Claude撰写",不能证明文本是人类写的[8] - 无法区分是不是别的AI生成,其他AI即便有水印,密钥各不相同,甚至使用完全不一样的水印算法[8] - 短文本样本检测效果很差,可供分析的选词样本太少,文本篇幅越长判定Claude参与的置信度就越高[9] - 在事实类文本中可供自由选词的空间很小,水印可嵌入的机会会变少[9] - 校对润色场景如果只修改语法标点,改动量极少,水印几乎没有可以附着的空间[9] 代码场景表现 - AI水印依赖多个等价可行的候选词,如果输出要求高度精确,选错就会出错、代码直接报错,这种位置不会施加水印扰动[11] - 绝大多数代码必须精准运行,相比普通自然文本,代码整体携带的水印特征会弱很多[11] - 代码内部的注释、变量命名存在自由选择空间的地方依旧会带上水印,但不会对代码实际运行逻辑造成实质影响[11] 对用户的影响 - 水印对模型推理速度几乎无影响,不会产生额外token,调用、使用的成本保持不变[12] - 水印标记的是Claude的输出,完全不携带任何用户相关信息,水印本身、配套密钥都无法还原出用户身份、所属机构、对话记录[13] - 水印仅能够证明Claude很可能在某个环节参与过这份内容的创作,无法区分是"Claude完整写的全文"还是"Claude做了重度改写编辑"[18] 合规与部署 - 推行水印是为了遵守欧盟《人工智能法案》,Anthropic与其余主流AI厂商合计约190家签署方于2026年7月签署《AI生成内容透明度欧盟行为准则》[14] - 上线初期选择全球统一开启水印,因为目前还没有成熟可靠的方案做到仅针对特定地区启用[14] - 欧盟法案针对2026-08-02之前发布的Anthropic模型设置了过渡期,也会为旧模型增加水印,在未来数月逐步完成部署[21] 其他文件处理 - 当Claude生成PNG、JPG、SVG这类支持格式的文件时,会在文件元数据嵌入一条经过密码学签名的内容凭证,标注文件由Claude生成或处理[16] - 该凭证是行业开放标准C2PA,相机厂商、图片编辑软件也在用该标准记录图片来源[16] - 元数据凭证和文本水印不是一回事,文件本体不会改动,没有嵌入隐形水印[16] 水印绕过与检测 - 轻微改写一般不会彻底抹除水印,但逐句大幅度重写替换全部词汇水印就会失效[17] - 普通AI检测软件拿不到水印密钥,依靠分析文本语言特征捕捉AI写作常见语言习惯,和密钥校验水印底层逻辑完全不一样[22] - 翻译的每一个词汇都是Claude生成选择,因此翻译结果带有水印[20] - 水印不会改变输出内容的版权归属或是法律责任划分,只用于判断内容是否由Claude生成/处理[23]