该举措旨在响应欧盟AI法案透明度准则,通过统计分布技术在生成文本中嵌入人眼不可见标记,覆盖网页端、API及代码工具全线产品且不可关闭。
美国人工智能企业Anthropic正式实施针对其旗下Claude系列模型生成的文本内容水印策略。自8月2日起,所有通过新发布版本生成的文本均会自动嵌入一种基于统计分布技术的隐形标记。该标记在人眼观察下不可见,不影响语义表达、生成质量或可读性,但在特定条件下可通过持有密钥的检测工具进行识别。此机制覆盖Claude网页界面、API接口以及Claude Code开发工具,面向全球用户生效且无法由用户手动关闭。
在技术实现层面,该系统利用Google DeepMind于2024年提出的SynthID-Text方案,通过在低风险词汇选择中植入特定模式来达成标记目的。官方说明指出,生成的图像等文件将附带符合C2PA标准的数字签名溯源元数据。关于抗编辑能力,Anthropic明确表示轻微编辑操作难以彻底去除水印痕迹,但如果文本经过逐词重写,水印将被消除;对于仅经模型校对或轻度修改的内容,水印保留情况取决于文本长度及具体编辑程度。此外,代码生成场景因需确保功能正确性,水印主要应用于代码注释等部分,对核心逻辑影响较小。公司计划随后发布专用的水印检测API供第三方验证使用。
这一调整被视为Anthropic签署欧盟《人工智能法案》第50条透明度行为准则后的关键执行动作,标志着行业从单纯的模型性能竞争转向内容可追溯性的治理阶段。此前市场已有迹象显示用户对隐私与透明度的关注加剧,部分报道提及数十名用户因担忧该机制而取消订阅,但业界普遍将此视为建立AI生成内容身份认证的必要步骤。随着世界经济论坛将生成式水印列为新兴技术以及全球主要模型开发商纷纷签署类似行为准则,嵌入可识别标记正成为行业标准配置,旨在解决传统检测工具无法区分具体模型来源及排除误判的局限,为出版、教育及企业内部文件等场景提供更直接的内容溯源依据。