根据 Beating monitoring 的监测结果,Anthropic 已开始在 Claude 生成的文本中嵌入机器可读的隐形水印。这些水印将应用于 Claude、Claude Code、Cowork、API,以及 AWS、Google Cloud 和 Microsoft Foundry 上支持的模型;新模型默认启用该功能,现有模型则会逐步获得该功能。

该水印直接嵌入模型的文本生成过程,而不是作为独立的文件元数据,因此在复制粘贴后仍会保留。Anthropic 尚未披露具体算法,但其实现似乎类似于 Google 的 SynthID 方法——在生成过程中细微调整词元的选择概率,从而留下可检测的统计信号。根据官方指引,非常短的文本可能没有足够的信号,而大幅改写、翻译或将内容与其他文本混合,可能导致水印无法被检测。该公司澄清称,检测到水印只能表明文本可能来自 Claude,并不能证明整篇内容都是由 Claude 撰写的。