群发资讯网

8 月 11 日。Anthropic 给 Claude 的所有文本输出加了隐形水

8 月 11 日。Anthropic 给 Claude 的所有文本输出加了隐形水印。

水印嵌在文本的统计分布里。你把 Claude 写的一段话复制到邮件、文档或博客里,水印跟着走;改一改,它可能还在。

同时,Claude 生成的 .svg、.png、.jpg 文件会附上 C2PA 签名元数据——Adobe、OpenAI 和 Google 的图像生成工具已经在用这套标准。

触发它的是欧盟 AI 法案第 50 条的透明度要求。但 Anthropic 的执行范围不限欧盟:全球所有 Claude 产品线一律适用,包括 API、Claude Code、Claude Cowork,以及通过 AWS、Google Cloud 和 Microsoft Foundry 调用的云客户。8 月 2 日以后发布的新模型从上线第一天就带标记,旧模型的过渡期到 12 月 2 日。

在大模型公司里,这是第一次有人在文本层面大规模落地水印。Google 的 SynthID 覆盖了文本、图像和音频,但没有像 Anthropic 这样公开机制文档。OpenAI 开发过文本水印方案,最后没上线——据报道称,顾虑包括对非英语文本质量的影响,以及用户可能流向没有水印的竞品。

Anthropic 选了另一条路。付费用户无法关闭水印。

但它自己在帮助文档里写了不少边界。检测到水印只说明内容「可能经过 Claude 处理」,不等于 Claude 是原作者——很多人用 Claude 做校对、翻译和格式转换,底层内容是人写的。反过来,检测不到也不代表不是 AI 生成的:旧模型没有水印,文本被大幅改写后信号会衰减,太短的段落不够识别,文件经过格式转换或截图后元数据会被剥离。

水印算法的具体细节尚未公开。Anthropic 说水印不影响生成质量,用户目前无法独立验证这一说法。学术研究记录过水印强度和文本质量之间的权衡——水印越强、越抗编辑,越容易影响输出。

Anthropic 正在开发配套检测工具,技术文档后续发布。

Claude 隐形水印ClaudeAnthropic