← 返回 Claude AI IP 检测更多资讯 →

Anthropic 给 Claude 生成内容加隐形水印,全球生效

Claude 资讯 · 2026-08-11 · Net.Coffee

签的是欧盟的行为准则,落地却是全球一刀切;官方同时写明了检测结果不能当裁判用。

一句话:Anthropic 签署了欧盟《人工智能法案》第 50(2) 条的透明度行为准则,2026 年 8 月 2 日及以后发布的新 Claude 模型,将从上线起给生成文本嵌入不可见水印、给支持的文件加 C2PA 来源签名——而且这套标记全球生效,不分用户在不在欧盟。

先看清签的是什么

第 50 条是欧盟 AI 法案里管透明度的那一条,核心要求是:AI 生成或处理过的内容,要以机器可读的方式被标出来。50(2) 针对模型与系统的提供方,配套的行为准则属于自愿签署——签了并不等于凭空多出一套义务,而是承诺按准则里写死的做法落地,换取合规上的确定性。Anthropic 是以生成式 AI 模型提供方和系统提供方的双重身份签的,时间点卡在 2026 年 8 月 2 日,正是法案透明度义务的适用日。

文本水印和文件签名不是一回事

这两套机制经常被混着讲,实际差别很大:

技术细节 Anthropic 暂未公布,只说会另行发布。目前业界公开的文本水印方案,多数是在采样阶段对候选词的概率分布做有规律的偏置,让输出在统计上留下一把只有持密钥者才读得出的指纹。这类方法有个共同的代价:文本越短、格式约束越强,能塞进去的信号就越少。也就是说,一句话的回复、结构固定的代码输出,天然不是水印友好的场景。

欧盟的规则,为什么管到了欧盟以外

按 Anthropic 的说明,标记覆盖 API、Claude、Claude Code、Claude Cowork 和 Claude Tag,适用范围是全球,而不是按用户所在地开关;8 月 2 日之前发布的旧模型,也在陆续补上这个能力。

选择一刀切并不难理解:为不同地区维护两套采样逻辑,成本和出错概率都不划算,反倒不如全量打开干净。这也是欧盟这套立法一贯的外溢方式——条款只约束欧盟市场,但企业为了工程上省事,往往把最严的那一套推到全球,最后所有人都按欧盟的标准在用产品。

官方主动写下的两句免责,才是重点

Anthropic 在说明里明确了两条:检测到标记,只能说明这段内容可能经过 Claude 处理;没检测到标记,也不能证明它不是 AI 生成或处理的。

这两句话把水印的能力边界划得很清楚。它不是给学校、招聘方或平台当"AI 检测"裁判用的——误判和漏判都存在,而且"经过 Claude 处理"这个说法本身相当宽:拿自己写的东西让 Claude 润色一遍,可能也算。指望靠它一键判定代写或抄袭的人,大概率会失望。方向其实是反的:真正受益的是需要主动证明"这份材料确实由某模型生成"的溯源与合规场景。

最后顺带说清一件容易混的事——内容被标记和账号被风控是两条完全不同的线。水印不影响你能不能连上、会不会被要求二次验证;后者才是国内用户日常真正卡住的地方,怀疑时去 Claude 可用性自查 看一眼当前出口 IP 的状态更省事。