你有没有想过,屏幕上一大段看起来挺像人写的文字,到底是谁写的?这个问题越来越难答。Anthropic 这次没靠用户自觉,而是直接从模型层做了手脚:给 Claude 生成的文字,打上一种肉眼看不见的水印。
欧盟的新规逼出了这一步
8 月 11 日,Anthropic 在一份更新后的支持页里确认,会为旗下模型的输出加水印,Claude 自然也在内。触发点是 8 月 2 日生效的欧盟 AI 法透明度守则,它要求 AI 公司用“别的系统能识别”的方式,标记出由 AI 生成或编辑过的内容。Anthropic 的说法是:8 月 2 日之后发布的模型,会自动带上给文本和文件打水印的能力。
因为水印是文字本身的一部分,当你把它复制粘贴到别处时,水印会跟着走,甚至可能扛过一些编辑。而且水印是在模型层面施加的——不管这段文字来自哪个 Claude 产品或界面,它都在。
不是戳个章,是藏在字里行间
这里说的“水印”,不是页面角落盖个“AI 生成”的红章,而是一种嵌在文本里的隐藏标记,像一张看不见的身份证,别的系统能检测出来。文件方面,Anthropic 用的是 C2PA 这个开放标准,相当于给图片和文档贴一张随身的内容凭证。文本这边更关键的一点是可携带性:你复制粘贴、甚至稍微改几笔,那个标记大概率还粘在上面。
覆盖范围比你想的宽
这次不是只管聊天框。Anthropic 列出来的范围包括 Claude 主产品、平台 API、Claude Code、Claude Cowork 和 Claude Tag,而且老模型后续也会补上水印支持。换句话说,只要文字是从 Claude 出来的,无论你是在写邮件、写代码还是做客服话术,标记都默认带着走。
但水印不是万能的
也别把它想得太神。TechCrunch 就抛了个关键问题:用户到底要改到什么程度,才能把这层标记洗掉?Anthropic 目前没给出明确答案。翻译、总结、格式转换,这些日常操作都可能改写文字,而真正想抹掉来源的人,更有动力去动手脚。所以水印更像是一份“有用的证据”,而不是一把“万能检测器”。
信任正在变成产品特性
把镜头拉宽,Anthropic 不是孤例。Google、Meta、微软、OpenAI、Synthesia、Black Forest Labs 都承诺遵守欧盟这套守则;上周音乐平台 Suno 也说要给生成的曲目加水印;上个月 Substack 联手 Pangram 去标 AI 写的内容。当 AI 生成物在工具、API、App 之间到处流动时,披露就不能再靠某个平台“贴个徽章”了,它得更像一层大家共享的基础设施。对做内容的人来说,以后的问题也许不再是“它像不像人写的”,而是“它的出身,以后还能不能被验证”。


水印这东西吧,对老实人有用,对存心绕的人基本是纸糊的。翻译一遍、总结一遍,标记大概率就散了。不过大方向没错——至少以后平台不能再拿“我不知道是 AI 写的”当挡箭牌了。
欧盟这次算是把“AI 内容溯源”从口号变成硬指标了。模型层打水印比平台贴标签靠谱,起码内容出了门还能追。就是那个“改多少能洗掉”的悬念没解开,真要较真还得看检测工具的命中率。