写完了三年代码,今天才发现这件事——AI生成的代码,从第一天起就被隐形标记了
写完了三年代码,今天才发现这件事——AI生成的代码,从第一天起就被隐形标记了。
事情是这样的。8月11日,Anthropic宣布Claude生成的内容全面嵌入隐形水印。不是那种在底部加个”Generated by Claude”的显式标签,是真的看不见、摸不着、复制粘贴也带走的标记。
这个水印是什么原理?
大语言模型生成文本本质上是逐词选择。遇到”今天天气寒冷且……”,选”阴沉的”或”灰暗的”都行,对句意影响甚微。水印就在这些”可选词”里做文章——每次选哪个词,不是随机的,而是带着隐藏信息。
举个例子,你让Claude Code写一个登录模块,生成的代码里可能有十几处这类”自由选择”。这些选择累积起来,就形成了一个独特的签名。
不只是文字,代码文件也会被标记
Anthropic披露,当Claude生成.svg、.png、.jpg等格式文件时,系统会附加基于C2PA开放标准的数字签名元数据。什么叫数字签名?就是你生成的文件会被打上一个”出生证明”,证明它是谁生成的、什么时候生成的、有没有被改过。
这对编程意味着什么?你用Claude Code写的代码,可能正在携带某种来源标记。虽然Anthropic说目前主要针对图片等媒体文件,但这个机制一旦建立,延伸到代码文件只是时间问题。
全球适用,不是只在欧盟
这次最让人意外的是覆盖范围。Anthropic说标记机制适用于Claude所有产品线,包括Claude Platform(API)、Claude网页版、Claude Code、Claude Cowork和Claude Tag,通过AWS、谷歌云、Microsoft Foundry接入的云合作伙伴也一样。而且全球适用,不是只针对欧盟地区。
背景是欧盟《人工智能法案》第50条——8月2日起,AI生成内容需要被标记。Anthropic签了,但把这个要求做成了全球统一方案。
局限在哪?
Anthropic自己说得很清楚:检测到Claude标记,仅表明内容可能经由Claude处理,并不能完全确认内容的完整来源;未检测到标记,也并不意味着内容并非由AI生成或处理。
换句话说,这个水印是用来满足监管合规的,不是用来做”AI代码溯源”的。它不能证明你的代码是不是AI写的,只能证明”如果检测到了,那确实经过Claude处理过”。
下一步怎么想?
如果你在企业环境里用Claude Code写代码,可以关注几件事:
第一,生成的代码文件可能会带来源元数据——这对代码审计可能有影响,特别是当你需要证明”这部分是我自己写的”的时候。
第二,如果你做开源项目,别人可能会用工具检测你的代码是否带有AI标记。这不一定有负面影响,但需要心里有数。
第三,这个机制目前还在早期,具体怎么检测、误报率多少、能不能被绕过,都还没有公开数据。可以先观望,但不用恐慌。
水印这事儿,技术上不复杂,复杂的是它带来的连锁反应。代码的”出身”问题,第一次被放到了台面上。
评论区
登录后可评论。