Claude 的新标记机制,把一个长期停在论文和平台声明里的问题推到用户面前:AI 生成文本能不能被机器识别?
量子位 8 月 11 日报道,Anthropic 正为 Claude 生成内容加入“隐形水印”。这套机制并非单独附在文件旁边的说明文字。按 Anthropic 官方帮助页的说法,8 月 2 日及之后在欧盟推出的新 Claude 模型,从发布第一天起就支持机器可读标记;生成文本会带嵌入式水印,受支持文件则附带数字签名的来源元数据。
官方原话写得很短:
“Generated text will carry embedded watermarks”
换成普通用户能听懂的话,就是 Claude 生成的一段文字,在肉眼看不见的层面带上可检测信号。复制、粘贴、轻度编辑之后,这个信号仍可能跟着走。企业用户、学校、出版平台和内容社区要面对的新情况,已经从“是否标注使用 AI”推进到检测结果如何进入审核、申诉和责任判断。
水印被放进模型输出层
Anthropic 这次列出的覆盖范围很广。产品侧包括 Claude、Claude Platform API、Claude Code、Claude Cowork 和 Claude Tag;云端访问也覆盖 AWS、Google Cloud 与 Microsoft Foundry。区域上,标记会在 Claude 提供服务的地方全球适用,并非只在欧盟开关。
这组信息给开发者留下两个判断点。
第一,水印在模型层出现。用户从聊天窗口、API、代码工具或云平台拿到文本,理论上都可能看到同一套标记逻辑。第二,文本和文件走两条技术路线:文本里嵌入不可见水印;.svg、.png、.jpg 等受支持文件使用 C2PA 来源元数据。
这让 Claude 的合规动作比普通页面提示更深一层。 页面提示告诉人“这里用了 AI”,模型层标记则给机器检测留接口。对大型平台来说,后者更容易进入自动审核系统;对创作者来说,误判成本也会更高。
欧盟法案给了最后期限
这项调整的背景是欧盟 AI 法案第 50 条。Cloud Security Alliance 的研究把第 50 条拆成四类透明义务:交互式 AI 要告知用户正在与 AI 互动;生成音频、图像、视频或文本的系统要以机器可读方式标记输出;情绪识别和生物分类部署要通知被影响者;深度伪造和涉及公共事务的 AI 文本要披露生成或修改情况。
时间线也很具体。第 50 条相关透明义务已在 8 月 2 日进入适用阶段;对已上市系统,水印子义务有一段过渡期,CSA 和 The Verge 均提到旧产品存在到 12 月 2 日的改造窗口。Anthropic 的处理方式,是让 8 月 2 日后在欧盟推出的新模型先天带标记,同时为旧模型补支持。
量子位提到,Google、Meta、Microsoft、OpenAI 等也已进入相关透明度实践准则签署或合规队列。这里不能理解成“所有模型都已经有同款文本水印”。更准确的读法是:欧盟把平台公开标识、机器可读标记和部署方披露绑到同一套透明义务里,头部模型公司开始把原本可选的标记能力做成产品基线。
检测结果难当作者证明
最容易被忽略的,是 Anthropic 自己写下的限制。
官方说明称,检测到 Claude 标记,只说明内容可能经过 Claude 处理,不能单独证明 Claude 是原作者。用户把自写内容交给 Claude 校对、翻译、摘要或改格式,也可能留下标记。反过来,没有检测到标记,也不能证明内容没有用过 AI:旧模型、重度改写、翻译、混入其它文字、文本太短、文件元数据被格式转换或截图剥离,都可能让信号消失。
这一步对中文用户影响不小。很多团队使用 Claude Code 写程序、用 Claude 处理会议纪要、润色合同或改写英文材料。若下游平台把“检测到 Claude 标记”直接等同于“AI 代写”,正常办公流程会被拖入解释成本。学校和出版业也一样:检测工具能提供线索,却不能替代材料来源、修改记录和人工判断。
水印越官方,越需要明确边界。 它能降低平台完全靠猜的成本,却也会制造新的灰区:翻译是否算 AI 生成,校对是否算 AI 参与,短段落检测失败该由谁承担。Anthropic 还未公开文本水印算法和检测技术文档,企业现在能做的,是先把检测结果当风险信号,而非最终结论。
三个后续节点要看实测
这次更新还没到“AI 文本一眼验明正身”的程度。能验证它价值的,有三个后续节点。
第一,Anthropic 何时发布检测工具和技术文档。没有公开接口,第三方平台很难把 Claude 标记纳入稳定流程。第二,水印在翻译、重写、摘要和代码生成里的保留率如何。中文环境尤其复杂,跨语言改写会同时改变词序、标点和术语,检测效果不能照搬英文场景。第三,平台如何设计申诉。若只给用户一个“AI 率”分数,不说明经过哪个模型、哪段内容、哪种处理链路,水印反而会变成新的黑箱。
对中文读者来说,这条新闻的重点不在“能不能抓学生作业”,而在 AI 内容治理正在从自愿声明走向基础设施。Claude 先把文本水印压进模型层,OpenAI、Google、Meta、Microsoft 的不同实现也会被拿来比较。未来几个月,合规部门会看它能否过审,平台会看它能否自动化,用户则会看它有没有误伤。
Claude 这次埋下的东西已经超出简单标签。它更像一枚合规探针:能不能被读出来、会不会被擦掉、读出来以后算什么,都还要靠公开文档和真实平台测试给答案。
参考来源:量子位、Anthropic Claude Help Center、The Verge、Cloud Security Alliance、CocoLoop、iThome;核验模型覆盖范围、产品入口、云平台范围、C2PA文件类型、第50条义务、旧模型过渡窗口、检测限制与未公开技术文档状态。