据 TechCrunch 8 月 15 日报道,Anthropic 发布官方博客,首次系统披露 Claude 文本水印的实现原理。为满足欧盟《AI 法案》透明度准则(Transparency Code)对「可识别 AI 生成内容」的要求,Anthropic 将采用 Google DeepMind 于 2024 年提出的 SynthID-Text 方法:在「低风险措辞选择」(如用 overcast 还是 grey 形容天气)中嵌入读者不可见、持有密钥即可检测的水印模式,并计划推出官方水印检测 API。
Anthropic 强调,水印不影响输出质量,「对读者而言,带水印的回复与未带水印的并无差别」。至于能否通过改写隐藏水印,官方承认轻度编辑大概率无法完全移除,只有逐字重写才可能做到——但「每个词都被替换后,这段文本是否还能称为 AI 生成,本身就存在争议」。此外,由于代码必须可运行、可选表达有限,代码中的水印痕迹远少于普通文本,主要落在注释等任意措辞处。
消息公布后,围绕「AI 是否该留指纹」的争论再度升温:Reddit 上有用户质疑此举「针对无辜的 Claude 用户」,Business Insider 则报道 X 上已有「数十名」用户声称因此取消 Claude 订阅。Anthropic 同时透露,多家主要模型开发商已签署同一份行为准则,将各自落地水印方案——Claude 不会是唯一一个。
为什么值得关注:内容溯源从「道德争论」进入「工程落地」
过去一年,「AI 生成内容要不要标识」更多停留在伦理讨论与平台自律层面;欧盟《AI 法案》透明度准则第一次把它变成可执行的系统要求,而 Anthropic 是首家公开完整技术路径的主流厂商。SynthID-Text 的关键在于:它不是靠「句式特征」事后猜测 AI 痕迹,而是从生成源头嵌入可验证的指纹——这与 Pangram 等基于写作「特征」(如「this isn’t X, it’s Y」式结构)的检测器有本质区别。
更有信号意义的是行业的同步动作。就在此前一天(8 月 14 日),Google 宣布允许用户移除 AI 生成物(图像、视频、歌曲)的可见水印,但明确保留不可见 SynthID 水印与 C2PA 元数据,并在 Gemini 中提供「移除」开关的同时开源本地验证库 Credentio。可见标记让步、机器可读溯源收紧——这一进一退,勾勒出 AI 内容治理的清晰方向:面向人的标签可以灵活,面向机器的验证必须留下。
对企业而言,这意味着「验真」正在成为一项可调用的能力:Anthropic 计划推出的检测 API,将让内容平台、企业内审与供应链把「是否为 AI 生成」从人工判断变成程序化检查。合规窗口期已经打开,越早接入越从容。
分角色实操建议
对内容平台与审核负责人:把 Anthropic 检测 API、SynthID/C2PA 元数据纳入内容风控与版权处理流程,建立「机器可读溯源」字段,避免监管细则落地时被动补课。
对企业合规与法务:若业务处于欧盟《AI 法案》适用范围,尽快评估自身 AI 生成物(客服话术、文档、营销素材)的可标识义务与检测对接方案,别等细则落地再动手。
对开发者与产品负责人:水印对模型轻度改写后的文本仍留有痕迹,做 RAG 检索、摘要、内容改写类产品时,需同步考虑溯源兼容与用户知情设计。
对普通从业者:注意「完整重写才能移除水印」的边界——AI 生成内容的指纹比多数人以为的更持久,用 AI 起草的内容请务必自行审改后再对外发布。
结语
AI 内容溯源正在从争议走向标准:看不见的指纹、可调用的检测 API、陆续跟进的大厂,一条完整链路正在成型。关注 AI商业快讯,每天一篇 AI 热点深度解读。