Anthropic 将为 Claude 生成内容全面加入隐形水印与数字签名

Anthropic 将为 Claude 生成内容全面加入隐形水印与数字签名

N
News Editor
2026-08-11 07:33:04
Anthropic 宣布,自 2026 年 8 月 2 日起,Claude 生成内容将全面嵌入机器可读标记,覆盖文字隐形水印与基于 C2PA 标准的数字签名,适用范围为全球。此举对应欧盟《AI 法案》第 50 条透明度义务,覆盖 Claude 应用、API、Claude Code 及云合作伙伴渠道。不过 Anthropic 也表示,检测到标记不等于内容完全由 Claude 原创,而没有标记也不能直接证明内容出自人类。

Anthropic 宣布,自 2026 年 8 月 2 日起,旗下聊天机器人 Claude 生成的内容将全面嵌入「机器可读标记」,包括藏在文本中的隐形水印,以及附着在文件中的数字签名来源记录,且将在全球范围内适用。

这是欧盟《AI 法案》第 50 条透明度义务正式实施后,大型 AI 公司交出的首批回应之一。按 Anthropic 的说法,Claude 生成内容的标记机制将覆盖不同产品与接入渠道。

两套标记机制同时启用

根据 Anthropic 官方说明文件,Claude 的标记机制分为两套。

第一套是嵌入式文字水印,即在生成文本中直接加入难以察觉的信号。Anthropic 表示,这种处理不会改变回复的含义、质量或可读性,用户在阅读时不会直接察觉;即便文本被复制粘贴到其他位置,水印也会一并传播。由于这套水印在模型层级应用,所有 Claude 产品与界面都会适用。

第二套是签署的来源元数据,适用于 SVG、PNG、JPG 等文件类型。该方案采用「内容来源和真实性联盟」C2PA 的开放标准,在文件中附加数字签名,用来证明该文件曾经由 Claude 处理,并可检测文件在后续是否遭到篡改。

Anthropic 称,这套机制覆盖 Claude 应用、API 平台、Claude Code 等全系列产品,经由 AWS、Google Cloud 或 Microsoft Foundry 等云合作伙伴接入的服务也包含在内。

新模型上线即支持,旧模型也在改造

Anthropic 表示,2026 年 8 月 2 日后推出的新模型会在上线时直接支持相关标记,较早的模型也正在加紧改造。公司同时承诺,将公开检测方法的技术文件,让用户和第三方都能验证相关内容是否经 Claude 处理。

对应欧盟《AI 法案》第 50 条透明度义务

Anthropic 此举是对欧盟《AI 法案》第 50 条透明度义务的回应。该条款自 2026 年 8 月 2 日起适用,要求 AI 供应商为生成或篡改的「合成内容」加上机器可读标记,方便下游用户、平台与监管机构识别 AI 产物。

输入信息显示,今年 5 月欧盟通过的「AI 综合法案」暂时协议,为既有系统提供至 12 月 2 日的宽限期。欧盟委员会也推出了自愿性的《AI 生成内容透明度行为准则》,鼓励行业采用开放标准和统一标识图示,Anthropic 也是签署承诺的企业之一。

Anthropic 这次没有只在欧洲实施,而是选择全球统一适用。

检测到标记,不代表内容完全由 AI 原创

Anthropic 也说明,这套标记系统并不是万无一失的识别工具。

首先,检测到标记,只能说明内容「曾由 Claude 处理」,并不等于 Claude 就是原作者。因为用户可能只是用 Claude 校对、翻译或摘要由人类撰写的文本。

其次,没有标记,也不能证明内容一定出自人类。较早模型生成的内容、经过大幅改写的文本、过短的段落,都可能不带标记;图片如果经过截图或格式转换,相关元数据也可能消失。

外部媒体质疑技术仍可被绕过

科技媒体《The Register》指出,研究早已显示图像水印可以被移除,光学字符识别(OCR)技术也能够绕过文字水印,网络上甚至已经出现现成的 C2PA 元数据移除工具。

该报道还分析称,这种做法可能反而提升不带水印的开源模型吸引力,因为部分用户未必希望读者知道内容由 AI 撰写。

AI 内容透明度竞赛刚刚开始

尽管技术层面仍有漏洞,AI 内容标记正在成为行业趋势。对于内容农场、学术抄袭、深度伪造诈骗等问题,水印至少会提高造假成本;对普通用户来说,未来在看到一篇文章或一张图片时,也会多出一个追溯来源的线索。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
540

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。