Anthropic公布Claude文本水印:AI内容溯源进入产品化阶段
Anthropic announced that future Claude models will generate text with a detectable statistical watermark, while saying the method should not visibly change output quality or add tokens. The announcement connected the rollout to EU AI Act transparency requirements.

Anthropic在8月14日发布官方说明,首次详细解释Claude文本水印的工作机制,并明确将其与欧盟《人工智能法案》的透明度要求挂钩[1][4]。这意味着,AI生成内容的"溯源"正从一项可选项,变成面向全球用户的产品默认配置。
水印怎么"藏"进文字里
根据Anthropic的说法,大语言模型生成文本时是一个词一个词地选择。当一句话存在多个同样合理的候选词时——比如"The weather today was cold and…"后面接"overcast"还是"grey"意思几乎一样——模型通常靠随机数决定选哪个[1]。水印正是利用这些"低风险选择":选择依然是随机的,但随机性的来源被替换成了由密钥编码的模式,读者无法察觉,持有密钥的人却能检测出来[1][7]。
Anthropic确认,该方法基于Google DeepMind 2024年发表在《Nature》上的SynthID-Text,而SynthID-Text又可追溯到研究者Scott Aaronson更早的提案[3][4][7]。Anthropic称水印不添加隐藏字符、额外token,也不影响输出质量或读者体验[3][7]。

*图1:Claude ru wiki(Прикли / CC0,Wikimedia Commons)*
它能证明什么,不能证明什么
需要明确的是,Anthropic自己把水印的定位说得很克制:它只能"判断Claude参与写作的可能性",而非确定性证据[1][2]。资料显示,完整重写即可破坏水印[4];截至相关报道时,Anthropic并未推出公开的检测器API,也未点名哪些模型会携带水印、何时正式上线[3][4]。换句话说,水印目前更像一套"待部署的能力框架",而非已经全面生效的检测体系。

*图2:Claude ru wiki(Прикли / CC0,Wikimedia Commons)*
为什么现在做这件事
直接触发因素是合规。资料显示,欧盟《人工智能法案》第50条要求生成式AI系统的提供方以机器可检测的方式标记合成内容[2];Anthropic称自2026年8月2日起,面向欧盟市场的提供方必须标记AI生成内容,而Anthropic是2026年7月欧盟相关透明度行为准则约190个签署方之一[4]。由于缺乏可靠的地区差异化方案,该水印上线后将直接适用于全球所有Claude用户[5]。
不过争议也随之而来。有报道称部分Claude用户因水印取消订阅,专业订阅者担心面向客户的内容会留下可检测的AI痕迹[3]。另有分析指出,Anthropic在描述影响时使用了"大致相同""无统计显著差异""可忽略影响"等一连串限定词,而"几乎无影响"并不等于"绝对无影响"[5]。

*图3:AI ON TRACK 2025 03(מקף־עברי / CC BY-SA 4.0,Wikimedia Commons)*
点评
水印的真正意义,或许不在于它能多准确地"抓出"AI文本,而在于它把"内容来源可验证"写进了产品默认项。但技术上的"可能性判断"与监管期待的"确定性标记"之间仍有落差,检测器缺位、重写即失效等限制,也决定了溯源短期内只能是辅助信号,而非裁决依据。
参考来源
[1] How Claude's text watermark works
https://www.anthropic.com/news/claude-text-watermark
[2] Claude Text Watermark: EU AI Act Fines Hit €15M [2026]
https://shattered.io/claude-text-watermark-eu-ai-act-2026/
[3] Claude Text Watermark 2026 Explained | Truescho
https://truescho.com/en/blog/claude-text-watermark-anthropic-2026
[4] Anthropic Details How Claude's Text Watermark Will Work
https://aiunderstanding.org/news/anthropic-details-how-claude-s-text-watermark-will-work
[5] Claude Text Watermark Full Details Revealed - 36氪
https://eu.36kr.com/en/p/3940141009091976
[6] AI Watermark Evidence Fails Forensic Readiness: An Empirical ...
[7] How Claude's text watermarking works | AI Intelligence News | AI ...
https://ai.wuaishare.cn/news/en/165
[8] How to Detect Claude Watermark - Facebook
https://www.facebook.com/fb-answers/detect-claude-watermark/
本稿由 AI 生成,发布状态:pending_human_review。正式发布前以人工审核为准。