看到“AI水印”,很多人会以为文本里藏了特殊字符。Anthropic解释,Claude水印利用模型选择下一个词时的低风险随机性留下统计模式,读者看不见,也不会增加token。

它怎样工作
当多个词都合理时,系统用密钥和前文影响随机选择。检测方用对应密钥检查一段文字的选择序列,再给出Claude参与的概率。官方采用的是SynthID-Text思路。
| 场景 | 检测表现 | 原因 |
|---|---|---|
| 较长原创文本 | 信息更多 | 有更多可选择词位 |
| 短文本 | 置信度较低 | 样本不足 |
| 事实与代码 | 水印更稀疏 | 正确选择空间小 |
| 轻度校对 | 可能难检测 | 多数词来自人类 |
| 大幅重写 | 水印可能减弱 | 原选择被替换 |

检测结果能证明什么
它能回答“Claude可能参与了多少”,不能证明作者身份,也无法判断另一家AI是否参与。检测到水印也分不清整篇生成和深度改写;没有检测到,也不能直接证明文本完全由人写。

因此我不会用单次检测直接处罚作者。更稳妥的流程是保留草稿、版本历史、引用和编辑记录,再把水印结果作为一条辅助证据。
图片文件是另一套机制
Anthropic称支持的PNG、JPG和SVG文件会附加C2PA内容凭证,属于签名元数据。它与文本统计水印不同,文件编辑或移除元数据也会影响验证。
可用性与隐私
Claude检测API目前处于私测,优先面向监管、执法、媒体、事实核查、研究和有合规义务的企业。Anthropic称水印不包含用户、组织或对话身份信息,也不会额外收费。
常见问题
水印会让文章质量下降吗?
Anthropic称内部测试未发现内容、创造力或可读性影响,外部场景仍可继续评估。
改写能去掉水印吗?
轻度编辑可能仍保留信号,完全重写会显著改变词序列。
普通用户现在能检测吗?
检测API仍为私测,开放范围以Anthropic最新说明为准。
