实际使用与边界
适用场景:把水印作为来源记录的一部分,同时保留草稿、资料笔记、作者披露和人工审阅决定。
边界:Anthropic 描述的是存在明确限制的概率信号,对短文本、事实文本、编辑文本和代码样本更不稳定。它不能证明作者身份、识别用户或检测所有 AI 系统。
Anthropic 宣布了什么
Anthropic 在 2026 年 8 月 14 日宣布,未来 Claude 模型生成的文本将包含水印。公司表示此举与欧盟 AI 法案对 AI 生成内容的标记要求有关,并计划在全球推出。Anthropic 还表示不会加入可见标记、隐藏字符或额外词元,水印也不包含身份信息。
这个信号如何工作
语言模型经常要在多个同样合理的词之间选择。Anthropic 表示,它会使用密钥和前文来决定这些低风险选择的随机来源。拥有密钥的检测器可以计算一段文字是否在统计上符合 Claude 生成。这更像取证信号,而不是印在页面上的标签:它给出的是概率,不是肉眼可见的印记。
检测结果能证明什么
Anthropic 明确说明,水印可以表示 Claude 可能参与了写作或处理,但不能区分原创生成和重度编辑,也不能证明文字不是人写的、识别个人或组织,或排除其他 AI。出版者应把检测当作来源记录中的一个信号,而不是作者身份裁决。
为什么有些样本很难检测
该方法需要足够多的灵活词语选择来留下模式。Anthropic 说,短文本更不可靠,事实段落可选择的安全词更少,精确代码通常水印更少,因为改动词元可能会让程序失效。对人类原文只做轻度校对,也可能没有足够的 Claude 选择可供检测。
真实发布流程会发生什么变化
更好的做法是加强来源记录,而不是研究如何欺骗检测器。对于重要材料,保留草稿、资料笔记、作者修改、模型名称和审阅决定;要求贡献者披露实质性的 AI 协助;最后仍以证据、原创性、准确性和责任感评价文章。水印可以支持记录,但不能替代人工编辑。
更大的政策问题
Anthropic 将文本水印与欧盟透明度规则,以及文件领域的 C2PA 来源凭证联系起来。这里应区分两件事:标记来源,不等于判断内容优劣、合法性或欺骗性。随着不同供应商采用不同方案,机构应记录供应商和方法,不要把‘检测到 AI’当作普适的技术事实。
常见问题
Claude 水印能识别我是谁吗?
Anthropic 表示水印不包含身份信息,也无法追溯到具体个人、组织或聊天。它只用于表示 Claude 可能参与了内容处理。
水印能检测所有 AI 文章吗?
不能。该方法依赖 Claude 的密钥,对短文本、事实文本、代码或轻度编辑文本更不可靠,也不能检测所有其他模型。
