Claude 开始给生成文本加隐形水印:复制粘贴保留不等于改写后可验证
作者:韩启明|OC 政策与安全编辑
作者:韩启明|OC 政策与安全编辑
据 TechCrunch 报道,Anthropic 更新帮助文档,宣布为 Claude 生成的文本加入机器可读水印,并为支持的图片、SVG 等文件加入 C2PA 来源凭证。新措施对应欧盟 AI 法案第 50 条自 8 月 2 日起适用的生成内容透明度要求。
一句话结论:文本水印可以在普通复制粘贴后继续存在,却不能证明经过大量改写的文章一定来自或不来自 Claude;它是概率性识别信号,不是作者身份、事实真实性或学术作弊的确定证据。
文本与文件采用的不是同一种机制。文件可以附带经过数字签名的 C2PA 元数据,记录生成工具和修改链;纯文本没有稳定元数据容器,模型只能在不改变明显含义的前提下,通过词语和 token 选择嵌入统计模式。复制粘贴会保留字词,因此可能保留水印;改写、翻译、缩短或混入人类文字则会逐渐削弱信号。
Anthropic 称,水印在模型层加入,因此不论文本来自 Claude 网页、API、Claude Code 或其他产品表面,都能使用同一机制。8 月 2 日后推出的相关模型将在发布时支持,公司还计划在过渡期内覆盖旧模型。但其公开说明仍未完整回答检测工具向谁开放、需要多长文本、误报率是多少,以及多少编辑会让水印失效。

欧盟要求提供者让 AI 生成或修改的内容可被机器识别,同时对深度伪造和用于公共利益信息的部分文本设置可见披露要求。欧盟委员会发布的实践准则是帮助合规的自愿路径,不等于所有 AI 文本都必须在页面上贴同一种肉眼标签,也不等于只有签署准则才能合法运营。
水印最危险的误用,是把检测结果当成惩罚依据。统计水印可能因短文本而置信度不足,也可能被人为扰动;人类写作被模型润色后,归属边界更加模糊。学校、媒体和企业可以把它作为调查线索,但必须结合版本记录、引用、工作过程和申诉机制。
关键事实
- 来源:Anthropic 帮助文档、TechCrunch、欧盟委员会
- 涉及公司:Anthropic
- 核心技术:模型级文本水印、C2PA 文件来源凭证
- 法规背景:欧盟 AI 法案第 50 条透明度义务自 2026 年 8 月 2 日适用
OC 判断
文本水印最现实的价值是平台级统计检测,而不是逐篇定罪。Anthropic 下一步需要公开检测接口、误报与漏报数据、编辑鲁棒性,以及不同语言中的效果。如果只有厂商能检测,水印会增加合规声明,却难以成为公共验证基础设施。
为什么重要
- 对用户:复制文本可能保留来源信号,但这不意味着厂商能追踪是谁复制或知道文本事实是否正确。
- 对开发者:API 输出、文件输出和用户二次编辑需要采用不同的来源记录策略。
- 对机构:不能把一次水印检测结果单独用于处罚,应保留人工复核与申诉。
评论
围绕这篇文章补充信息、提出问题或分享观察。