关注飞总聊IT,了解IT行业的方方面面。
8月11日,Anthropic悄悄更新了帮助中心的一篇文档。 没有发布会,没有博客长文,就是改了个文档。 但内容不小:从2026年8月2日之后发布的Claude模型,生成的文字里都会嵌入一段看不见的水印,生成的图片文件会带上数字签名的溯源信息。
翻译成人话:你用Claude写的每一段字,从今天起,都带着一个你看不见的记号。水印不是在应用层加的,而是直接做在模型输出里。这意味着你把Claude写的东西复制粘贴到Word、微信、邮件、网页——记号跟着走。改几个字,可能也还在。
技术原理业界大致清楚:在模型每一步选词的时候,从那些统计上几乎等价的候选词里,按一个密钥偏一点点。单看一句话完全正常,攒够长度,整段文字就带上了一个可检测的统计特征。
所以它不影响质量——因为那些词本来就差不多。也所以它对短句无效——因为攒不够统计置信度。
图片走的是另一套。.svg、.png、.jpg这些格式,Claude会附上基于C2PA标准的签名溯源信息,能证明这个文件被Claude处理过,也能看出这段元数据有没有被人动过手脚。
覆盖范围有多大? 全球。不分地区。API、Claude.ai、Claude Code、Claude Cowork、Claude Tag,全都算。通过AWS、谷歌云、微软Foundry调用Claude,文字水印一样带。
为什么突然搞这个? 欧盟《AI法案》第50条的透明度要求,8月生效。Anthropic签了欧盟那份《AI生成内容透明度行为准则》。
也就是说,这不是产品创新,是合规动作。 但Anthropic做了一个选择:不是给欧洲用户单开一套,而是全世界一起上。
这个选择可以理解成负责任,也可以理解成——分地区维护两套模型太麻烦了,不如一刀切。
那么问题来了:这玩意儿到底有用吗? 先看Anthropic自己怎么说的。第一,检测到水印,不等于内容是AI写的。你把自己写的稿子丢给Claude润色、翻译、校对,输出的东西照样带水印——哪怕思想和文字都是你的。
第二,没检测到水印,也不等于内容是人写的。老模型生成的、被大改过的、被改写过的、被翻译过的、和别的内容混在一起的,都测不出来。太短的段落也测不出来。
翻译一下这两句话的意思: 这不是AI检测器。它只能说明"Claude可能碰过这段内容",不能说明"这段内容是Claude写的"。 那更尴尬的问题是——现在谁能检测? 答案是:没人。
Anthropic说会发布技术文档,让第三方能检测Claude的水印和溯源信息。但文档还没出来。在它出来之前,没有任何开发者能把水印检测做进自己的产品里。
所以目前的状态是:水印已经在往全世界的输出里埋了,但检测工具还在路上。 这就有点意思了。 你的内容已经被打上标记,但你无法自己验证这个标记的存在,也无法验证它到底记录了什么。 用户的反应,可想而知。
一条相关的推文拿到了超过61万次浏览,付费用户里的反应以负面为主。 不满的点也很直接:我花钱买的服务,输出的内容里被塞了我看不见也删不掉的东西。
这个不满合理吗? 部分合理。 因为水印确实是个不对称的东西——它服务的对象不是你,是别人。是平台,是监管机构,是想搞清楚"这段内容哪来的"的第三方。你付了钱,承担了标记,但收益归了别人。
但反过来说,一个所有AI生成内容都无法追溯的世界,代价可能更大。假新闻、伪造证据、批量水军——这些东西不会因为你反对水印而消失。
再说一个更值得琢磨的角度。OpenAI早就承认自己没有部署文本水印。 技术上,OpenAI完全做得到——这套统计水印方案在学术界公开好几年了。 它没做,是因为不想。
原因也很实际:水印会让一部分用户转向没有水印的竞品。在一个还在抢用户的市场里,主动给自己的输出打标记,就是主动送客户出门。
推荐飞总知识星球,在私域场合里畅所欲言,聊聊职场发展的事情,和飞总提问交流,这么低 的价格不会一直保留,机会难得,一定不要错过这个的机会。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.