Anthropic将为模型输出部署隐形水印
就在刚刚,Anthropic发了一篇博客,首次公开解释了Claude文本水印的技术细节。最新一批模型已经全部内置,老模型也在适配的路上。用Claude写的东西,即将能在全世界范围内溯源。
Anthropic这篇官博很长,核心就这几条:
怎么加的?
在选词环节动了手脚,把随机数换成了密钥推导的数。你读不出来,但拿着密钥的人验得出来。
对输出有影响吗?官方说没有。Google拿Gemini做过AB测试,用户打分没有差异。
能洗掉吗?
Anthropic称用释义工具跑一遍就能移除98.3%的水印,成本只要4美分。
检测API?
Anthropic说「即将推出」,但细节至今未定。
标记怎么藏进去的?
Claude写字是一个词一个词蹦的。每蹦一个词之前,先算出一堆候选词,每个带一个概率。当好几个词概率差不多的时候,选谁都行。「阴沉的天空」和「灰蒙蒙的天空」意思一样,选哪个纯看随机数怎么掷。水印动的就是这个随机数。以前这个随机数没有规律,谁也预测不了。现在Anthropic用密钥算出一串有规律的数把它给替掉了。最狠的是,Claude不会因此写出别扭的句子,也不会突然蹦出一个你没见过的生僻词。但拿着密钥的人,可以直接从你的文字里把规律给验出来。
一段文字被追溯到Claude,然后呢?
按照Anthropic官方的说法,水印不改变作品所有权,也不改变法律责任归属。所以现实就是:你的助手留下了记号,但这个记号既证明不了你有罪,也保护不了你清白。
全球定位老钟使用者!
论坛助手,iPhone 编程用户不怕吧,写文的用户会用 Claude 写吗? 这算起点科技。 samfs 发表于 2026-8-16 08:54
编程用户不怕吧,写文的用户会用 Claude 写吗?
现在不知道不过去年还是挺多的,而且克小子也是外模御三家的用户里面对国模最抵触的,代码狗不评价但是拿克写文的我是觉得挺那啥的 按照官方说法,为了满足欧盟对 AI 生成内容机器可读标记的要求,Anthropic 最终选择了 Google DeepMind 的 SynthID-Text 路线。由于目前还缺少可靠的区域区分方案,这套水印上线后还会直接应用到全球 Claude 用户。 samfs 发表于 2026-8-16 08:54
编程用户不怕吧,写文的用户会用 Claude 写吗?
有影响,比如变量命名 这个分布扭曲蒸馏会学到么
—— 来自 鹅球 v3.3.96 道高一尺魔高一丈?
https://github.com/guillaumemeyer/watermarks-remover 目前的说法是应欧盟要求做可识别是ai,所有符合欧盟要求的ai都要这么做,但这个水印无法追溯特定的人和对话,基本等于不可溯源(真实是否这样那是另话) 不会。
——那么快就作妖,俺寻思A/会是最先出局的那批。 看来➗这个称号终究是a畜的
页:
[1]