i0ncube_R 发表于 2026-8-16 08:53

Anthropic将为模型输出部署隐形水印

就在刚刚,Anthropic发了一篇博客,首次公开解释了Claude文本水印的技术细节。

最新一批模型已经全部内置,老模型也在适配的路上。用Claude写的东西,即将能在全世界范围内溯源。

Anthropic这篇官博很长,核心就这几条:

怎么加的?
在选词环节动了手脚,把随机数换成了密钥推导的数。你读不出来,但拿着密钥的人验得出来。

对输出有影响吗?官方说没有。Google拿Gemini做过AB测试,用户打分没有差异。

能洗掉吗?

Anthropic称用释义工具跑一遍就能移除98.3%的水印,成本只要4美分。

检测API?
Anthropic说「即将推出」,但细节至今未定。

标记怎么藏进去的?
Claude写字是一个词一个词蹦的。每蹦一个词之前,先算出一堆候选词,每个带一个概率。当好几个词概率差不多的时候,选谁都行。「阴沉的天空」和「灰蒙蒙的天空」意思一样,选哪个纯看随机数怎么掷。水印动的就是这个随机数。以前这个随机数没有规律,谁也预测不了。现在Anthropic用密钥算出一串有规律的数把它给替掉了。最狠的是,Claude不会因此写出别扭的句子,也不会突然蹦出一个你没见过的生僻词。但拿着密钥的人,可以直接从你的文字里把规律给验出来。

一段文字被追溯到Claude,然后呢?
按照Anthropic官方的说法,水印不改变作品所有权,也不改变法律责任归属。所以现实就是:你的助手留下了记号,但这个记号既证明不了你有罪,也保护不了你清白。

全球定位老钟使用者!

论坛助手,iPhone

samfs 发表于 2026-8-16 08:54

编程用户不怕吧,写文的用户会用 Claude 写吗?

星花 发表于 2026-8-16 08:55

这算起点科技。

羊寢 发表于 2026-8-16 08:58

samfs 发表于 2026-8-16 08:54
编程用户不怕吧,写文的用户会用 Claude 写吗?

现在不知道不过去年还是挺多的,而且克小子也是外模御三家的用户里面对国模最抵触的,代码狗不评价但是拿克写文的我是觉得挺那啥的

FeteFrumoase 发表于 2026-8-16 09:00

按照官方说法,为了满足欧盟对 AI 生成内容机器可读标记的要求,Anthropic 最终选择了 Google DeepMind 的 SynthID-Text 路线。由于目前还缺少可靠的区域区分方案,这套水印上线后还会直接应用到全球 Claude 用户。

bn.ssgr 发表于 2026-8-16 09:02

samfs 发表于 2026-8-16 08:54
编程用户不怕吧,写文的用户会用 Claude 写吗?

有影响,比如变量命名

魔神赵日天 发表于 2026-8-16 09:05

这个分布扭曲蒸馏会学到么

—— 来自 鹅球 v3.3.96

Hibino 发表于 2026-8-16 09:09

道高一尺魔高一丈?
https://github.com/guillaumemeyer/watermarks-remover

熊边上 发表于 2026-8-16 09:09

目前的说法是应欧盟要求做可识别是ai,所有符合欧盟要求的ai都要这么做,但这个水印无法追溯特定的人和对话,基本等于不可溯源(真实是否这样那是另话)

星花 发表于 2026-8-16 09:11

不会。
——那么快就作妖,俺寻思A/会是最先出局的那批。

名居守 发表于 2026-8-16 09:13

看来➗这个称号终究是a畜的
页: [1]
查看完整版本: Anthropic将为模型输出部署隐形水印