Anthropic给Claude装了隐形卧底

2026-08-15 18:25:08 · chineseheadlinenews.com · 来源: 新智元

你用Claude写的东西,即将能被全世界查出来!

就在刚刚,Anthropic发了一篇博客,首次公开解释了Claude文本水印的技术细节。

最新一批模型已经全部内置,老模型也在适配的路上。

从此,你的助手就成了Anthropic安插的卧底。

Anthropic这篇官博很长,核心就这几条:

怎么加的?在选词环节动了手脚,把随机数换成了密钥推导的数。你读不出来,但拿着密钥的人验得出来。

对输出有影响吗?官方说没有。Google拿Gemini做过AB测试,用户打分没有差异。

被谁逼的?欧盟AI法案要求标记AI生成内容,全球适用。

有什么坑?帮你校对的时候测不出来,帮你翻译的时候全是水印。短文本和纯事实几乎无效,而且分不清是Claude写的还是Claude改的。

能洗掉吗?有研究称用释义工具跑一遍就能移除98.3%的水印,成本只要4美分。

检测API?Anthropic说“即将推出”,但细节至今未定。

标记怎么藏进去的

这么说吧。

Claude写字是一个词一个词蹦的。每蹦一个词之前,先算出一堆候选词,每个带一个概率。

当好几个词概率差不多的时候,选谁都行。“阴沉的天空”和“灰蒙蒙的天空”意思一样,选哪个纯看随机数怎么掷。

水印动的就是这个随机数。

以前这个随机数没有规律,谁也预测不了。现在Anthropic用密钥算出一串有规律的数把它给替掉了。

最狠的是,Claude不会因此写出别扭的句子,也不会突然蹦出一个你没见过的生僻词。

但拿着密钥的人,可以直接从你的文字里把规律给验出来。

打个比方。

餐厅里红烧肉和糖醋排骨都68块,口味一样好,服务员推荐哪个看心情。

现在餐厅给服务员发了一本暗号本,上一桌点了鱼就推荐红烧肉,点了鸡就推荐糖醋排骨。

一周下来,两道菜卖出去的总量没什么变化。但经理翻一遍点单记录,就知道哪些推荐是按暗号本来的。

这个思路最早是Scott Aaronson 2022年还在OpenAI时提出的。谷歌DeepMind接过去做成了产品级方案SynthID-Text,2024年发在Nature上。

谷歌曾拿自家Gemini做过实测。他们给一部分真实用户悄悄开了水印,然后对比有水印和没水印的用户反馈,结果发现点赞和点踩在统计上并没有显著差异。

值得一提的是,这跟市面上Pangram之类的AI检测工具完全不同。

那些工具没有密钥,只能靠猜文风,猜错是常态。但有了水印之后,就不用猜了,直接拿验密钥就行。

这个卧底比你想的更不靠谱

Anthropic官博里有这么一句:水印只作用于Claude“选择”的词。

想想这意味着什么。

先说翻译。

你写了一篇中文文章让Claude翻成英文。每个英文词都是Claude选的,水印信号拉满。但思想和观点全是你的。

代码也有问题。

大部分位置需要精确输出,水印插不进去。但注释和变量命名有自由度,水印能嵌进去。

至于会不会产生bug,Anthropic说可以忽略不计。

但对工程师来说,“可以忽略”从来不等于“没有”。

短文本好不到哪去。

写个一两百字的邮件回复,可选择的词就那么几个,水印谤本留不下什么。

纯事实更是死角。

“牛顿最著名的著作叫做Principia……”后面只能跟Mathematica,没有第二个选项。越是精确表达,水印越没有发挥空间。

到了校对,水印几乎失灵。

你写了三千字的文章丢给Claude改错别字。它改了二十来个地方,整篇文章99%是你写的。那二十个改动里,水印确实留不下多少痕迹。

但问题是,你怎么证明那99%是你自己写的?

硅谷知名科技博主Ben Thompson直接开炮:“我很庆幸自己从来没养成把校对稿直接复制粘贴的习惯。”

而且就算水印测出来了,它也回答不了一个关键问题:这段话是Claude从头写的,还是你写了初稿、Claude帮你大改的?

Anthropic自己承认,水印只能判断Claude“可能参与过”,再细就分不了了。

换句话说就是,用过Claude的人,一律得准备自证清白。

4美分擦掉一切

2026年7月的一项研究发现,这种水印的移除率,高达98.3%。

具体来说,研究者把带水印的文本丢进AI释义工具,让AI换个说法重写一遍。

其中,59篇被检出水印的文本里,跑完之后58篇的水印直接消失。

按当前定价,处理一篇千字文章大约4美分。

而且检测API一旦公开,矛盾还会进一步加深。

因为任何人都能拿它反向优化,改一个词跑一次检测,直到水印信号降到安全线以下。

密码学里管这叫“逃避预言机”。

所以Anthropic的检测API至今“即将推出”,细节“仍在确定中”。

圆珠笔不是作者

不过,就算把这些技术问题全部解决,也依然绕不开一个更根本的问题:

你不会因为用Word写文章,就把Word列为共同作者。

而Anthropic的这种水印,无异于要求一支圆珠笔宣传自己是作者。

一段文字被追溯到Claude,然后呢?

按照Anthropic官方的说法,水印不改变作品所有权,也不改变法律责任归属。

所以现实就是:你的助手留下了记号,但这个记号既证明不了你有罪,也保护不了你清白。


    24小时新闻排行榜更多>>
  1. 在中国找地方政府要钱是技术活
  2. 十几块的退房礼,成了连锁酒店的“中产”证明
  3. 狂喝瘦身茶都没用?减肥铁律只有一条
  4. 深海底下为何会出现一座“湖”?
  5. 林肯号"部署250天",水兵跳海获救,川普:还不够久
  6. 高市“8·15”致辞不谈“反省”
  7. 美国逼盟友“必须在中美AI中二选一”
  8. 南华早报:习近平访美前,白宫准备无序让中国不安
  9. “牢笼合约”:30岁的我被母亲送进了特训营
  10. 麦考尔访台重申挺台立场 批中共威胁全球权力平衡
  11. 非沪籍居民及境外人士置换性购房政策微调
  12. 英军火巨头向中国出口技术数据 遭美国罚款3600万
  13. AI裁员潮后的“悔棋”:为何美国大企业开始重新招人?
  14. 建筑工挖墙挖到900万欧元黄金 等5年有机会分到手
  15. 最优“AI泡沫交易”:同时做多“傲慢”与“偏见”
  16. 中国城市,正在集体“啃老”
  17. 中国"贸易伪装"艺术至极致,川普的关税几同虚设
  18. 马科斯对美划红线,拒成台海交战方
  19. 《奥德赛》内地大爆,剑指7亿票房
  20. 用$20在拉斯酒店“赌”,能省多少银子?
  21. 9?11世贸中心六人被困电梯 靠刮水器绝境逃生
  22. 穆式皇马挑战巴萨
  23. 川普已经做好最坏打算
  24. 国乒男单崩了?连续三站WTT无缘八强 6人全出局
  25. 中期选举压力是否还能触发“TACO”?
  26. 最顶级大脑锻炼方式——这个老办法
  27. 中国移动收入下滑
  28. 小菜园:堂食翻台率回升,净利润下降24%
  29. 上市前夜,OpenAI遭遇“高管离职潮”
  30. 姚文瀚〈卖浆图〉卖啥“浆”?长知识了
  31. 朱莉安·浩夫晒度假照,穿比基尼状态吸睛
  32. 美上诉法院要求重审是否将大疆移出“黑名单”
  33. 享乐人生?来看看皇帝的一天有多辛苦
  34. 德国海军准将谈俄中威胁与未来战争
  35. 习近平访美前 川普政府据报准备无序令中方不安
  36. 川普爆粗口:“没有比这更大的侮辱”
  37. 告别百万年薪 华为“天才少年”要去瑞典做博士后
  38. 苹果在休斯敦开设先进制造中心 可供中小企业参观
  39. Sam说了句Elon永远不会忘记的话
  40. 加州“不治肺病”病例暴增19倍!祸首竟是厨房这东西
  41. 88岁吴伯雄上台致辞不慎跌倒 称“会尽量活久一点”
  42. 解放军反腐越烧越大 苗华遭查后 47名上将接连“出事”
  43. 开罗宣言纪念碑落成
  44. 以军曝光真主党武器库 中俄军火赫然在列
  45. 据报黎智英狱中受煎熬 难以站立
  46. 中国驻美使馆外集会,要求中国制定全国动物保护法
  47. 范斯与川普明显不同调
  48. C919订单破千,仅交付42架
  49. 川习会有变数?爆中方找不到接头人 习访美三预案流出
  50. 又一功勋离世,享寿105岁
  51. 纽约男杀害前女友后分尸 与尸块同住一个月始揭发
  52. 美撤走亚洲最后航母 重心从中国转向伊朗与西半球
  53. 以总理讽英国:首个拥核的“不列颠伊斯兰共和国”
  54. 川普扬言吞并霍尔木兹海峡?
  55. NASA太空人染怪病 失语20分钟 急返地球查不清
  56. 密西沙加36岁男子涉人口贩运被控罪
  57. 今年这4种风格,谁穿谁时髦
  58. 韩总统罕提议“正式结束朝鲜战争”
  59. 川普要求最高法院允许白宫恢复施工 重申涉国安
  60. 美国政府反制国际刑事法院