用Claude写论文的人天塌了?Anthropic宣布,即日起给输出文本加上水印!

admin 2026-08-14 09:01:23 网络安全文章 来源:ZONE.CI 全球网 0 阅读模式

文章总结: Anthropic宣布自2026年8月2日起为Claude输出添加隐形水印和数字签名元数据,通过操纵选词概率形成统计指纹,全球生效以遵守欧盟AI法案。水印可被改写破坏但难以完全消除,对论文代写等场景有影响,检测工具将推出。 综合评分: 75 文章分类: ai安全,安全工具,技术标准,数据安全


cover_image

用 Claude 写论文的人天塌了?Anthropic 宣布,即日起给输出文本加上水印!

内存泄漏

2026年8月12日 00:00 辽宁

在小说阅读器读本章

去阅读

以下文章来源于AI 现变研习社 ,作者清风徐徐来

AI 现变研习社 .

分享超有趣的 AI 玩法,传播实用的 AI 姿势,共同见证 AI 的无限可能

说实话,看到这个消息的第一反应是:完了,用 Claude 写论文的人要哭了。

A 公司又一次颠覆了我的认知。我一直以为只有图片、视频这种东西才有水印,你一个文本聊天工具,怎么也能加水印了?而且是那种看不见摸不着、藏在字里行间的隐形水印。

很多人写论文都用 Claude,为什么?因为它文笔是真的好,语句流畅、逻辑清晰、读起来特别舒服。可正因为这样,它成了论文代写的高频工具。

现在,天塌了——论文检测要来了。

消息一出,网友炸了锅

这消息一发布,评论区直接热闹了,各种观点都有。

有人直接开怼,说 Anthropic 多虑了——”他们的垃圾模型不用加水印,大家也能看出来是它生成的”。

这话虽然毒,但也戳中了一个点:其实最近几代 Claude,人眼都能看出是 AI 写的,有人甚至怀念 opus 4.6,说那是”最后的辉煌”。

也有技术流的网友看得很透彻。有人指出:你去写一篇 AI 专业领域的文章,不管你怎么写,AI 检测概率都在 95% 以上,因为那些专业术语你根本改不掉。

所以现在发技术类 AI 文章在各大平台反而最不受欢迎——检测通过率低,不但不被推荐,还可能被限流。他甚至反问了一句很扎心的话:个人转 codex 转 Claude 再转 GPT,这内容到底算谁的?

还有网友觉得,这水印迟早会变成行业共识——就像 reddit、snapchat、X 这些平台,将来可能就用它来辨识内容的价值和创作投入。隐形水印本身证明不了什么,但它代表的趋势,谁也拦不住。

到底发生了什么

Anthropic 官方宣布,要给 Claude 的输出内容加上机器可读的标记。具体来说分两部分:一是文本里嵌入隐形水印,二是生成的图片(如有)等文件里附带数字签名元数据

而且这不是画饼,8 月 2 日(也就是上周)开始,所有新发布的 Claude 模型已经强制执行这套机制了。

范围:全球!

为什么要搞这个

原因很简单:合规。

这是 Anthropic 为遵守欧盟 AI 法案第 50 条签署的透明度行为准则。注意,执行范围不限于欧盟——全球所有用 Claude 的地方都会生效。也就是说,跟你在不在欧洲没关系,只要用的是 Claude,就跑不掉。

这水印到底咋实现的?

很多人以为水印就是偷偷塞几个看不见的字符(零宽字符那种),其实没那么简单。Claude 大概率不是这么干的。

更可能的方式是:**生成文字时,轻微操纵每一步的选词概率。网友Alpha捕手做了个原理图如下:

举个例子,模型准备写”这项技术带来巨大___”,原本”影响、变化、价值”都能选。系统会拿一把秘密密钥,把候选词动态分成”绿名单”和”红名单”,然后悄悄提高绿名单词语的出现概率。

单看任何一句都完全正常,但几百个词累积下来,整篇文章就会形成一套只有检测器知道的统计规律——像一首读不出押韵、但机器能识别韵脚的诗。

这方法高明在哪?因为水印藏在选词组合里,不依赖格式也不依赖元数据,所以复制粘贴后还在,改少量文字也未必能完全消除。当然,全文重写、翻译、大量混入其他内容,信号还是可能被破坏。

简单说:Claude 不是给文字盖章,而是每次选词时轻轻拨一下方向盘,最后留下一个统计指纹。

在此之前没人这么干过

讲真,Claude 之前从没公开部署过文本水印。OpenAI 倒是开发过方案,但一直没上线。Anthropic 这次直接在文本层面落地,算 AI 大模型厂商里走得相当靠前的一家。

对你的直接影响

拿 Claude 起草的邮件、报告、文章,都会携带可被机器检测的水印。Anthropic 正在开发配套检测工具,未来第三方也能检测。

但也不用慌,限制也很实在

检测到水印 ≠ 确认 Claude 是原作者。 很多人拿它润色、翻译、总结已有内容,水印只能说明内容”可能经过 Claude 处理”。

反过来也一样:检测不到水印 ≠ 内容不是 AI 写的。 文本被大量改写后水印会消失,太短的文本信号不够可靠,文件经过格式转换或截图也会丢元数据。

所以这套机制没想象中那么”神”,能绕,只是麻烦点。

那到底能不能躲?先搞懂这水印是啥

很多人其实没搞清楚文本水印到底怎么回事。

简单说,它是嵌进语言生成过程里的一种印记。比如某个地方 A、B 两个同义词都能用,系统就总选 B;某个表达方式 C/D 都行,就总选那个次高概率的 D。文本看起来完全正常、毫无破绽,但实际上每个词都被”安排”过,是可以被检测出来的。

关键一点:水印是加在文本内容本身上的。所以就算你把文字转成图片、再用 OCR 扫描回文本,一样没用——水印跟着内容走,不是跟着格式走。

而且这套机制的添加和检测都是大模型自己做的,人根本感知不到。你读不出来,机器一眼看穿。

至于能不能躲?理论上改文本可能破坏水印,但问题是——你根本不知道水印藏在哪些词上。你以为是”影响”,它可能标的是旁边那个”变化”;你改了这句,它水印还在下句。想全破坏掉,基本等于把整篇文章重写一遍。

所以结论很现实:能绕,但没那么容易。

最后说一句

AI检测现在还是玄学。

之前有用古人写的《长恨歌》拿去某平台检测的,结果被判定为AI味太浓。

至于用 Claude 写论文的朋友——且用且珍惜,这波水印潮才刚开始。以后 AI 写的东西,可能真的躲不掉了。

在AI的年代,那些伟大的文学作品将更加伟大。

用什么办法去掉Claude的水印?大家评论区来出出主意?


免责声明:

本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。

任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。

本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我

本文转载自:内存泄漏 《用 Claude 写论文的人天塌了?Anthropic 宣布,即日起给输出文本加上水印!》

评论:0   参与:  0