首页 今日快讯文章正文

不到24小时就出了!欧盟1500万罚款也难拦,黑客一招就破功

今日快讯 2026年08月17日 15:20 0 admin

AI水印会长期存在,还是只是做做样子?在Anthropic宣布推出相关功能后,不到24小时,一款能去除Claude文本中AI水印的免费工具就出现在GitHub上。几天内,又有几款类似工具陆续出现,目标从不可见的Unicode标记到Anthropic附加在生成文件中的签名元数据不等。

不到24小时就出了!欧盟1500万罚款也难拦,黑客一招就破功

如果AI水印如此容易被破解,它究竟能否长期存在,还是仅仅是摆设?随着Anthropic、谷歌、微软、Meta和OpenAI纷纷为自家AI生成内容添加标记,这个问题引发了广泛讨论。而其答案,远非简单的“是”或“否”。

为什么AI水印突然无处不在。欧盟《人工智能法案》第50条自2026年8月2日起适用,要求开发生成式人工智能系统的公司以机器可读、可检测的格式标记其输出内容。违规罚款最高可达1500万欧元,或公司全球年度营业额的3%,以较高者为准。

在这一期限前,包括Anthropic、谷歌、Meta、微软和OpenAI在内的约190家机构签署了欧盟关于AI生成内容透明度的自愿性《行为准则》。这一框架可使签署方被推定为符合相关要求。

截止日期过去9天后,Anthropic宣布,Claude将直接在文本输出中嵌入AI水印,即一种不可见的统计模式,并在生成文件中加入签名的C2PA元数据。这一功能面向全球推出,不仅限于欧盟用户。

谷歌自2023年以来一直在AI生成图像中添加水印,随后将这一做法扩展到文本、音频和视频。报道称,OpenAI数年前也开发过类似的文本水印能力,但最终没有部署。

不到24小时就出了!欧盟1500万罚款也难拦,黑客一招就破功

为什么AI水印如此容易失效。这些公司面临的技术挑战本身就不对称。AI水印必须承受用户对文本或文件几乎所有可能的处理,而攻击者只需找到一种有效方法即可。

统计标记会在编辑后衰减。Anthropic的文档承认,校对、翻译、大幅改写,或文本过短,都可能导致其文本水印无法被检测。去除工具发展迅速。在Anthropic宣布相关功能后一天内出现在GitHub上的工具,通过对Claude输出内容进行一到两轮改写,就能破坏水印所依赖的大约70%的词元序列。该项目平均每天新增约72个星标。

检测到水印并不等于能证明作者身份。Anthropic指出,匹配结果仅说明Claude“可能处理过”相关内容,不能证明内容就是由Claude创作。平台和雇主在将AI水印检测结果视为定论时,未必会充分考虑这种模糊性。反弹已经让Anthropic流失订阅用户

不到24小时就出了!欧盟1500万罚款也难拦,黑客一招就破功

尽管AI水印本身并不稳固,但它已真实影响用户行为。美国《商业内幕》报道,在水印功能上线后,数十名用户取消了Claude订阅,其中几位已付诸行动。

一名AI顾问表示,他取消订阅是因为即便是自己写的文本,只要经过Claude轻度编辑,也可能出现水印,而不仅仅是Claude从零生成的内容才会被标记。一名软件工程师则认为,水印只是确认了他因其他服务问题而准备离开的决定。还有一家数字代理公司的创始人表达了更广泛的担忧:一旦围绕某家供应商的工具建立工作流,这家供应商日后就可以单方面改变规则。

Anthropic对《商业内幕》表示,公司尚未观察到与这次公告相关的可衡量退订增长。截至去年,其企业客户约为300000家。在这样的规模下,社交平台X上几十条公开投诉几乎微不足道。

不过,无论数量多少,这种反弹本身都具有参考价值。即便AI水印可以被GitHub上的免费工具轻易去除,它仍会改变部分用户对所付费产品的看法。水印不必技术上足够强大,也能影响信任;只需足够可见,或相关传闻足够广,就足以让人觉得某些东西已经改变。

不到24小时就出了!欧盟1500万罚款也难拦,黑客一招就破功

AI水印会留下来吗?如果把它看作一种技术保证,AI水印更像是一种表演。面对有明确目标的对手,它并不牢靠,而Anthropic也未声称它牢不可破。但若将其视作监管基础设施的一部分,至少在可预见的近期,它很可能会继续存在。

现阶段,它的任务不是做到无法破解,而是成为默认配置。长期目标,是为那些真正会被审查的场景留下记录:例如争议、审计或诉讼发生时,没有人事先想到要去除标记。

监管机构设计底层框架时,正是基于这一假设。欧盟《行为准则》要求采用分层方法,将元数据、统计标记和检测工具结合,原因在于,没有任何单一层级被认为能够独立发挥作用。

不到24小时就出了!欧盟1500万罚款也难拦,黑客一招就破功

这也与过去20年数字版权管理以及其他“容易绕过”的来源追踪系统所走的路径一致:它们往往在发布几天内被破解,但多年后仍是行业标准,因为支撑这些标记的,是制度层面的力量,而非标记本身的技术韧性。

AI水印会带来什么影响?对于生产或依赖AI辅助内容的企业来说,至少有两个直接后果。一种新的默认状态,也是一种新的信号。AI生成内容如今会默认带有标记,除非有人刻意将其去除。随着时间推移,没有AI水印的内容本身,可能会显得更像经过刻意处理,就像一张被清除元数据的照片,往往比一张从未带过元数据的照片更容易引起怀疑。

信任流失的速度,可能快于技术本身的变化。Anthropic遭遇的退订表明,用户感知往往先于技术现实发生变化。水印不必完美有效,也足以让供应商损失用户好感;同样,它甚至不必真的被破解,客户也可能因此产生被监视的感觉。

不到24小时就出了!欧盟1500万罚款也难拦,黑客一招就破功

AI水印并不只是做做样子,但它也远不是最终答案。它从一开始就被设计成一种默认机制,而不是一把锁。那些将其视为更强保证的企业,反而最可能率先吃亏。

发表评论

长征号 Copyright © 2013-2024 长征号. All Rights Reserved.  sitemap