← 文章 / AI技术
TechCrunch 5小时前 · 2026-08-16 06:54:03 · 2 阅读

Anthropic 细化 Claude 新水印技术细节

Anthropic 周五发布了一篇博文,试图解答关于如何为 Claude 生成文本添加水印的一些基本问题,例如:水印具体如何运作?能否通过编辑隐藏?以及这对代码有何影响?

自 Anthropic 本周早些时候宣布将实施水印以符合欧盟《人工智能法案》透明度准则(该准则要求 AI 公司使用能够识别 AI 生成内容的系统)以来,Claude 用户一直在对此争论不休。

例如,Reddit 上有用户将此举描述为对无辜 Claude 用户的阴谋,另有人声称:“唯一不想使用这项功能的原因就是想欺骗别人。”《商业内幕》报道称,已有数十名 X 用户因此宣布取消 Claude 订阅。

Anthropic 的新博文首先概述了水印概念,解释称当 Claude 做出“低风险选择”(例如在描述天气时在“overcast”和“grey”之间二选一)时,它会在回复中生成一种“对读者不可见,但对持有解码密钥的人来说是可检测的”模式。

该公司表示:“水印不会影响 Claude 输出的质量。对读者而言,带有水印的回复与未带水印的回复无法区分。”

具体来说,Anthropic 表示将采用 Google DeepMind 团队 2024 年提出的 SynthID-Text 方案,并计划发布水印检测 API。Anthropic 强调,这与 Pangram 等公司提供的 AI 检测方法不同,后者是通过寻找写作中的“破绽”(如“his isn’t [X],it’s [Y]”这类句式)来揭示 AI 使用痕迹:“捕捉这些模式与检查水印在本质上截然不同。”

有人会重写文本来隐藏水印吗?Anthropic 表示这有可能,但“轻度编辑可能无法完全移除水印”,而“完全重写(替换每个单词)则可以”。

“当然,在后一种情况下,很难说该文本还能否被描述为 AI 生成,”该公司表示。

至于在仅经过校对或轻度编辑的文本中,水印是否可被检测到,Anthropic 表示这取决于“文本长度以及 Claude 的编辑程度”。如果只是轻度编辑,“几乎所有的单词”都由人类作者撰写,“水印几乎无处附着(如果有的话)。”

代码方面,水印应该比其他文本弱,因为模型需要生成可运行的代码,没有自由在多种同等有效的选项中进行选择。

“话虽如此,在代码中某些单词或术语存在任意选择的地方,水印仍然可以发挥作用,例如代码注释,”Anthropic 表示,“但根据定义,它对实际生成的代码影响微乎其微。”

Anthropic 还表示,Claude 并非唯一生成带水印文本的 AI 聊天机器人,因为“其他主要模型开发商已签署了同一行为准则,并将实施自己的水印。”

原始来源: TechCrunch

评论 (0)