Claude 文本水印的工作原理

未来的 Claude 模型将为生成文本加入一种不影响内容质量、不可被读者察觉且不携带身份信息的水印。它通过调整模型选词时的随机性,在长文本中留下只有持有密钥者才能检测的统计模式,用于判断 Claude 是否可能参与了写作。 原文:How Claude text watermarking works 本文由 LobsterAI 自动翻译和发布。 未来的 Claude 模型将生成带有水印的文本。这是一种用于判断 Claude 参与文本写作可能性的方法。为遵守《欧盟人工智能法案》(EU AI Act),Anthropic 正与其他几家主要 AI 提供商一同实施这一变更。 要点总结 水印方法不会对 Claude 输出的质量或内容产生任何实际影响。 读者无法分辨带水印与不带水印文本的差异。 文本中不会添加任何内容,也不存在隐藏字符。 水印不需要额外 token,不会增加费用。 水印不携带身份识别信息,无法追溯到特定个人、组织或对话。 水印并非 Claude 独有。自 8 月 2 日起,欧盟要求 AI 提供商标记 AI 生成内容。其他主要模型开发商也签署了同一《行为准则》,将实施各自的水印。 什么是水印? Claude 这类大语言模型每次生成一个词。每次决定下一个词时,会从候选词中依据前文选出最合理的。比如“今天天气寒冷而且……”,下一个词几乎不可能是“甜腻的”,却很可能是“阴沉的”或“灰蒙蒙的”。大多数情况下选哪个对读者并不重要,此时由随机数决定。 水印利用的正是这些无关紧要的选择——这类选择在一段文本中会出现许多次——在回答中留下模式。读者察觉不到,但持有密钥的人能够检测。使用水印时,选择仍然是随机的,只是随机性的来源发生了变化:系统使用密钥加上前几个词来决定选词。 人们可以检查词序列是否符合“使用密钥的 Claude 会做出的选择”,从而计算文本由 Claude 生成的概率。 水印如何影响输出? 水印不影响输出质量。对读者而言,带水印与不带水印的文本没有区别,这与钞票等肉眼可见的水印不同。Anthropic 的内部测试未发现水印对内容、创意或可读性产生任何影响。 在 SynthID-Text 论文中,DeepMind 对部分 Gemini 流量进行了对比,结果显示用户点赞与点踩的数据没有统计显著差异;在受控研究中,人类评分者同样没有发现质量差异。 可以用一个类比来理解:玩大富翁时不使用骰子,而是改用圆周率的小数位表,从随机位置开始依次取数作为“骰子”结果。走法依然是随机的,游戏结果没有差异;但事后如果能看到全部走法序列并知道 π,就能推断这局是否使用了 π——这局就是“带水印的”。Claude 文本水印的原理与此相同。 具体使用哪种方法? Claude 的文本水印是 DeepMind 于 2024 年发表在《自然》上的 SynthID-Text 方法的一个版本,属于可追溯至 Scott Aaronson 2022 年提案的方法家族。它们遵循同一个原则:水印只改变选词时随机性的来源。...

August 15, 2026 · 1 min · fisherdaddy