BlackHalo logo
Published on

Anthropic在Claude中的‘水印’文本篡改是对写作的亵渎

Authors
  • Name
    ropbear
    daringfireball.net
Anthropic Claude文本水印示意图
头图来源: 来源页面

引言

Anthropic宣布将在所有Claude模型中嵌入文本水印,以遵守欧盟《AI生成内容透明度行为准则》。该公司最初声称水印“不可察觉,不改变意义、质量或可读性”,但实际采用的技术却恰恰相反——通过语义隐写术在词选择中嵌入统计指纹,从而牺牲文本的精确性和清晰度。本文作者John Gruber对此表示强烈愤慨,认为这是对写作本质的亵渎。

水印技术原理

Anthropic在另一篇技术文章中解释了实际工作原理:模型在生成每个token时,会依据一个秘密密钥将候选词分为“绿色”和“红色”列表,并略微偏向选择绿色列表中的词。这种偏差类似于一枚51:49的硬币——虽然多数情况下偏向绿色,但仍有相当概率选择红色。只有持有密钥的人才能通过统计绿色词的比例来判定文本是否由Claude生成。文本越长,检测置信度越高;短文本(如少于200个token)则无法可靠检测。

技术缺陷

作者指出,这种方法的根本问题在于:没有两个同义词具有完全相同的含义。“He leaped at the chance”和“He jumped at the opportunity”虽然意思相近,但措辞的细微差别会影响表达效果。用户期望LLM在每一个决策点选择最精确、最恰当的词语,而水印机制却为了满足外部检测需求而故意引入次优选择。即使在私密对话中,用户与Claude的交流也毫无理由被篡改——这完全违背了用户利益。

对欧盟法规的批评

欧盟法规要求水印对“典型处理方式”(如截图、OCR、复制粘贴、翻译等)具有鲁棒性,并强制服务条款禁止用户移除水印。这实际上意味着用户不得对输出进行任何改写,因为词选择本身就是水印。作者认为,这种法规只会惩罚诚实用户(如学生、员工),而恶意用户只需使用非合规的AI改写工具即可轻松绕过检测。James Padolsey指出,该法规将“辅助”与“完全生成”混为一谈,对难度本身施加道德溢价,却无法阻止真正的欺骗。

结论

Anthropic选择了一种比法律最低要求更宽泛的模型级实现,这虽然方便合规工程,但既无法有效防止滥用,又严重损害了普通用户的体验。作者呼吁:任何工具都不应为了嵌入隐藏线索而牺牲一丁点的清晰度、连贯性、意义或质量。写作的本质在于精确表达,而水印机制是对这一本质的背叛。

补充讨论与深层反思

John Gruber在文中进一步指出,Anthropic最初的支持文档声称水印“不可察觉,不改变意义、质量或可读性”,这完全是一种误导。实际披露的技术细节表明,水印必然改变词选择,从而改变文本的语义层次。作者认为,这种做法不仅是对用户信任的背叛,更是对写作这一人类创造行为的亵渎。他质疑:为什么要在私密对话中也加上水印?这完全不是为了保护版权或防止抄袭,而是为了满足欧盟的“保姆式”监管,牺牲了用户的真实需求。

Grube r强调,写作的本质在于精确表达。每一个词的选择都承载着特定的含义和情感。即使最优秀的LLM,在生成文本时也常常缺乏人类写作的“清晰度”。现在Anthropic还故意降低文本质量,只为满足监管要求,这令人难以接受。他引用了James Padolsey的分析,指出这种水印技术极为脆弱:恶意用户只需使用非合规的AI改写工具,就能轻松移除水印,而诚实用户却要承担所有副作用。这无异于“给老实人戴上手铐,却让罪犯自由潜逃”。

从更广阔的视角看,欧盟《AI生成内容透明度行为准则》的初衷或许是为了遏制虚假信息,但其具体条款却充满了技术上的天真和操作上的荒谬。例如,要求水印对截图、OCR、翻译等处理方式具有鲁棒性,这几乎是不可能实现的目标。更严重的是,该法规将“辅助写作”(如AI帮用户润色句子)与“完全生成”混为一谈,导致所有AI辅助行为都处于被怀疑的阴影中。这既不符合技术现实,也不利于AI的健康发展。

Anthropic作为美国公司,本可以选择仅在欧洲市场执行该法规,但它却选择在全球范围、所有模型中强制实施水印。这种做法引发了对“监管霸权”的担忧。作者呼吁业界重新思考:技术的目的是服务人类,而不是困于僵化的规则。只有当生成文本的唯一目标是满足用户需求时,AI写作才能真正发挥其潜力。任何为了外部目的而篡改文本的行为,都是对写作本质的背叛。

原标题:Anthropic's ‘watermark’ text adulteration in Claude is a perversion of writing。 HN 原始发布时间:2026年8月17日星期一。当前记录为 760 分、673 条评论。

阅读原文 · 查看 HN 讨论