WeChat (機器之心)
ai-toolssecurity-privacy
Original source

Claude 水印已被破解 — watermarks-remover 斬獲 11k Star

Summary

Anthropic 為 Claude 全部文本輸出添加隱藏水印(基於 Google DeepMind SynthID-Text 方案),引發爭議後出現開源反制工具。

水印技術原理:

  • 在模型做「無關緊要的選擇」時植入統計模式(如選 overcast vs grey)
  • 累積構成隱藏簽名,持有密鑰者可檢測
  • 輕度編輯無法去除,完全改寫可消除

watermarks-remover 三層去除:

  • A 層(確定性清洗):Python 腳本去除不可見 Unicode 字符、bidi 控制符等
  • B 層(統計水印破壞):Agent 改寫文本,破壞 token 採樣統計模式(覆蓋 Claude/SynthID/OpenAI/Kirchenbauer)
  • 文件層:去除 PNG/JPEG/PDF/DOCX 等中的 C2PA/EXIF/XMP 元數據

有趣細節:

  • Claude 拒絕安裝這個去除器作為 Agent Skill
  • 最終由 GLM 5.2 完成安裝(諷刺的是去除器代碼很可能出自 Claude 本身)

爭論焦點:

  • 反對方:付費用戶有權不被標記,水印創造「AI 內容二等公民」
  • 支持方:溯源是必要公共基礎設施,「使用權」≠「隱瞞來源權」