Claude 水印已被破解 — watermarks-remover 斬獲 11k Star
- URL: https://mp.weixin.qq.com/s/ZXcLRIli8V8shxuauW2TQw
- Date Saved: 2026-08-17
- Source: WeChat (機器之心)
- Tags: ai-tools, security-privacy
- Repo: https://github.com/guillaumemeyer/watermarks-remover
Summary
Anthropic 為 Claude 全部文本輸出添加隱藏水印(基於 Google DeepMind SynthID-Text 方案),引發爭議後出現開源反制工具。
水印技術原理:
- 在模型做「無關緊要的選擇」時植入統計模式(如選 overcast vs grey)
- 累積構成隱藏簽名,持有密鑰者可檢測
- 輕度編輯無法去除,完全改寫可消除
watermarks-remover 三層去除:
- A 層(確定性清洗):Python 腳本去除不可見 Unicode 字符、bidi 控制符等
- B 層(統計水印破壞):Agent 改寫文本,破壞 token 採樣統計模式(覆蓋 Claude/SynthID/OpenAI/Kirchenbauer)
- 文件層:去除 PNG/JPEG/PDF/DOCX 等中的 C2PA/EXIF/XMP 元數據
有趣細節:
- Claude 拒絕安裝這個去除器作為 Agent Skill
- 最終由 GLM 5.2 完成安裝(諷刺的是去除器代碼很可能出自 Claude 本身)
爭論焦點:
- 反對方:付費用戶有權不被標記,水印創造「AI 內容二等公民」
- 支持方:溯源是必要公共基礎設施,「使用權」≠「隱瞞來源權」