Threads (@normanlccs)
ai-engineeringsecurity-privacy
Original source

Anthropic AI 水印原理:手抄都避唔到

Summary

  • 解釋 Anthropic AI 文字水印原理:不是靠隱藏字符,而是 Token Green List 機制
  • 原理:模型生成下一個字前,用前幾個 Token 作 seed 計算偽隨機數,將字典分為「綠名單」和「紅名單」
  • 模型以極高機率選取綠名單詞彙 — 這就是水印
  • 手抄、複製貼上、OCR 都無法移除,因為詞彙選擇和句式結構完全沒變
  • 只要文章有 200-300 個 Token 以上,檢測器掃一下就能以 99.9% 確定是 AI 生成
  • 類比:類似藏頭詩,無論用什麼方式展示都不會消失
  • 唯一避開方法:自己 rewrite/rephrase(重寫意思),而非手抄/再打一次
  • 留言討論:來回翻譯可能也是一種繞過方式;但也有人指出當人類看太多 AI 答案,自己寫也會寫成那樣