AI 文字浮水印上線不到一週,專門移除標記的工具已開始湧現
2026.08.20
Anthropic 為部分 Claude 模型的輸出加上「不可感知的浮水印」後,專門移除這類標記的工具隨即出現。由於浮水印是透過模型選詞形成的統計模式,複製、改寫甚至換一個模型潤飾都可能破壞它——這讓校園端把浮水印當成查核依據的想法必須重新評估。
AI 內容標示的技術路線遇到了可預期的第一道考驗。Anthropic 為部分 Claude 模型的輸出加入「不可感知的浮水印」後不到一週,專門用來移除這類標記的工具已開始在開發者社群出現。 理解這件事需要先理解浮水印的原理。文字浮水印不是在文件裡加一個看不見的標記,而是在模型生成時對詞彙選擇施加細微的統計偏好——特定的用詞分布模式構成可被演算法檢測的簽章。對讀者而言完全無感,但對檢測工具而言是可…