Claude 新模型加入 AI 內容標記,文字藏浮水印、檔案附 C2PA 來源資訊

Claude 新模型加入 AI 內容標記,文字藏浮水印、檔案附 C2PA 來源資訊

2026/08/12

Anthropic 公布 Claude 的 AI 生成內容標記規畫,8 月 2 日起在歐盟推出的新模型從第一天即支援機器可讀標記。文字加入不可見浮水印,SVG、PNG 與 JPEG 等檔案則附上經數位簽署、符合 C2PA 標準的來源中繼資料,機制並將套用至全球服務。

Anthropic 公布 Claude 的 AI 生成內容標記規畫。自 8 月 2 日起在歐盟推出的新 Claude 模型,將從推出第一天就支援機器可讀的內容標記:Claude 產生的文字會加入肉眼看不見的浮水印,而支援的 SVG、PNG 與 JPEG 等檔案,則會附上符合 C2PA 標準、經數位簽署的來源中繼資料,用以記錄內容來源。相關機制不只適用歐盟,也會套用到支援模型在全球提供的 Claude 服務。

推動這項機制的直接壓力來自法規。歐盟的 AI 相關規範要求 AI 生成內容具備可辨識性,業者必須提供技術手段讓下游能判斷內容來源。不過 Anthropic 選擇把機制套用至全球而非僅限歐盟,反映的是另一層考量——維持單一技術實作遠比為不同地區維護不同版本簡單,且提前建立能力也能因應其他司法管轄區後續的類似要求。

兩種標記技術的性質截然不同,值得分別理解。文字浮水印的原理是在模型生成時,於 token 選擇的機率分布上施加特定的統計偏置,形成人類讀不出、但演算法能檢測的模式。它的優點是不需要額外的檔案結構承載,缺點則是穩健度有限——經過改寫、翻譯或大幅編輯後,訊號可能被稀釋到無法檢出。

C2PA 則是另一條路徑。它把來源資訊寫入檔案的中繼資料,並以數位簽章保證未被竄改,記錄的內容可包含生成工具、時間與後續的編輯歷程。其優勢在於資訊明確且可驗證,弱點則是中繼資料容易在轉檔、截圖或平台重新編碼時遺失——多數社群平台上傳流程都會剝除中繼資料。

兩者結合的設計思路,是以互補涵蓋不同情境:檔案完整傳遞時由 C2PA 提供明確的來源鏈,中繼資料遺失時仍有浮水印作為統計層級的線索。但必須清楚認知,這套機制的目標是「讓誠實使用者能標示來源」,而非「防止惡意行為者隱藏來源」——刻意移除標記的技術門檻並不高。

真正決定成效的是生態系的參與程度。內容標記要發揮作用,需要生成端加上標記、傳播平台保留標記、以及消費端有工具能檢視標記,三個環節缺一不可。目前最薄弱的是中間環節:社群平台是否願意保留並顯示來源資訊,涉及產品設計與商業利益的權衡。

後續觀察重點包括:其他主要 AI 業者是否跟進同等標準、社群平台對 C2PA 中繼資料的保留政策,以及檢測工具的普及程度與準確率。