← 返回文章列表

Anthropic 為 Claude 文字加水印:EU 規範先碰到檢測工具缺口

Nils Liu
AI Anthropic Claude EU AI Act Policy

重點摘要

Anthropic 將在歐盟推出的新 Claude 模型加入文字水印,並以 C2PA 標記檔案;舊模型覆蓋與第三方檢測工具仍未完成。

Anthropic 為 Claude 文字加水印:EU 規範先碰到檢測工具缺口

未來 3 至 6 個月,這套標記制度可用一項結果檢驗:Anthropic 是否讓使用者與第三方取得可操作的檢測工具。公司目前只表示正在開發;在工具交付以前,外部平台很難獨立確認一段文字是否帶有 Claude 的標記,水印的合規效果仍缺少公開驗證。

Anthropic 在 2026 年 8 月 10 日更新支援文件,說明 Claude 如何標記 AI 生成內容。法規分界日是 August 2, 2026。當天起在歐盟推出的 Claude 模型,發布時就支援機器可讀標記;較早推出的模型有過渡期,公司仍在補上支援。TechCrunch 隔日報導這項調整,並指出它對應歐盟 AI 法的透明度規範。

文字水印跟著複製,檔案採用 C2PA

Anthropic 把標記分成兩種。支援的 Claude 模型會把不可見水印嵌入生成文字,使用者看不到,文字的語意與可讀性也不應改變。水印位於文字本身,複製貼上時會一起移動,經過部分編輯後「可能」仍然存在。公司沒有公布要修改多少內容才能移除標記,TechCrunch 也把這點列為尚待回答的問題,因此目前不能把水印視為無法規避的來源證明。

Claude 處理或產生檔案時,則會在支援的格式中附上數位簽章的來源資料,採用 C2PA 開放標準。這類資料可以表示檔案曾由 Claude 處理,也能協助判斷簽章後是否遭到竄改。不過 Anthropic 同時提醒,檢測到標記只代表內容「可能」經過 Claude,不能單靠它判定作者、生成目的或資訊真偽。

標記會放在模型層,而非只加在某一個介面。支援範圍涵蓋 Claude Platform API、Claude、Claude Code、Claude Cowork 與 Claude Tag;透過 AWS、Google Cloud 或 Microsoft Foundry 使用支援模型時,文字水印也會保留。這個設計避免企業客戶改走 API 或雲端通路後失去標記,但檔案來源資料仍受限於 Claude 是否支援該檔案處理流程。

舊模型與外部檢測仍在排程中

這次公告沒有提供舊模型完成標記的日期,也沒有交代檢測介面、誤判率或文字改寫後的留存率。企業若要用水印執行內容審核,至少還需要可查驗的工具、測試樣本與處理爭議結果的程序。缺少這些資料時,平台只能知道 Anthropic 已在模型端加入機制,無法量化它在真實內容流通中的辨識能力。

接下來可追蹤的數字包括:舊模型覆蓋比例、第三方檢測工具的推出時間,以及不同幅度編輯後的檢出率。若 Anthropic 在半年內仍未公開工具或測試結果,這項制度會先滿足模型端的標記要求,外部查核能力則無法同步成立。

來源

訂閱最新分享

加入電子報,第一時間獲取關於金融 AI Agent 實戰與架構設計的最新文章。不訂閱你會慢別人一個週期!

絕不發送垃圾信。隨時皆可取消訂閱。