AI快訊

複製貼上也能追蹤!Claude AI生成內容浮水印技術解析

N
Nathan科技編輯 · 技術負責人
發布 · 更新
根據ithome報導,Anthropic自8月2日起為在歐盟推出的新Claude模型加入機器可讀浮水印與C2PA簽署,因應歐盟AI法案第50條;根據Inside報導,此為業界首見同時涵蓋文字與檔案的雙層標記方案,但研究顯示SynthID圖片浮水印移除成功率達79%,凸顯技術局限。

為什麼Anthropic要給Claude加浮水印?監管壓力與透明度要求

根據ithome報導,Anthropic公布了Claude的AI生成內容標記規畫,自8月2日起在歐盟推出的新Claude模型將從推出第一天支援機器可讀標記〔E1〕。這項規畫的直接背景,是Anthropic已簽署歐盟《人工智慧法》(AI Act)第50條相關的AI生成內容透明度實務準則〔E4〕,而《人工智慧法》要求生成文字、圖片、音訊及影片內容的AI系統以機器可讀方式標記AI生成或修改的內容,相關透明度規定已自8月2日起適用〔E5〕。

根據Inside報導,這項法規並非沒有牙齒:違規罰款上限為1,500萬歐元或全球年營收的3%,取高者適用〔E11〕。時間點也高度重疊——Anthropic的雙層標記機制上線日,恰好踩在《人工智慧法》第50條生效當天〔E10〕。

Anthropic的創新:雙層標記如何同時保護圖文內容

根據ithome報導,Claude產生的文字會加入肉眼看不見的浮水印,支援的SVG、PNG與JPEG等檔案則加入符合C2PA標準、經數位簽署的來源中繼資料,用來記錄內容來源〔E2〕。這代表文字與檔案分別採用不同的技術路徑:前者嵌入內容本身,後者附掛於檔案層。

根據Inside報導,這是主要模型廠商首次同時覆蓋文字與檔案兩層的內容標記機制〔E10〕。換言之,Anthropic並非只做其中一項,而是把兩種標記方式打包成同一套規畫。

技術揭秘:文字浮水印如何在生成時被植入

根據ithome報導,只要使用支援標記的Claude模型,透過Claude、Claude Platform API、Claude Code、Claude Cowork或Claude Tag取得的文字都會帶有標記〔E6〕,也就是說標記並非單一產品的功能,而是涵蓋Claude旗下多條產品線。

根據Inside報導,文字浮水印的運作原理,是在模型選擇用字時微調機率分布,嵌入一組統計上可辨識的訊號〔E15〕。這個訊號的植入時間點就在生成當下,而非事後加工。

複製貼上後浮水印還在嗎?標記的實際持久性

根據ithome報導,Anthropic表示浮水印不會顯示在畫面上,也不影響文字原意與閱讀,而文字複製貼上到其他地方後,標記仍可能保留下來〔E7〕。也就是說,讀者將Claude產出的文字貼進另一份文件、另一個平台,理論上標記仍有機會存在。

此外,根據ithome報導,相關機制不只適用歐盟,也會套用至支援模型在全球提供的Claude服務〔E3〕,代表這不是僅限單一地區用戶才會遇到的標記行為。

標記就能證明是AI寫的嗎?方案的關鍵局限

根據ithome報導,文字經大幅改寫或翻譯、篇幅太短,以及檔案轉換、重新儲存或截圖造成來源資訊被移除,都可能使標記無法辨識〔E8〕。這意味著標記存在或不存在,都無法完全確定內容是否為AI生成。

同樣根據ithome報導,Anthropic也正替8月2日前推出的既有Claude模型加入標記支援,目前尚未公布完成時間;文字浮水印採用的具體技術及偵測方式也還沒有公開,Anthropic表示後續將發布技術文件〔E9〕。也就是說,舊模型的標記覆蓋與技術細節,目前都還是未完成事項。

浮水印有多脆弱?標記被移除的可能性

根據Inside報導,C2PA後設資料的密碼學保證了資料沒被竄改,但後設資料可以被剝除——下載一張圖片、重新儲存,簽章就消失了〔E16〕。

同樣根據Inside報導,學術研究指出類似的問題,移除工具對Google SynthID圖片浮水印的成功率可達79%〔E14〕。這個數字雖然針對的是Google的方案,但反映出同類圖片浮水印機制普遍面臨的移除風險。

Google和OpenAI怎麼應對?業界標記方案對比

根據Inside報導,Google的SynthID已標記超過1,000億張圖片,文字浮水印也早在2024年10月部署到Gemini API中,是目前規模最大的文字標記系統〔E12〕。相較之下,OpenAI在5月宣布採用SynthID為ChatGPT圖片加浮水印,但文字浮水印至今仍未推出〔E13〕。

三家廠商的標記進度可對照如下:

廠商/方案文字浮水印圖片/檔案標記規模與時間點
Anthropic(Claude)支援,8月2日起於歐盟新模型導入〔E1〕C2PA簽署中繼資料〔E2〕全球適用〔E3〕,首家雙層方案〔E10〕
Google(SynthID)2024年10月部署至Gemini API〔E12〕已標記圖片〔E12〕逾1,000億張圖片〔E12〕
OpenAI(ChatGPT)尚未推出〔E13〕5月宣布採用SynthID〔E13〕

這代表什麼

把前述證據並列,可以看到一個時間與技術落差並存的局面。監管面上,《人工智慧法》第50條的透明度規定與最高3%全球年營收(或1,500萬歐元)罰款〔E11〕在8月2日生效,Anthropic選在同一天推出雙層標記〔E1〕〔E10〕,顯示這是對應法規時程的具體行動;但技術面上,Anthropic自己承認既有模型標記尚未完成、技術與偵測方式也未公開〔E9〕,且文字或檔案經改寫、翻譯、截圖、重新儲存都可能使標記失效〔E8〕〔E16〕。對照Google SynthID的圖片浮水印已有79%的學術移除成功率〔E14〕,而Anthropic的文字浮水印同樣是靠「微調機率分布」的細微訊號〔E15〕,兩者面臨的脆弱性屬同一類問題。換言之,標記機制目前解決的是「揭露義務」的合規需求,而非「內容溯源」的技術保證。

📊 證據與數據

常見問題

Claude的文字浮水印技術細節公開了嗎?

根據ithome報導,文字浮水印採用的具體技術及偵測方式目前尚未公開,Anthropic表示後續將發布技術文件〔E9〕。

Claude的浮水印機制只在歐盟生效嗎?

根據ithome報導,相關機制不只適用歐盟,也會套用至支援模型在全球提供的Claude服務〔E3〕。

📎 資料來源

  1. ithome.com.tw
  2. inside.com.tw
N
Nathan科技編輯 · 技術負責人

相關文章

快訊

台積電董事會核准Q2配息維持7元 首度開放外資美元股利選擇

根據《經濟日報》與鉅亨網報導,台積電董事會8月11日核准2026年第2季每股現金股利維持7元,並首度開放外資股東選擇以美元收取股利;同時通過294億4,250萬美元資本預算,並核准與索尼半導體合資規模不超過2,820億日圓的新公司。

林紀旭 James Lin ·
快訊

Google AI摘要衝擊流量 法國逾300家媒體聯盟APIG提出申訴

根據TechNews與中央社報導,代表逾300家法國媒體的APIG聯盟於2026年8月11日向當局申訴,指Google今年7月上線的AI摘要功能未經談判即成既成事實;法國報業目前7成流量依賴Google,業界估計衝擊恐達3成。

EffectStory 編輯部 ·