從 2026 年 8 月 2 日起,部分支援的 Claude 模型輸出的文字,包括你請它代寫的簡報文案、翻譯的合約草稿,很可能已帶著一個肉眼看不見的標記。文字本身一字未動,也沒有藏任何特殊字元,但持有 Anthropic「金鑰」的人,事後可以驗出這段文字有多大機率出自 Claude。
Anthropic 在 8 月 14 日發布官方說明回應外界疑問。推出浮水印的直接原因是歐盟《人工智慧法案》(EU AI Act):8 月 2 日起,服務歐盟市場的 AI 業者必須以機器可讀的方式標記 AI 生成內容。
Anthropic 在 2026 年 7 月與其他組織共同簽署配套的透明度行為準則,整份準則約有 190 個簽署方,涵蓋 AI 系統的提供者與部署者;截至 8 月 12 日,簽署第 1 節「標記與偵測」承諾的提供者有 82 家。
各方可採用不同的機器可讀標記方案,而文字浮水印是 Anthropic 選擇的實作。由於還沒有可靠的分區域方案,浮水印在支援的模型上全球一體適用,台灣使用者同樣在內。
浮水印藏在哪?藏在「選字的習慣」裡
大型語言模型逐字生成文字,每寫一個字,都從幾個候選詞中挑一個。以「今天天氣很冷,天色十分⋯⋯」為例,接「陰沉」或「灰暗」都通,意思幾乎一樣,這種怎麼選都對的時刻,平常由亂數決定。
浮水印動的就是這個亂數:改用一套含金鑰的演算法,依據前文決定選哪個字。對讀者來說,結果讀起來照樣自然,但事後拿金鑰檢驗整段文字的選字序列,就能算出這段文字由 Claude 生成的機率。
Anthropic 給了一個比喻:玩大富翁時,把擲骰子換成按順序讀圓周率的小數位,每一步照樣隨機、遊戲結果不受影響,但賽後對照圓周率數列,就能判斷這一局多半用了圓周率。
換句話說,浮水印沒有加入任何內容,只是換了「隨機的來源」。Anthropic 表示,這不增加 token、不影響速度與價格,浮水印中也沒有任何能追溯到特定使用者、組織或對話的資訊。
這種技術源自 Google DeepMind 2024 年發表於《自然》(Nature)期刊的 SynthID-Text。官方引述該論文指出,Google 曾在 Gemini 的實際流量上測試,帶浮水印與否的回覆,使用者評分沒有統計上的顯著差異。
哪些情況驗得出、哪些驗不出?
這套浮水印的能力邊界,可能比想像的窄。它依賴「怎麼選都對」的選字空間:空間越大、文字越長,驗出的信心度越高。 反過來說,幾種常見情境的偵測效果較弱,可能不足以檢出:
- 短文字:選字點太少,資訊量不足。
- 事實密集的段落:像「牛頓最著名的著作是《自然哲學的數學原理》」,下一個詞只有一個正確答案,浮水印無處著力。
- 校對與輕度編輯:絕大多數字是人寫的,Claude 只改動標點與文法,可附著的痕跡極少。
- 程式碼本體:許多程式碼位置必須精確,選擇空間較小,只有註解這類有語意自由度的部分可能留痕。
翻譯則相反:譯文每個字都是 Claude 選的,通常會帶有浮水印。
另外兩條限制更關鍵。其一,Anthropic 自己承認,逐字詞替換的完整重寫可使標記消失。 其二,驗出浮水印只能證明「Claude 可能參與過」,無法區分「Claude 從頭寫的」與「Claude 幫你重度編修的」,也驗不出其他公司 AI 生成的文字,因為金鑰不同。
用戶怕什麼?自己寫的東西被標成 AI
《Business Insider》8 月 15 日報導,數十名用戶在 X 上表示已退訂 Claude,該媒體訪問了其中 4 名表示已取消訂閱的用戶,部分受訪者用的是月費 100 美元起(約新台幣 3,200 元起)的 Claude Max 方案。他們的焦慮高度一致:自己原創的內容,只因經過 Claude 校對、翻譯或整理,就可能被驗出 Claude 曾參與處理,進而遭外界誤解為 AI 代寫,在有 AI 使用規範的學術場景或客戶合約裡惹上麻煩。
在捷克接案的開發者 Vladislav Rajtmajer 說,他擔心交付給客戶的程式碼帶著 AI 標記,可能引發著作歸屬質疑,甚至觸發合約罰則。美國喬治亞州的 AI 顧問 Richard Echols 則說:「就算你編輯的是自己寫的東西,他們照樣加浮水印。」Anthropic 回應《Business Insider》稱,公告後沒有觀察到退訂量上升的趨勢。
支持方的聲音也存在:高階主管溝通公司 The Narrative Company 共同創辦人 Aadit Sheth 在 X 上表示,讀者應能分辨眼前的文字是否反映一個人自己的思考,浮水印是確保這件事的一種方式;也有意見認為,標記有助於避免 AI 系統吃進大量 AI 生成內容而劣化。
技術社群的批評:管得住老實人,防不了有心人
軟體工程師 James Padolsey 在 8 月 12 日的部落格文章指出更根本的矛盾。他引述歐盟法案第 50 條第 2 項,條文其實豁免了「標準編輯的輔助功能」,但 Anthropic 選擇在模型層全面實作,範圍比法律的最低要求更廣。
結果是一個弱浮水印悖論:坦誠使用 AI 輔助的人被牽連進懷疑範圍,他特別點名依賴 AI 減輕認知負擔的身障與神經多樣性族群;有心規避的人,徹底改寫一遍就能脫身。 他稱這是「合規劇場」(compliance theatre),並提到網路上已出現 declaude.org 這類專門混淆 AI 文字指紋的工具。
接下來要留意什麼
對日常使用者,可以從官方的限制清單反推:Claude 從頭代寫或翻譯的長篇內容,通常較容易累積可偵測訊號;校對或輕度潤飾的偵測效果較弱,改動少時可能不足以檢出。Anthropic 表示將提供浮水印偵測 API,但截至 2026 年 8 月 17 日仍在研議實作細節;至於 Claude 產生的受支援檔案類型(如 PNG、JPG、SVG)則會附加 C2PA 內容憑證,屬於不同機制。
而 8 月 2 日前推出的舊版 Claude 模型,官方稱將在公告後數月內陸續補上浮水印。
最後,往後浮水印很可能不會只有Claude獨有。現在推行的文字浮水印只是其中一種實作,AI 生成內容的標記與來源驗證正在擴大。下一次把 AI 產出交給客戶或投稿之前,值得先弄清楚,你用的工具,留下了什麼樣的痕跡?
延伸閱讀:
Claude Code官方解密!一次看懂4種「迴圈」設計法,讓AI Agent自動搞定複雜任務
Codex入門完整教學!10步驟+提示詞範例,打造你的AI專案工作區
資料來源:Anthropic 官方公告、《Business Insider》、James Padolsey 部落格、歐盟執委會公告、EU AI Act 第 50 條、SynthID-Text 論文
本文初稿為AI編撰,整理.編輯/ 李先泰
