Claude AI 的母公司 Anthropic 表示,未來將推出浮水印偵測 API,用來判斷一段文字或檔案是否帶有 Claude 的標記。不過,該偵測結果只能作為「內容可能曾由 Claude 處理」的訊號,不能視為作者身分或內容來源的確鑿證明。
浮水印在資訊量較低的內容中效果較弱,例如只有一個正確答案的事實性回答,以及必須使用精確語法才能正常執行的程式碼。輕度編輯可能無法完全移除浮水印,但如果對原文進行全面改寫,則可能消除其中的統計特徵。
即使內容最初由 Claude 產生,也不一定能被偵測到浮水印。以下情況可能削弱或移除標記:
- 文字經過大幅改寫、改述或翻譯。
- 原文與其他內容混合,導致原有統計模式被稀釋。
- 段落過短,沒有足夠文字供系統進行可靠判定。
- 檔案在格式轉換、重新儲存或截圖後,相關中繼資料遭到移除。
- 內容由尚未支援浮水印的舊模型或特定功能產生。
- Claude 僅進行非常有限的校對或編輯,沒有產生足夠的新文字。
Anthropic 的說明中心也指出,偵測不到標記並不代表內容一定不是由 AI 生成或處理。
偵測結果代表什麼
偵測到 Claude 標記,只能表示該內容可能曾經經過 Claude 處理,不一定代表 Claude 撰寫了原始內容。例如,使用者可能只是利用 Claude 進行:
- 文法校正。
- 翻譯。
- 摘要。
- 格式轉換。
- 局部改寫或文字潤飾。
因此,一篇由人類撰寫、後來交由 Claude 翻譯或校對的文章,也可能帶有 Claude 的標記。相反地,經過大量人工編輯、改寫或重新組織後,原本由 Claude 生成的文章也可能不再呈現可偵測的訊號。
對新聞與翻譯工作的意義
對媒體編輯而言,這種偵測結果不應被當作「AI 代寫」的單一證據。更穩妥的做法是將其與版本紀錄、採訪素材、作者說明、編輯流程及事實查核結果結合使用。
例如,一篇記者原創的中文報導若交由 Claude 翻譯成日文、韓文或泰文,偵測器可能判定譯文曾由 Claude 處理,但這並不能證明新聞內容、採訪資料或原始觀點來自 Claude。這項技術較適合用於內容溯源提示,而不是用來單獨判定作者或責任歸屬。
Anthropic 尚未公布完整的偵測 API 技術細節,因此外部研究人員目前難以獨立驗證其準確率、誤判率,以及在不同語言、文本長度和編輯程度下的表現。偵測系統的實際可靠性,仍有待公開工具推出及更多測試。










