Anthropic 為配合歐盟《人工智慧法案》的生成內容透明要求,在 Claude 輸出中加入統計式文字浮水印,藉由特定詞彙分布協助辨識 AI 生成文本。這類機制被視為追查內容來源、處理著作權爭議與抑制假訊息的工具,但能否承受改寫與刻意規避,一直是技術落地的核心疑問。
相關機制曝光後數小時內,多名開發者便發布開源工具,宣稱可偵測並移除 Claude 的統計特徵,使原有標記難以持續保留。破解速度再度凸顯文字浮水印的脆弱性,也促使業界重新檢視歐盟監管要求:若標記可被低成本抹除,平台責任、著作權歸屬與執法證據都可能面臨缺口。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡Anthropic推出Claude文字浮水印與數位簽章
生成式 AI 大量進入工作、教育與媒體後,內容來源與責任歸屬日益受重視。Anthropic 因此在 Claude 文字中加入機器可讀的隱形訊號,並為支援的檔案附上 C2PA 數位簽章;歐盟《AI 法案》的相關透明度義務亦於 2026 年 8 月 2 日開始適用。
Anthropic 近期說明,文字浮水印會透過不影響閱讀與生成品質的統計模式,留下可供系統辨識的紀錄,但內容經大幅改寫後可能消失。措施引發部分付費用戶退訂,也催生移除工具;其中一項工具上線三天即在 GitHub 獲逾 9,000 顆星,而外界仍缺乏可公開驗證文字浮水印效果的工具。
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。