AI Policy2026-08-23WIRED

開發者秒破解 Claude 浮水印,監管再受挑戰

Anthropic 宣布將在 AI 生成內容中嵌入隱形浮水印,以符合歐盟新規定,但這項消息立刻遭到程式開發社群的強烈反彈。消息公布後數小時內,開發者就在網路上分享各種覆寫與繞過的方法,嚴重質疑浮水印作為合規工具的有效性。 這些浮水印設計為人類無法察覺,但可被自動化系統偵測,讓平台能辨識 AI 生成的文字。歐盟的 AI 法案要求 AI 生成內容必須透明,浮水印是其中一種被提出的做法。 然而,開發者很快就找到移除或竄改浮水印的方法。手法包括改寫文字、插入與刪除特定字元,或使用其他 AI 模型重寫內容。有些開發者甚至製作了能自動移除 Claude 輸出浮水印的工具。 這場貓抓老鼠的遊戲凸顯了一個根本問題:如果浮水印能輕易被繞過,那它提供的保護就相當有限。歐盟的法規可能製造了虛假的安全感,讓監管者誤以為浮水印是可靠的執法工具,但事實顯然並非如此。 Anthropic 很可能會以更強健的浮水印技術回應,但這場軍備競賽恐怕還會持續。這起事件也引發了更廣泛的思考:監管 AI 內容究竟可不可行?如果有心人士總能找到繞過的方法,單靠技術解決方案是不夠的。要確保 AI 生成內容的透明度,可能需要技術、法律與社會措施三管齊下。

相關資訊