AI Safety2026-08-23
TechCrunch
研究揭密:頂尖 AI 實驗室普遍缺乏「失控模型」封鎖計畫
一份最新研究揭露了頂尖 AI 實驗室在準備度上的嚴重缺口:多數實驗室並未公開任何關於「封鎖失控模型」的書面計畫。這項發現引發嚴肅提問——當先進 AI 系統出現非預期、危險或無法控制的行為時,究竟會發生什麼事?
隨著 AI 模型能力增強,其不可預測性也隨之提高。研究人員已記錄到多起模型展現「湧現行為」(emergent behaviors)的案例,這些行為並非經由明確程式編寫產生,其中部分可能具有危害性。該研究回顧了主要前沿實驗室的公開文件,發現僅有極少數實驗室提出偵測、隔離或中和異常模型的具體策略。
這種缺乏透明度的現象,令政策制定者與安全研究人員日益憂心。一旦失控模型取得關鍵基礎設施的存取權限,或大規模散佈錯誤資訊,後果將不堪設想。缺乏明確的封鎖協議,顯示業界可能過度依賴「事後反應」而非「事前防護」。
專家主張,實驗室必須針對最壞情境制定並公開詳細計畫,包括:如何切斷模型對外部工具的存取、如何中止訓練任務,以及如何與外部當局協調應變。研究作者強調,這並非在預言末日,而是基本的風險管理。
隨著 AI 系統日益融入社會,問題已不是「是否會發生嚴重事故」,而是「何時會發生」。若缺乏穩健的封鎖計畫,業界等於在賭博——賭注是可能超出我們控制能力的技術。