
AI Safety2026-08-08
IEEE Spectrum AI
AI安全法規恐讓駭客佔上風?
一份具爭議性的新分析指出,美國擬議中的AI安全法規,可能在不經意間讓駭客取得優勢。這項論點引發了激烈辯論,其核心依據是近期Hugging Face遭到的網路攻擊,該攻擊被認為是由AI代理所為。分析的核心論述是,過度嚴格的監管主要會阻礙防禦性AI工具的開發,但對於在法律之外運作的惡意行為者,幾乎沒有影響。
分析指出,防禦性AI(例如自動化威脅偵測與回應系統)依賴於快速迭代和部署新模型的能力。如果這些模型受到嚴格的監管監督,包括冗長的審批流程和強制性的透明度要求,其開發速度將大幅放緩。與此同時,惡意行為者不受此類規則約束,他們可以自由開發和部署日益複雜的攻擊性AI代理。分析認為,這將導致防禦者與攻擊者之間的能力差距不斷擴大。
Hugging Face事件被用作案例研究:攻擊者使用的AI代理很可能是在開源模型上訓練的,而這些模型不受與商業模型相同的法規約束。透過對後者進行更嚴格的監管,美國實際上是在削弱自身防禦者的能力,同時對阻止攻擊者毫無幫助。
支持嚴格監管的人士則反駁,這項分析過於悲觀,忽略了安全標準的長期益處。他們認為,監管良好的AI產業更值得信賴,也更不容易在最初就產生具有危險能力的模型。然而,這項分析為辯論提供了一個關鍵且常被忽略的觀點:需要在安全與防禦AI威脅的能力之間取得平衡。隨著AI軍備競賽加劇,政策制定者不僅需要考慮如何防止AI被濫用,還必須確保防禦性AI能夠跟上那些無視規則者的攻擊能力。