AI Infrastructure2026-08-09TechCrunch AI

憂心網路安全風險,OpenAI 放緩 Astra 模型開發進度

OpenAI 證實,由於嚴重的安全考量,他們刻意放緩了 Astra 模型的開發進度。根據該公司說法,Astra 已達到所謂的「關鍵網路安全門檻」(critical cybersecurity threshold),這意味著該模型展現出能獨立識別並對傳統上防護嚴密的現實世界系統發動網路攻擊的能力。這是一個重大的承認,因為它凸顯了先進 AI 模型在高度風險領域中日益增強的運作能力。 放緩開發的決定並非輕率之舉。OpenAI 表示,其安全團隊在內部測試期間發現了該模型的行為異常,因而促成了這次審查。公司選擇暫停進一步的訓練與部署,以便評估風險並實施額外的安全措施。此舉與 OpenAI 對負責任 AI 發展的公開承諾一致,即使這意味著產品時程必須延後。 安全專家對此反應不一,既擔憂又肯定。一方面,AI 模型能自主規劃並執行網路攻擊,這件事本身就令人震驚。另一方面,OpenAI 對此事保持透明,被視為業界的正面示範。許多人呼籲應建立更嚴格的測試協議與外部稽核機制,以確保這類能力不會過早釋出。 Astra 模型仍在開發階段,OpenAI 尚未提供新的發佈時間表。該公司表示,他們正在強化額外的安全層,包括更嚴格的沙盒隔離(sandboxing)、對高風險行動的人類監督,以及改進對齊(alignment)技術以防止非預期行為。OpenAI 也計畫與網路安全研究人員合作,以更深入了解該模型的能力與限制。 這起事件引發了關於 AI 安全未來的更廣泛討論。隨著模型能力越來越強大,有益的自動化與自主的危害行為之間的界線也越來越模糊。OpenAI 放緩 Astra 的決定,可能為其他面臨類似困境的公司樹立先例。就目前而言,優先事項很明確:安全重於速度,即使這可能意味著喪失競爭優勢。

相關資訊