Model Update2026-09-13TechCrunch AI

Anthropic 執行長提減速方案,要第三方驗證安全

Anthropic 執行長 Dario Amodei 提出一套讓 AI 開發腳步放慢的計畫,主張讓 METR 等獨立第三方評估機構取得其模型存取權,以驗證公司是否遵守安全實務與承諾。這項提案出現在一篇長文中,Amodei 在文中描述了「為前沿定速」的三步做法,這個說法已成為領先 AI 實驗室協調克制的代名詞。 核心概念是:光靠自願承諾並不夠。少了外部驗證,實驗室可以宣稱自己遵循安全實務,卻沒有人能確認真假。Amodei 主張,邀請外部評估者進場,代表可信度需要透明與獨立審查,即使這種審查並不方便。 這套三步框架的用意,是讓實驗室在逼近某些風險門檻時,有一套結構化的方式放慢腳步,而不是在競爭壓力下臨時做決定。那股壓力非常強:打造更強大模型的競賽已大幅加速,任何單方面暫停的實驗室,都可能被不踩煞車的對手超車。 這篇文章之所以引人注意,在於競爭對手之間似乎出現了共識。OpenAI 的 Sam Altman 也對協調安全措施的必要性表達過類似立場,顯示兩家領先 AI 公司罕見地趨於一致。這究竟是真心共同的憂慮,還是想藉此形塑法規的策略操作,仍是未解的問題。 懷疑者指出,自願減速面臨根本的集體行動難題。如果只有部分實驗室放慢,其他家就可能坐收搶快的好處。執行、驗證與國際協調,全都還沒有答案。不過,這項提案仍為「前沿 AI 開發該如何治理」的討論增添動能,也對其他實驗室形成壓力,得說明自己要如何驗證自家的安全宣稱。

相關資訊