AI Security2026-09-19The Verge

三人團隊靠 Claude 花 72 小時駭進 OpenAI

據報導,Hacktron 三名獨立安全研究員使用 Anthropic 的 Claude Opus 4.8 與 5,在不到 72 小時內攻破 OpenAI 員工帳號。根據《華爾街日報》的說法,攻擊者取得了 OpenAI 的 GitHub 儲存庫權限,該儲存庫名為「Monorepo」。這起事件是先進 AI 雙用途特性的鮮明案例:能幫開發者寫程式、找出錯誤、自動化工作流程的同一批模型,也能幫攻擊者規劃並執行入侵。 報導中的成功案例顯示,AI 正在降低資安領域的門檻。過去需要大量人工偵查的任務,例如盤點一家公司的員工、找出可用的憑證、撰寫具說服力的訊息,如今都能靠語言模型加速。如果一個 AI 系統能把零散線索串起來並建議下一步,小團隊也可能達成以往需要更多人與更多時間才能做到的事。這引來對 AI 輔助釣魚、社交工程與自動化漏洞發掘的擔憂,也對企業形成壓力,必須強化身分驗證系統、落實多因素驗證,並監控異常的存取行為。 同時,拿一家公司的模型去攻擊另一家公司的系統,也帶出治理問題。模型供應商雖然公布使用政策,但有心使用者仍可能找到繞道方式。資安團隊如今也越來越依賴 AI 進行防禦,包括威脅偵測與紅隊演練,因此攻擊與防禦之間的界線相當模糊。研究員的行動或許可被包裝成技術示範,但若沒有負責任的漏洞揭露,也可能變相讓 AI 驅動的攻擊變得常態化。 對 OpenAI 而言,員工帳號與儲存庫存取權遭入侵的報導,將引來內部安全上的質疑。對 Anthropic 來說,這凸顯了防止模型被濫用的難題。對整體產業而言,教訓是 AI 安全無法與一般資安切割。多因素驗證、最小權限存取與快速的事件應變,依然是基本功。隨著具代理能力的 AI 愈來愈強,企業應該假定攻擊者會用它加快速度、並行思考。Hacktron 這起事件提醒大家,AI 安全與 AI 資安,現在已經是同一件事。

相關資訊