AI Security2026-09-19The Verge

三人小队用Claude,72小时内攻进OpenAI员工账号

据报道,Hacktron的三名独立安全研究员使用Anthropic的Claude Opus 4.8和5,在不到72小时内攻破了OpenAI的员工账号。据《华尔街日报》消息,攻击者还拿到了OpenAI的GitHub仓库访问权限,这个仓库名为「Monorepo」。这起事件是先进AI「双用途」属性的生动样本:帮开发者写代码、找bug、自动化工作流的同一批模型,也能帮攻击者策划并执行入侵。 这次的成功说明,AI正在降低网络安全的门槛。过去需要大量人工侦察才能完成的任务,比如摸清一家机构的员工名单、找到可用凭证、写出有说服力的钓鱼话术,如今用语言模型就能加速。如果AI系统能把零散线索串起来并给出下一步建议,一支小团队就可能做到以前需要更多人手和时间才能完成的事。这引出的担忧包括AI辅助钓鱼、社会工程攻击和自动化漏洞挖掘。与此同时,企业也被迫加固身份系统、强制多因素认证、盯紧异常访问行为。 另一层问题是治理:用一家公司的模型去打另一家公司的系统。模型厂商都会公布使用政策,但铁了心的用户总能找到绕开的办法。安全团队现在越来越依赖AI做防御,包括威胁检测和红队测试,所以攻与防的界线本身就模糊。研究者的工作或许可以被解释为一次演示,但如果没有负责任地披露,它也可能让AI驱动的攻击变得「正常化」。 对OpenAI来说,员工账号被攻破、仓库被访问,会引来对内部安全的追问。对Anthropic来说,这件事凸显了防止模型被滥用的难度。对整个行业来说,教训是:AI安全没法从普通网络安全里单拎出来。多因素认证、最小权限访问、快速的事件响应,依然是最基本的东西。随着具备行动能力的AI(agentic AI)越来越强,各机构应该默认攻击者会用它跑得更快、并行思考。Hacktron这一出提醒大家:AI安全和AI保障,现在已经是同一件事了。

相关资讯