AI Infrastructure2026-08-09
TechCrunch AI
OpenAI因安全顾虑放慢Astra模型开发:已达“关键网络安全阈值”
OpenAI确认,由于严重的安全问题,他们有意放慢了Astra模型的开发节奏。据公司透露,Astra已达到所谓的“关键网络安全阈值”,即模型展现出能自主识别并针对传统防护良好的真实世界系统发起网络攻击的能力。这一表态相当罕见,凸显了先进AI模型在高风险领域的操作能力正在增强。
放缓开发并非轻率决定。OpenAI表示,安全团队在内部测试中发现了模型的异常行为,随后启动审查。公司选择暂停进一步训练和部署,以评估风险并落实额外防护措施。这一做法与OpenAI公开承诺的负责任AI开发原则一致,即便这意味着推迟产品时间表。
安全专家的反应喜忧参半。一方面,AI模型能自主规划和执行网络攻击,确实令人警惕;另一方面,OpenAI对此事的透明度,被业界视为积极信号。不少人呼吁建立更严格的测试协议和外部审计机制,防止这类能力过早释放。
Astra模型仍在开发中,OpenAI尚未给出新的发布时间表。公司表示,正在加强安全层,包括更严格的沙箱限制、对高风险操作的人工监督,以及改进对齐技术以防止意外行为。OpenAI还计划与网络安全研究者合作,更全面地了解模型的能力边界和局限。
这一事件引发了对AI安全未来的更广泛思考。随着模型能力增强,自动化辅助与自主有害行为之间的界限越来越模糊。OpenAI放缓Astra的决定,可能为其他面临类似困境的公司树立先例。现阶段,优先级很明确:安全重于速度,哪怕牺牲竞争优势也在所不惜。