Product Launch2026-08-14TechCrunch AI

OpenAI 推 GPT-5.6 Sol“超快模式”,每秒 750 token,快 14 倍

OpenAI 宣布为其最强模型 GPT-5.6 Sol 推出一个新的预览模式,目标很明确:大幅缩短企业用户的响应时间。这个叫“Ultrafast”的模式,借助 Cerebras 的硬件,输出速度最高可达每秒 750 token——比标准性能快了整整 14 倍。这波操作直接回应了生产环境中对高吞吐 AI 的旺盛需求,毕竟在实时应用里,延迟和吞吐量往往决定成败。 对于跑复杂数据管道、客服自动化或大规模内容生成的企业来说,这种速度提升可能意味着更快的决策和更低的运营成本。OpenAI 显然想拿这个当竞争优势,尤其是跟 Google 和 Anthropic 这些也在拼性能极限的对手抢客户。Ultrafast 模式目前还在预览阶段,可能不会立刻对所有用户开放,但公司暗示如果早期采用情况不错,会考虑更大范围铺开。 行业分析师认为,这是 OpenAI 锁定企业合同的一步棋——对企业客户来说,稳定性和速度往往比单纯的模型能力更重要。跟 Cerebras 合作,也让 OpenAI 的基础设施依赖更多元化,减少对英伟达 GPU 生态的过度依赖。虽然 Ultrafast 模式的具体定价还没完全公布,但价值主张很清楚:对于需要近乎即时响应的负载,这可能会改变游戏规则。随着 AI 模型越来越深入日常业务运营,能以史无前例的速度处理请求,很可能成为市场上的关键差异化优势。

相关资讯