Product Launch2026-08-14
OpenAI Blog
OpenAI预览GPT-5.6 Sol超快模式:速度提升14倍,每秒750 tokens
OpenAI宣布了Ultrafast的预览版本,这是一个新的API服务层级,能大幅提升GPT-5.6 Sol的性能。这个模式由Cerebras提供硬件支持,每秒最多能输出750个token,速度比标准配置快了最多14倍。这个服务就是冲着企业用户来的,那些对AI系统响应速度和延迟有高要求的场景。
Ultrafast的推出,解决的是企业市场的一个刚需。很多应用,比如实时客服、金融交易、互动内容生成,都要求即时响应。哪怕只是几秒钟的延迟,都可能影响用户体验和运营效率。有了Ultrafast,OpenAI算是给这些严格要求提供了一个解决方案。
Cerebras是这次合作的硬件伙伴,他们家的AI处理器以高吞吐量任务见长。把Cerebras的技术整合进OpenAI API,两家公司等于一起做出了一个在速度上刷新认知的服务。这个合作也说明,硬件创新在推动AI能力进步这件事上有多重要。
对企业来说,Ultrafast的好处很直接。更快的响应时间意味着更动态的交互,以前觉得不现实的AI应用场景,现在可以部署了。而且高token吞吐量意味着,更大的复杂模型也能用在实时应用里,性能不打折扣。
Ultrafast目前还在预览阶段,OpenAI计划根据需求来扩大可用性。早期使用者可以先测试这个服务,反馈意见,帮OpenAI打磨最终的功能。随着AI继续进化,Ultrafast这类服务会在让先进模型变得好用、实用这件事上,扮演越来越关键的角色。