Product Launch2026-08-14
TechCrunch AI
OpenAI bringt „Ultrafast“-Modus für GPT-5.6 Sol
OpenAI hat einen neuen Vorschaumodus für sein leistungsstärkstes Modell GPT-5.6 Sol angekündigt, der die Antwortzeiten für Enterprise-Nutzer drastisch verkürzen soll. Der sogenannte „Ultrafast“-Modus nutzt Cerebras-Hardware und liefert bis zu 750 Ausgabe-Token pro Sekunde – eine 14-fache Steigerung gegenüber der Standardleistung. Damit reagiert das Unternehmen direkt auf die wachsende Nachfrage nach Hochdurchsatz-KI in Produktionsumgebungen, wo Latenz und Durchsatz über Erfolg oder Scheitern von Echtzeitanwendungen entscheiden können.
Für Unternehmen, die komplexe Datenpipelines betreiben, Kundensupport automatisieren oder große Mengen an Inhalten generieren, könnte der Geschwindigkeitsschub schnellere Entscheidungen und niedrigere Betriebskosten bedeuten. OpenAI positioniert das als Wettbewerbsvorteil, insbesondere gegenüber Rivalen wie Google und Anthropic, die ebenfalls die Leistungsgrenzen verschieben. Der Ultrafast-Modus befindet sich derzeit in der Vorschau, das heißt, er ist möglicherweise nicht sofort für alle Nutzer verfügbar. Das Unternehmen deutete jedoch an, dass ein breiterer Rollout wahrscheinlich ist, wenn die frühe Einführung gut verläuft.
Branchenanalysten sehen darin einen strategischen Schritt, um Unternehmensverträge abzusichern, bei denen Zuverlässigkeit und Geschwindigkeit oft wichtiger sind als reine Fähigkeiten. Durch die Partnerschaft mit Cerebras diversifiziert OpenAI zudem seine Infrastrukturabhängigkeiten und reduziert die Abhängigkeit vom dominanten GPU-Ökosystem von Nvidia. Die Preise für den Ultrafast-Modus wurden noch nicht vollständig bekannt gegeben, aber das Wertversprechen ist klar: Für Workloads, die nahezu sofortige Antworten erfordern, könnte das ein Game-Changer sein. Je stärker KI-Modelle in den täglichen Geschäftsbetrieb integriert werden, desto mehr wird die Fähigkeit, Anfragen in beispielloser Geschwindigkeit zu verarbeiten, zu einem entscheidenden Unterscheidungsmerkmal im Markt.