Model Update2026-09-11
OpenAI Blog
GPT-Live-1 bringt Full-Duplex-Stimme in die API
OpenAI hat GPT-Live-1 in seiner API veröffentlicht und bringt damit natürliche Full-Duplex-Sprachgespräche zu Entwicklern. Das Modell bietet stärkere Instruktionsbefolgung, Unterstützung für individuelle Stimmen und Telefonie-Integration – und eignet sich damit gut für Callcenter, Sprachassistenten und interaktive Anwendungen.
Die Full-Duplex-Fähigkeit ist das Highlight. Sie bedeutet, dass das Modell gleichzeitig zuhören und sprechen kann, statt zu warten, bis ein Nutzer fertig ist, bevor es antwortet. Traditionelle turn-basierte Sprachsysteme wirken oft steif und langsam, mit unangenehmen Pausen und Unterbrechungen, die den Fluss eines echten Gesprächs stören. GPT-Live-1 soll genau diese Reibungspunkte beseitigen und Austausche erzeugen, die sich eher wie ein Gespräch mit einem anderen Menschen anfühlen.
Neben der Reaktionsfähigkeit verbessert das Modell die Befolgung detaillierter Anweisungen – wichtig für Unternehmen, die konsistente, markenkonforme Interaktionen in großem Maßstab brauchen. Die Unterstützung individueller Stimmen erlaubt es Organisationen, den Klang ihres Assistenten zu definieren, während die Telefonie-Integration den Einsatz über Standard-Telefonleitungen eröffnet – eine Voraussetzung für viele Kundenservice-Abläufe.
Der Release signalisiert, dass Sprache zur zentralen Front im Wettbewerb der KI-Anbieter wird. Während textbasierte Assistenten reifen, könnte die Fähigkeit zu flüssigen gesprochenen Gesprächen Produkte in Märkten differenzieren, in denen Kunden erwarten, anrufen zu können und verstanden zu werden.
Für Entwickler bietet GPT-Live-1 einen Weg, konversationelle Sprache zu integrieren, ohne ein Flickwerk aus Spracherkennung, -synthese und Dialogmanagement zusammenzubauen. Die Frage ist nun, wie gut es unter realen Bedingungen funktioniert – mit Hintergrundgeräuschen, Akzenten und den unvorhersehbaren Wendungen, die echte menschliche Gespräche ausmachen.