Model Update2026-09-11
OpenAI Blog
GPT-Live-1 trae voz full-duplex a la API de OpenAI
OpenAI ha lanzado GPT-Live-1 en su API, llevando conversaciones de voz naturales y full-duplex a los desarrolladores. El modelo ofrece un mejor seguimiento de instrucciones, soporte para voces personalizadas e integración telefónica, lo que lo hace muy adecuado para call centers, asistentes de voz y aplicaciones interactivas.
La capacidad full-duplex es la característica estrella. Significa que el modelo puede escuchar y hablar a la vez, en lugar de esperar a que el usuario termine antes de responder. Los sistemas de voz tradicionales por turnos suelen sentirse rígidos y lentos, con pausas incómodas e interrupciones que rompen el flujo de una conversación real. GPT-Live-1 busca eliminar esos puntos de fricción y producir intercambios que se parezcan más a hablar con otra persona.
Más allá de la capacidad de respuesta, el modelo mejora el seguimiento de instrucciones detalladas, algo que importa a las empresas que necesitan interacciones consistentes y alineadas con su marca a escala. El soporte de voces personalizadas permite a las organizaciones definir cómo suena su asistente, mientras que la integración telefónica abre la puerta al despliegue sobre líneas telefónicas estándar, un requisito para muchas operaciones de atención al cliente.
El lanzamiento indica que la voz se está convirtiendo en un frente central de la competencia entre proveedores de IA. A medida que los asistentes basados en texto maduran, la capacidad de mantener conversaciones habladas fluidas podría diferenciar productos en mercados donde los clientes esperan llamar y ser entendidos.
Para los desarrolladores, GPT-Live-1 ofrece una forma de añadir voz conversacional sin tener que armar un rompecabezas de reconocimiento de voz, síntesis y gestión de diálogo. La pregunta ahora es qué tan bien rinde en condiciones del mundo real, con ruido de fondo, acentos y los giros impredecibles que definen una conversación humana genuina.