Model Update2026-09-11
OpenAI Blog
GPT-Live-1 traz voz full-duplex à API
A OpenAI liberou o GPT-Live-1 na sua API, trazendo conversas de voz naturais e full-duplex para desenvolvedores. O modelo segue melhor instruções, oferece suporte a vozes personalizadas e integração com telefonia, o que o deixa bem adequado para call centers, assistentes de voz e aplicações interativas.
A capacidade full-duplex é o destaque. Isso significa que o modelo pode ouvir e falar ao mesmo tempo, em vez de esperar o usuário terminar para só então responder. Sistemas de voz tradicionais baseados em turnos costumam soar travados e lentos, com pausas esquisitas e interrupções que quebram o ritmo de uma conversa real. O GPT-Live-1 quer eliminar esses atritos e produzir trocas mais próximas de uma conversa entre duas pessoas.
Além da responsividade, o modelo melhora no seguimento de instruções detalhadas, o que importa para empresas que precisam de interações consistentes e alinhadas à marca em escala. O suporte a vozes personalizadas permite que as organizações definam como seu assistente soa, enquanto a integração com telefonia abre a porta para implantação em linhas telefônicas comuns, um requisito para muitas operações de atendimento ao cliente.
O lançamento sinaliza que a voz está se tornando uma frente central na competição entre os provedores de IA. Conforme os assistentes baseados em texto amadurecem, a capacidade de manter conversas faladas fluentes pode diferenciar produtos em mercados onde os clientes esperam ligar e ser entendidos.
Para os desenvolvedores, o GPT-Live-1 oferece uma forma de adicionar voz conversacional sem montar um quebra-cabeça de reconhecimento de fala, síntese e gerenciamento de diálogo. A questão agora é como ele se sai em condições do mundo real, com ruído de fundo, sotaques e as reviravoltas imprevisíveis que definem uma conversa humana de verdade.