<p><strong>CONFIRMADO.</strong> A OpenAI liberou o GPT-Live-1 na API em 10 de setembro de 2026. O modelo de voz full duplex chega com suporte a chamadas telefônicas, transcrição nativa, texto de resposta e preço anunciado de US$ 0,05 por minuto para a camada de voz. É a diferença entre assistir a uma demonstração convincente e poder colocar a tecnologia dentro de um produto.</p><h2>A API finalmente chegou</h2><p>O GPT-Live-1 já era o motor da nova experiência de voz do ChatGPT, mas o acesso para quem desenvolve aplicações ainda estava no futuro. Agora, a OpenAI diz que o modelo está disponível na API e permite que cada equipe escolha o modelo de texto, as ferramentas e o harness de agente usado nos bastidores. A camada de voz cuida da conversa contínua, enquanto o trabalho mais pesado pode ser delegado a um modelo de raciocínio, como o GPT-6 Astra, ou a um modelo de terceiros.</p><h2>Uma voz que não precisa parar para pensar</h2><p>O diferencial não é apenas uma voz mais bonita. O GPT-Live-1 escuta e fala ao mesmo tempo, em vez de esperar uma janela limpa de silêncio para encerrar a fala do usuário. Isso melhora interrupções, pausas, confirmações curtas e mudanças de assunto. A OpenAI também afirma que o modelo lida melhor com silêncio, ruído de fundo e sessões longas. Em uma avaliação inicial, a Speak registrou quase 80% menos interrupções do tutor em comparação com sistemas anteriores baseados em turnos.</p><p>A empresa reporta ainda ganho de 30 pontos percentuais no Full Duplex Bench contra o GPT-Realtime-2.1. Esses números são declarações da própria OpenAI, não um benchmark independente, mas apontam para o aspecto que mais importa em voz: o ritmo da conversa, não apenas a qualidade da transcrição.</p><h2>O que muda para empresas brasileiras</h2><p>Para pequenas e médias empresas, a novidade abre uma rota mais curta para atendimento telefônico, confirmação de reservas, atualização de pedidos, triagem de suporte e cobrança de informações. Um restaurante pode receber ligações sem montar uma cadeia separada de reconhecimento de fala, modelo de texto e síntese de voz. Uma clínica pode deixar o agente continuar conversando enquanto consulta agenda e sistemas internos. Uma operação de eventos pode lidar com perguntas e alterações sem transformar cada pausa do cliente em um erro de turno.</p><p>O preço de US$ 0,05 por minuto vale apenas para a camada frontal de voz. O modelo de bastidores, ferramentas, telefonia, infraestrutura, observabilidade e eventuais buscas entram na conta. Portanto, a cifra é uma porta de entrada, não o custo total de uma chamada. Para o Brasil, câmbio, impostos, suporte em português e qualidade com nomes próprios precisam entrar no teste antes de qualquer migração.</p><h2>O contraponto que importa</h2><p>Full duplex não elimina os problemas de produto. A empresa ainda deixa para o desenvolvedor a responsabilidade por permissões, políticas, handoffs para humanos, registro de chamadas e controle de custo. A flexibilidade de escolher o backend é poderosa, mas também significa que a experiência final pode variar muito entre implementações. Além disso, avaliações proprietárias não provam desempenho superior em português brasileiro, ruído de call center ou cenários de atendimento agressivo.</p><h2>Leitura editorial</h2><p>O lançamento é material porque reduz a distância entre voz natural e automação útil. Minha leitura é que a OpenAI não está vendendo somente um modelo de fala, está tentando transformar o tempo da conversa em uma camada de interface e deixar a inteligência profunda modular. Para quem constrói agentes no Brasil, vale testar agora em um fluxo estreito e medir interrupções, latência, custo total e escalada para humanos. Trocar toda a arquitetura com base no anúncio seria marketing. Ignorar a mudança também seria.</p><h2>Fontes</h2><p>OpenAI, anúncio da API, 10 de setembro de 2026:<br />https://openai.com/index/introducing-gpt-live-1-in-the-api<br /><br />OpenAI, engenharia do sistema GPT-Live, 3 de agosto de 2026:<br />https://openai.com/index/continuous-voice-interaction-with-gpt-live/<br /><br />VentureBeat, lançamento original do GPT-Live, 8 de julho de 2026:<br />https://venturebeat.com/technology/openai-launches-gpt-live-a-full-duplex-voice-upgrade-that-lets-chatgpt-talk-more-like-a-person</p>