<p><strong>CONFIRMADO.</strong> OpenAI liberó GPT-Live-1 en la API el 10 de septiembre de 2026. El modelo de voz full duplex llega con soporte para llamadas telefónicas, transcripción nativa, texto de respuesta y un precio anunciado de US$ 0,05 por minuto para la capa de voz. Es la diferencia entre ver una demostración convincente y poder poner la tecnología dentro de un producto.</p><h2>La API finalmente llegó</h2><p>GPT-Live-1 ya impulsaba la nueva experiencia de voz de ChatGPT, pero el acceso para desarrolladores de aplicaciones seguía siendo una promesa. Ahora OpenAI afirma que el modelo está disponible en la API y permite que cada equipo elija el modelo de texto, las herramientas y el harness del agente que funcionarán detrás de la conversación. La capa de voz gestiona la interacción continua, mientras que el trabajo más pesado puede delegarse a un modelo de razonamiento como GPT-6 Astra o a un modelo de terceros.</p><h2>Una voz que no necesita detenerse para pensar</h2><p>La ventaja no es solamente una voz más agradable. GPT-Live-1 escucha y habla al mismo tiempo, en lugar de esperar una ventana limpia de silencio para decidir que el usuario terminó. Eso mejora las interrupciones, las pausas, las confirmaciones breves y los cambios de dirección. OpenAI también afirma que el modelo maneja mejor el silencio, el ruido de fondo y las sesiones largas. En una evaluación inicial, Speak registró casi un 80% menos de interrupciones del tutor frente a sistemas anteriores basados en turnos.</p><p>La empresa también reporta una mejora de 30 puntos porcentuales en Full Duplex Bench frente a GPT-Realtime-2.1. Esas cifras son declaraciones de OpenAI, no un benchmark independiente, pero apuntan al aspecto más importante de la voz: el ritmo de la conversación, no solo la calidad de la transcripción.</p><h2>Qué cambia para las empresas brasileñas</h2><p>Para pequeñas y medianas empresas, el lanzamiento abre una ruta más corta hacia la atención telefónica, la confirmación de reservas, la actualización de pedidos, la clasificación de soporte y la recopilación de información. Un restaurante puede responder llamadas sin montar capas separadas de reconocimiento de voz, modelo de texto y síntesis de voz. Una clínica puede dejar que el agente mantenga la conversación mientras consulta agendas y sistemas internos. Una operación de eventos puede gestionar preguntas y cambios sin convertir cada pausa del cliente en un error de detección de turnos.</p><p>El precio de US$ 0,05 por minuto se aplica solo a la capa frontal de voz. El modelo de backend, las herramientas, la telefonía, la infraestructura, la observabilidad y las búsquedas eventuales se suman a la factura. Por eso, el precio destacado es una entrada, no el costo total de una llamada. Para Brasil, el tipo de cambio, los impuestos, el soporte en portugués y el rendimiento con nombres propios deben medirse antes de una migración.</p><h2>El contrapunto que importa</h2><p>El full duplex no elimina las responsabilidades de producto. Los desarrolladores siguen a cargo de permisos, políticas, escalamiento a personas, registro de llamadas y control de costos. La libertad para elegir el backend es poderosa, pero también significa que la experiencia final puede variar mucho entre implementaciones. Además, las evaluaciones propias no demuestran un rendimiento superior en portugués brasileño, ruido de call center o escenarios de atención con clientes agresivos.</p><h2>Nuestra lectura editorial</h2><p>El lanzamiento es material porque reduce la distancia entre voz natural y automatización útil. Nuestra lectura es que OpenAI no está vendiendo solamente un modelo de habla. Está intentando convertir el tiempo de la conversación en una capa de interfaz y mantener modular la inteligencia profunda. Para quienes construyen agentes en Brasil, vale la pena probarlo ahora en un flujo estrecho y medir interrupciones, latencia, costo total y escalamiento a personas. Reconstruir toda la arquitectura basándose solo en el anuncio sería marketing. Ignorar el cambio también sería un error.</p><h2>Fuentes</h2><p>OpenAI, anuncio de la API, 10 de septiembre de 2026:<br />https://openai.com/index/introducing-gpt-live-1-in-the-api<br /><br />OpenAI, ingeniería del sistema GPT-Live, 3 de agosto de 2026:<br />https://openai.com/index/continuous-voice-interaction-with-gpt-live/<br /><br />VentureBeat, lanzamiento original de GPT-Live, 8 de julio de 2026:<br />https://venturebeat.com/technology/openai-launches-gpt-live-a-full-duplex-voice-upgrade-that-lets-chatgpt-talk-more-like-a-person</p>