CONFIRMADO. Google publicó el 10 de septiembre la versión 2.23.0 de su SDK Gen AI para Python. No es un lanzamiento de modelo, no cambia los precios de la API y no promete un salto en benchmarks. Es una actualización de infraestructura enfocada en dos puntos incómodos al convertir Gemini en producto: reproducir entornos gestionados y saber cuándo terminó realmente una conversación en vivo.
El primer cambio añade el parámetro from_environment a la creación de entornos. El desarrollador puede crear un entorno nuevo a partir de otro existente, pasando el identificador del entorno de origen. La función está disponible en llamadas síncronas y asíncronas. La implementación envía esa referencia a la API de entornos de Agent Platform. Cuando se usa esta opción, la petición no debe combinarla con nuevas fuentes ni con otra configuración de entorno.
Parece un detalle pequeño del SDK, pero cambia la operación diaria. Una empresa pequeña que mantiene un agente con archivos, dependencias y configuración de red puede separar desarrollo, pruebas y producción sin reconstruir todo desde cero. También resulta más sencillo crear una variante temporal para un cliente, probar una integración y regresar al entorno original sin convertir cada experimento en un proyecto de infraestructura. La advertencia es importante: copiar un entorno no valida permisos, secretos, costes ni el comportamiento del agente. El clon necesita los mismos controles de seguridad y observabilidad que el entorno original.
La segunda novedad modifica la detección del final de turno en el Live API. Antes, el cliente de Python dejaba de recibir eventos cuando encontraba turn_complete. Ahora usa interaction_status cuando el servidor entrega un valor válido, y considera IDLE como finalización. Si el estado es IN_PROGRESS, la sesión sigue recibiendo eventos aunque ya haya aparecido una señal de final de turno.
Para voz y vídeo en tiempo real, esto no es solo un cambio de nomenclatura. Un agente puede terminar una etapa de generación y continuar procesando la interacción. La nueva lógica reduce el riesgo de cortar una respuesta, liberar la interfaz demasiado pronto o lanzar la siguiente acción mientras el servidor todavía trabaja. Es una corrección de sincronización, no una promesa automática de menor latencia. La latencia final sigue dependiendo del modelo, la red, el audio y el diseño de la aplicación.
El paquete también elimina un campo sin uso de FunctionResultDelta, una limpieza menor que reduce la ambigüedad en las respuestas de herramientas. Mi lectura es directa: conviene actualizar si usas entornos de Agent Platform o el Live API, siempre con pruebas de regresión en los flujos de streaming. Si la aplicación solo llama a generate_content de forma convencional, el beneficio es indirecto y esta versión, por sí sola, no justifica correr.
Fuentes en ES: release oficial v2.23.0; changelog de la versión; guía oficial del Live API; catálogo independiente del paquete.
