CONFIRMADO: Gemini estrena comprensión de vídeo agéntica

Sello editorial: CONFIRMADO. Base: el blog de Google del 1 de septiembre de 2026. La comprensión de vídeo agéntica está en Gemini 3.7 Flash, 3.6 Flash y 3.5 Flash-Lite, vía API de Gemini en AI Studio y Gemini Enterprise Agent Platform. Se activa con processing agentic en el input de vídeo. Sin tarifa extra; vale el precio de tokens. Es una función sobre Flash ya existente, no Gemini 3.8. Fuente: https://blog.google/innovation-and-ai/models-and-research/gemini-models/introducing-agentic-video-in-gemini/ · docs: https://ai.google.dev/gemini-api/docs/video-understanding#agentic-video-understanding

Lo que sabemos

En vez de ingerir el vídeo a un FPS fijo, el modelo busca, escanea e inspecciona solo los fotogramas, el audio y la transcripción que necesita. Las evals de Google hablan de hasta 88% menos tokens, hasta 66% menos coste de análisis y hasta 7% más acierto, con la mayor ganancia en vídeo largo. 3.7 Flash queda en su frontera calidad-coste entre los tres. El despliegue en la app de Gemini es "pronto"; Ask YouTube, en meses. Gemini 3.8 Flash sigue fuera del catálogo oficial.

Lo que aún no sabemos

No hay benchmarks independientes. Latencia del bucle agéntico, calidad en español y fallos en vídeo ruidoso no están medidos aquí. El 88/66/7 es cifra del fabricante. 3.8 Flash sigue siendo señal del WSJ, no este lanzamiento.

Por qué importa

Si ya paga Flash para leer YouTube o clases largas, este es el drop práctico, no un ID nuevo. Pruebe processing=agentic en un clip largo real antes de reescribir pipelines. No lo confunda con el envío de 3.8 Flash.