POR QUÉ IMPORTA
Google activó la comprensión de vídeo agéntica en Gemini 3.7, 3.6 Flash y 3.5 Flash-Lite. Cifras del fabricante: hasta 88% menos tokens y 66% menos coste. No es Gemini 3.8.En este artículo
CONFIRMADO: Gemini estrena comprensión de vídeo agéntica
Sello editorial: CONFIRMADO. Base: el blog de Google del 1 de septiembre de 2026. La comprensión de vídeo agéntica está en Gemini 3.7 Flash, 3.6 Flash y 3.5 Flash-Lite, vía API de Gemini en AI Studio y Gemini Enterprise Agent Platform. Se activa con processing agentic en el input de vídeo. Sin tarifa extra; vale el precio de tokens. Es una función sobre Flash ya existente, no Gemini 3.8. Fuente: https://blog.google/innovation-and-ai/models-and-research/gemini-models/introducing-agentic-video-in-gemini/ · docs: https://ai.google.dev/gemini-api/docs/video-understanding#agentic-video-understanding
Lo que sabemos
En vez de ingerir el vídeo a un FPS fijo, el modelo busca, escanea e inspecciona solo los fotogramas, el audio y la transcripción que necesita. Las evals de Google hablan de hasta 88% menos tokens, hasta 66% menos coste de análisis y hasta 7% más acierto, con la mayor ganancia en vídeo largo. 3.7 Flash queda en su frontera calidad-coste entre los tres. El despliegue en la app de Gemini es "pronto"; Ask YouTube, en meses. Gemini 3.8 Flash sigue fuera del catálogo oficial.
Lo que aún no sabemos
No hay benchmarks independientes. Latencia del bucle agéntico, calidad en español y fallos en vídeo ruidoso no están medidos aquí. El 88/66/7 es cifra del fabricante. 3.8 Flash sigue siendo señal del WSJ, no este lanzamiento.
Por qué importa
Si ya paga Flash para leer YouTube o clases largas, este es el drop práctico, no un ID nuevo. Pruebe processing=agentic en un clip largo real antes de reescribir pipelines. No lo confunda con el envío de 3.8 Flash.