CONFIRMADO: Gemini ganha leitura agentic de vídeo

Selo editorial: CONFIRMADO. Base: blog do Google em 1º de setembro de 2026. A compreensão agentic de vídeo entrou no Gemini 3.7 Flash, 3.6 Flash e 3.5 Flash-Lite, pela API do Gemini no AI Studio e no Gemini Enterprise Agent Platform. Ativa-se com processing agentic no input de vídeo. Sem taxa extra; vale o preço de token. É feature em cima do Flash que já existe, não o Gemini 3.8. Fonte: https://blog.google/innovation-and-ai/models-and-research/gemini-models/introducing-agentic-video-in-gemini/ · docs: https://ai.google.dev/gemini-api/docs/video-understanding#agentic-video-understanding

O que sabemos

Em vez de ingerir o vídeo a um FPS fixo, o modelo busca, varre e inspeciona só os frames, o áudio e a transcrição que precisa. As evals do Google falam em até 88% menos tokens, até 66% menos custo de análise e até 7% mais acerto, com o ganho maior em vídeo longo. O 3.7 Flash fica na fronteira qualidade-custo entre os três. O app Gemini recebe isso "em breve"; o Ask YouTube, em meses. O Gemini 3.8 Flash continua fora do catálogo oficial.

O que ainda não sabemos

Não há benchmark independente. Latência do loop agentic, qualidade em português e falha em vídeo ruidoso não foram medidas aqui. O 88/66/7 é número do fabricante. 3.8 Flash segue sinal do WSJ, não este lançamento.

Por que importa na prática

Se você já paga Flash para ler YouTube ou aula longa, este é o drop prático, não um ID novo. Teste processing=agentic num clipe longo real antes de reescrever pipeline. Não confunda com o embarque do 3.8 Flash.