Agora
Primeira página / Lançamentos & Modelos

Google lança Gemini 3.8 Live com avatar falante para empresas

O Google lançou em 24 de setembro o Gemini 3.8 Live with Live Avatar, que coloca um rosto animado e sincronizado por voz na frente do modelo de diálogo em tempo real, disponível para clientes do Gemini Enterprise. É a resposta do Google à corrida por assistentes de IA com presença visual, um passo além do áudio que já vinha empurrando concorrentes como Meta.

Logo oficial da Google
Logo oficial: Google. Crédito: Wikimedia Commons.
Por Redação Max IA AssistantLeitura de 3 minutos2 fontes citadas

CONFIRMADO: o Gemini ganhou rosto

O Google confirmou em 24 de setembro o lançamento do Gemini 3.8 Live with Live Avatar, uma camada visual acoplada ao modelo de diálogo em tempo real que a empresa havia lançado poucos dias antes. Em vez de só ouvir e responder por voz, o sistema agora gera vídeo de um personagem animado, cartunesco ou realista, cuja boca e expressões acompanham a fala em até 24 quadros por segundo. A mudança central não é técnica isolada: é o Google tentando transformar conversa por voz em presença visual persistente, algo que Meta e outros players já vinham testando com seus próprios avatares.

Como funciona na prática

Segundo o Google, o Live Avatar processa áudio e vídeo ao mesmo tempo, permite que o usuário interrompa a fala a qualquer momento sem perder o contexto e mantém sincronia labial em 97 idiomas, inclusive em trocas de idioma no meio da conversa. O diferencial mais relevante para empresas é a execução assíncrona de ferramentas: o avatar consegue continuar falando enquanto busca dados ou roda uma tarefa em segundo plano, como confirmar uma reserva de hotel sem travar o diálogo. Isso aproxima o recurso de um atendente real, que resolve enquanto conversa, em vez de um chatbot que trava esperando resposta de sistema.

Onde isso deve aparecer primeiro

O recurso é exclusivo do Gemini Enterprise e mira casos como atendimento ao cliente, recepção virtual, demonstrações de produto e suporte multilíngue, com biblioteca de avatares prontos ou rostos personalizados a partir de foto de referência para empresas na lista aprovada. Para pequenas e médias empresas que hoje usam apenas texto ou voz em atendimento, o salto para um rosto sincronizado pode elevar a percepção de qualidade do suporte, mas também exige calibrar expectativa: sessões são curtas, o custo é maior que o do áudio puro, e o recurso por enquanto só está disponível via alocação corporativa aprovada pelo Google, não em auto-serviço.

O limite que o próprio Google reconhece

O Google aplica marca d'água SynthID em todo o vídeo e áudio gerados, mantém revisão de rostos personalizados e reserva o recurso à camada Enterprise, sinal de que a empresa está ciente do risco reputacional de avatares de IA mal recebidos publicamente. Reportagens independentes já classificaram o visual de alguns avatares como pouco natural, e a própria dinâmica de sessões curtas sugere que o Google ainda testa limites de custo computacional antes de expandir o acesso. A versão mais potente, Live Extended Thinking, segue em preview privado sem o recurso de avatar.

Nossa leitura

O Gemini 3.8 Live with Live Avatar é um movimento defensivo e ofensivo ao mesmo tempo: defende o Google de ficar para trás na corrida de assistentes com presença visual e ataca o mercado corporativo de atendimento antes que outros players consolidem essa camada. Para empresas brasileiras que avaliam automação de atendimento, o recurso ainda não está em auto-serviço nem em preço público, então o próximo passo prático é acompanhar quando o Google abrir acesso mais amplo antes de comprometer orçamento nessa frente.

Fontes

  1. 1.Google, anúncio oficial do Gemini 3.8 Live with Live Avatar. blog.google
  2. 2.Engadget, cobertura independente do lançamento. engadget.com

Encontrou um erro? Consulte nossa política de correções.

Quer aplicar isso na sua empresa?Conte pelo WhatsApp o que sua empresa quer resolver. A Max M implementa com você.

Fale com a Max M