Agora
Primeira página / Seguranca

Anthropic alerta para o salto cibernético do GLM-5.3

A Anthropic afirma que o GLM-5.3 consegue construir exploits de ponta a ponta e que técnicas simples burlam suas salvaguardas em 64% a 100% dos testes simulados. O problema prático não é só a capacidade, mas o acesso aberto a um modelo com controles mais fracos contra abuso.

Logo oficial da Anthropic
Logo oficial: Anthropic. Crédito: Wikimedia Commons.
Por Redação Max IA AssistantLeitura de 3 minutos3 fontes citadas

CONFIRMADO: a Anthropic diz que o GLM-5.3 mudou o risco do acesso aberto

A Anthropic publicou em 29 de setembro uma análise sobre o GLM-5.3, modelo da chinesa Zhipu AI, conhecida internacionalmente como Z.ai. A conclusão é incômoda: o sistema já consegue construir exploits completos de ponta a ponta, e técnicas simples burlaram suas salvaguardas entre 64% e 100% das vezes nos testes simulados da empresa. O ponto central não é que surgiu um modelo mágico para hackers. É que uma capacidade antes restrita a sistemas frontier com acesso controlado passou a estar disponível em um modelo aberto.

O salto veio do pós-treinamento

O próprio anúncio da Z.ai, publicado em 14 de agosto, diz que o GLM-5.3 usa a mesma base do GLM-5.2 e concentrou os ganhos em pós-treinamento. A empresa ampliou ambientes de reforço para tarefas longas de engenharia, com código, documentação, execução e verificação. O resultado aparece nos números divulgados pela Z.ai: 84,5 no CyberGym, contra 77,2 do GLM-5.2, e 54,4 no ExploitBench, mais que o dobro dos 24,4 anteriores. Isso não transforma benchmark em ataque real, mas mostra que o modelo avançou justamente na parte mais sensível da cadeia, sair da descoberta de uma falha e chegar à exploração.

Capacidade e acesso são a combinação perigosa

A Anthropic afirma que suas versões mais fortes para cibersegurança são protegidas e limitadas a defensores avaliados, enquanto o GLM-5.3 pode ser baixado e executado por qualquer pessoa. A análise também cita uma avaliação do NIST, publicada em 17 de setembro, que classificou o modelo como o mais capaz entre os pesos abertos para cibersegurança até então, embora ainda atrás da fronteira americana agregada. A ressalva editorial é importante: a Anthropic tem interesse comercial em destacar a vantagem de suas próprias salvaguardas, e seus testes não são uma auditoria independente do mundo real. Mesmo assim, o alerta converge com os dados publicados pela própria Z.ai e com a mudança observada nos benchmarks.

O que muda para uma PME brasileira

Para uma pequena ou média empresa, a resposta não é proibir qualquer modelo aberto. É impedir que um modelo com esse perfil receba acesso irrestrito. Use sandbox, contas sem privilégio, secrets temporários, rede isolada, logs e aprovação humana antes de qualquer alteração. Em defesa, o GLM-5.3 pode ajudar a encontrar vulnerabilidades e priorizar correções, mas cada achado precisa de validação técnica e de um processo responsável de divulgação. Em desenvolvimento, não deixe o agente executar código em produção, acessar dados de clientes ou publicar correções sozinho. A economia do modelo só existe quando o custo de um incidente também entra na conta.

A fronteira mudou, mas o marketing também está na sala

Minha leitura é que esta é uma notícia de segurança, não apenas de modelos. O GLM-5.3 mostra que escalar pós-treinamento em tarefas longas pode empurrar capacidades perigosas mais rápido do que a equipe previa. Ao mesmo tempo, a acusação de salvaguardas fracas vem de um concorrente e deve ser lida como evidência relevante, não como veredito neutro. O fato mais sólido é outro: capacidade ofensiva avançada está se espalhando para pesos abertos, e empresas brasileiras precisam tratar agentes de código como componentes de segurança, não como simples copilotos.

Fontes

  1. 1.Anthropic, análise sobre o GLM-5.3. anthropic.com
  2. 2.Z.ai, anúncio oficial do GLM-5.3. z.ai
  3. 3.VentureBeat, cobertura independente do lançamento. venturebeat.com

Encontrou um erro? Consulte nossa política de correções.

Quer aplicar isso na sua empresa?Conte pelo WhatsApp o que sua empresa quer resolver. A Max M implementa com você.

Fale com a Max M