CONFIRMADO: o Sonnet ficou mais rápido, não simplesmente mais barato
A Anthropic lançou o Claude Sonnet 5.5 em 28 de setembro como a atualização de seu modelo intermediário para trabalho cotidiano. A promessa central é direta: mais de 30% de velocidade de saída acima do Sonnet 5, com o mesmo preço de 2 dólares por milhão de tokens de entrada e 10 dólares por milhão de saída. O modelo também mantém cobrança de 0,20 dólar por milhão de tokens em cache. A economia real, porém, depende de quantos tokens e chamadas de ferramenta cada tarefa exige.
A surpresa está no coding e no custo por tarefa
O Sonnet 5.5 foi apresentado para corrigir bugs, produzir documentos, planilhas e apresentações e lidar com tarefas bem delimitadas. Na avaliação Terminal-Bench 4.0, a Anthropic reportou 70,6%, acima dos 66,4% do Opus 5.5, embora esse número seja da própria empresa. Uma medição independente da Artificial Analysis também colocou o Sonnet à frente em sua execução, mas encontrou um contraponto importante: em esforço máximo, ele consumiu cerca de 193 mil tokens por tarefa, mais que o Opus 5.5. Isso pode inverter a conta em fluxos que deixam o modelo pensar demais.
O contrato técnico mudou junto com o modelo
A documentação oficial traz mudanças que importam mais para quem mantém agentes do que para quem só conversa com o modelo. O pensamento adaptativo fica ligado por padrão e o esforço controla a profundidade. Para desligar o pensamento inicial em fluxos com ferramentas, a aplicação precisa usar o modo between_tools, porque disabled retorna erro. Uso forçado de ferramenta deixa de funcionar, os blocos de pensamento ficam vinculados ao modelo e à conversa, e texto entre chamadas pode aparecer dentro de blocos thinking. No Claude API e no Google Cloud, o toolset antigo de computer use também não é aceito.
O impacto para pequenas empresas brasileiras
Para uma PME que usa agente de programação, atendimento ou análise documental, o lançamento é atraente porque pode entregar mais iterações por minuto sem aumento no preço de tabela. A vantagem aparece especialmente em tarefas com escopo claro, como corrigir um bug, revisar um contrato ou transformar dados em relatório. Mas trocar apenas o model ID é uma receita para incidente. Streaming, histórico de thinking, tool choice, computer use e limites de esforço precisam ser testados em staging, com o custo por tarefa concluída medido em reais, não apenas em tokens.
A leitura editorial
O Sonnet 5.5 é um lançamento relevante porque transforma o modelo intermediário em candidato sério para substituir o Opus em tarefas rotineiras. Ainda não é um cheque em branco para automação: o benchmark é forte, o consumo em esforço alto é pesado e a migração tem breaking changes reais. Minha leitura é testar agora em fluxos bem delimitados, com esforço controlado e rollback pronto. A promessa não é um modelo mágico, é um agente mais rápido quando o sistema ao redor sabe limitar a tarefa.
Fontes em PT
Anthropic, documentação oficial de novidades e migração
Decrypt, cobertura e análise independente
SiliconANGLE, cobertura do lançamento
Encontrou um erro? Consulte nossa política de correções.
Quer aplicar isso na sua empresa?Conte pelo WhatsApp o que sua empresa quer resolver. A Max M implementa com você.
Fale com a Max M


