Em 28 de setembro de 2026, a Anthropic apresentou o Claude Sonnet 5.5, nova versão de seu modelo intermediário. Segundo a empresa, ele roda mais de 30% mais rápido e custa até 30% menos na maior parte dos trabalhos.
O lançamento foi acompanhado de perto pelo desenvolvedor Simon Willison. Ele publicou os primeiros testes e chamou atenção para o efeito prático da novidade.
O impacto vale tanto para quem consome APIs quanto para quem usa a versão gratuita do claude.ai.
O preço cobrado pelo Sonnet 5.5 é o mesmo do Sonnet 5. O modelo novo aparece à frente do antecessor em todos os benchmarks divulgados pela companhia.
Como ele responde mais rápido, o custo efetivo por tarefa tende a cair mesmo sem alteração na tabela de preços. O detalhe pesa em aplicações que fazem muitas chamadas ao longo do dia.
A troca é vantajosa em qualidade e em conta no fim do mês.
Disputa pelo nível gratuito
Para Willison, o aspecto mais interessante do Sonnet 5.5 não está nas medições de desempenho. Está na forma como a Anthropic decidiu distribuí-lo: o modelo passou a equipar o nível gratuito do claude.ai.
Isso significa que quem usa a plataforma sem pagar passa a ter acesso a um modelo bastante capaz. Do outro lado, o plano gratuito do ChatGPT roda o Luna 5.6, da OpenAI.
Na avaliação do desenvolvedor, a Anthropic tem hoje uma oferta gratuita consideravelmente mais forte que a da concorrente.
A empresa também reafirmou que o Haiku 5.5, da faixa mais leve de sua família de modelos, será disponibilizado "nas próximas semanas". Willison registra a expectativa de que esse modelo seja competitivo em preço com o GPT-6 Luna. A disputa por custo por token segue acirrada entre os dois laboratórios.
O pelicano, o bug e o custo de pensar demais
Willison mantém um teste recorrente para avaliar modelos de linguagem: pedir que produzam uma imagem vetorial de um pelicano andando de bicicleta. O Sonnet 5.5 se saiu bem no experimento, mas herdou um comportamento problemático já observado no Opus 5.5.
Quando configurado no esforço de raciocínio "max", o modelo consumiu 128 mil tokens, o equivalente a 1,28 dólar. Esgotou o orçamento e falhou, sem entregar o SVG solicitado.
No nível "xhigh", o resultado foi bastante diferente. A mesma tarefa saiu por 5,74 centavos de dólar e levou 41 segundos.
A comparação mostra que forçar o modelo a raciocinar mais nem sempre compensa. Acima de determinado ponto, o esforço adicional queima recursos sem garantir que a resposta chegue ao fim.
É um alerta para quem ajusta esses parâmetros em produção.
Desempenho em código e eficiência
Em tarefas de programação, o Sonnet 5.5 se aproxima do Opus 5.5, incluindo truques de animação 3D que viralizaram nas redes sociais. Willison também submeteu ao nível gratuito do claude.ai um pedido para gerar uma página HTML que renderizasse, com WebGL, um pelicano tridimensional pedalando.
Ele classificou o retorno como um esforço sólido. O teste ajuda a dimensionar o que um usuário sem assinatura consegue obter hoje de um modelo de ponta.
O conjunto de fatores reforça uma tendência já visível ao longo de 2026. Preço estável, ganho de velocidade, desempenho superior ao antecessor e queda no custo de execução entram nessa conta.
A competição entre laboratórios deixou de ser apenas sobre capacidade bruta. Passou a incluir eficiência e acessibilidade.
Modelos mais baratos de operar ampliam o leque de produtos viáveis, especialmente para startups que dependem de margens apertadas.
O que observar adiante
O próximo capítulo dessa disputa deve ser o Haiku 5.5, cuja chegada a Anthropic promete para as próximas semanas. Se ele vier com preço agressivo diante do GPT-6 Luna, a pressão sobre os custos de inferência deve aumentar ainda mais.
Quem desenvolve sobre essas plataformas tende a se beneficiar. Até lá, o Sonnet 5.5 já cumpre o papel de mostrar que é possível melhorar benchmarks sem encarecer o acesso.
E de levar um modelo forte para a camada gratuita, onde a maioria dos usuários toma contato com a tecnologia pela primeira vez.







