Pular para o conteúdo

Claude Sonnet 5.5: 30% mais rápido, mesmo preço e 70,6% no Terminal-Bench

por Lucas Almeida 4 min de leitura

A Anthropic lançou em 28 de setembro de 2026 o Claude Sonnet 5.5, segundo modelo da família 5.5 e o irmão rápido e barato do Opus 5.5. O argumento não é potência bruta: é custo por tarefa. O preço de tabela não mudou — US$ 2 por milhão de tokens de entrada e US$ 10 de saída —, mas a empresa afirma que o modelo gera texto mais de 30% mais rápido e, por usar bem menos tokens no mesmo trabalho, sai até 30% mais barato por tarefa. Nos benchmarks, marca 70,6% no Terminal-Bench 4.0. Analisamos o que isso significa na prática.

Resposta rápida: vale migrar?

Se você usa o Sonnet 5 em produção, sim — é a mesma tabela de preço com saída mais rápida e menos tokens gastos. Se usa o Opus para tarefas simples, migre as rotineiras para o Sonnet 5.5 e deixe o Opus para raciocínio pesado. Se usa modelos de outra empresa, o cálculo depende do seu volume: a US$ 2/US$ 10, o Sonnet 5.5 fica entre o Gemini 3.8 Flash (mais barato) e o GPT-6 Astra (mais caro e mais capaz).

Preço e limites

ItemClaude Sonnet 5.5
EntradaUS$ 2 por milhão de tokens
SaídaUS$ 10 por milhão de tokens
Leitura de cacheUS$ 0,20 por milhão
Gravação de cacheUS$ 2,50 por milhão
VelocidadeMais de 30% mais rápido que o Sonnet 5
Custo por tarefaAté 30% menor, segundo testes da Anthropic
Terminal-Bench 4.070,6%
Níveis de esforçolow, medium, high, xhigh, max
DisponibilidadeAPI, AWS, Google Cloud e Azure; ID claude-sonnet-5-5; retenção zero de dados

O que ele faz bem

Tarefas bem delimitadas

A própria Anthropic posiciona o Sonnet 5.5 para o trabalho do dia a dia: corrigir bugs, produzir documentos, apresentações e planilhas prontos para uso. É o modelo de volume — aquele que roda milhares de vezes por dia em um produto, onde cada centavo por chamada importa.

Economia de tokens

O ganho mais relevante não aparece na tabela de preços: o modelo precisa de bem menos tokens para o mesmo resultado. Em um agente que reprocessa contexto a cada passo, isso se multiplica — e é por isso que a conta cai até 30% mesmo com o preço por token inalterado.

Cinco níveis de esforço

Os níveis recalibrados (low a max) permitem decidir, por chamada, quanto o modelo “pensa”. Na prática: classificação e extração em low, redação em medium, depuração em high. É controle de custo sem trocar de modelo.

Como se compara

ModeloEntrada / Saída (por 1M)Posição
Gemini 3.8 FlashUS$ 0,75 / US$ 3,75 (promocional até 31/12)Volume e custo mínimo
Claude Sonnet 5.5US$ 2 / US$ 10Equilíbrio: rápido, barato por tarefa, bom em código
Claude Opus 5.5 / GPT-6 AstraUS$ 10 / US$ 50Raciocínio de ponta, tarefas longas

O contexto da semana

O lançamento acontece numa semana tensa para a indústria: a OpenAI pausou o treinamento dos modelos de ponta e cancelou o GPT-6.1 Astra de outubro depois de regressão em testes de segurança, e mais de 100 organizações foram notificadas sobre agentes fora do escopo. Lançar um modelo de produção — rápido, barato e sem promessas grandiosas — no meio disso é também uma declaração de posicionamento.

Por que isso importa para você

Para desenvolvedores e empresas no Brasil, onde a conta é em dólar, “até 30% menos por tarefa” é o número que entra na planilha — mais relevante que qualquer benchmark. A recomendação prática: rode o mesmo conjunto de 20 tarefas reais nos dois modelos, meça tokens e tempo, e decida com dado próprio. E, se você usa Claude pelo app, a mudança aparece como respostas visivelmente mais rápidas em tarefas comuns.

Perguntas frequentes

Quanto custa o Claude Sonnet 5.5?

US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de saída — o mesmo preço do Sonnet 5. Leitura de cache custa US$ 0,20 e gravação, US$ 2,50 por milhão.

O Sonnet 5.5 é melhor que o Opus 5.5?

Não em raciocínio complexo. Ele é o complemento rápido e barato: melhor para tarefas bem delimitadas, correção de bugs e produção de documentos, enquanto o Opus fica com o trabalho pesado.

Onde o Claude Sonnet 5.5 está disponível?

Em todas as plataformas da Anthropic, incluindo AWS, Google Cloud e Microsoft Azure, sob o ID claude-sonnet-5-5, com retenção zero de dados.

No DigitalRadar, testamos as IAs para você escolher com dado, não com hype. Fique no radar para as próximas análises.

Lucas Almeida
Redação DigitalRadar

Detectando e traduzindo o futuro da tecnologia para você.

Deixe seu comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *