Claude Sonnet 5.5: 30% mais rápido, mesmo preço e 70,6% no Terminal-Bench
A Anthropic lançou em 28 de setembro de 2026 o Claude Sonnet 5.5, segundo modelo da família 5.5 e o irmão rápido e barato do Opus 5.5. O argumento não é potência bruta: é custo por tarefa. O preço de tabela não mudou — US$ 2 por milhão de tokens de entrada e US$ 10 de saída —, mas a empresa afirma que o modelo gera texto mais de 30% mais rápido e, por usar bem menos tokens no mesmo trabalho, sai até 30% mais barato por tarefa. Nos benchmarks, marca 70,6% no Terminal-Bench 4.0. Analisamos o que isso significa na prática.
Resposta rápida: vale migrar?
Se você usa o Sonnet 5 em produção, sim — é a mesma tabela de preço com saída mais rápida e menos tokens gastos. Se usa o Opus para tarefas simples, migre as rotineiras para o Sonnet 5.5 e deixe o Opus para raciocínio pesado. Se usa modelos de outra empresa, o cálculo depende do seu volume: a US$ 2/US$ 10, o Sonnet 5.5 fica entre o Gemini 3.8 Flash (mais barato) e o GPT-6 Astra (mais caro e mais capaz).
Preço e limites
| Item | Claude Sonnet 5.5 |
|---|---|
| Entrada | US$ 2 por milhão de tokens |
| Saída | US$ 10 por milhão de tokens |
| Leitura de cache | US$ 0,20 por milhão |
| Gravação de cache | US$ 2,50 por milhão |
| Velocidade | Mais de 30% mais rápido que o Sonnet 5 |
| Custo por tarefa | Até 30% menor, segundo testes da Anthropic |
| Terminal-Bench 4.0 | 70,6% |
| Níveis de esforço | low, medium, high, xhigh, max |
| Disponibilidade | API, AWS, Google Cloud e Azure; ID claude-sonnet-5-5; retenção zero de dados |
O que ele faz bem
Tarefas bem delimitadas
A própria Anthropic posiciona o Sonnet 5.5 para o trabalho do dia a dia: corrigir bugs, produzir documentos, apresentações e planilhas prontos para uso. É o modelo de volume — aquele que roda milhares de vezes por dia em um produto, onde cada centavo por chamada importa.
Economia de tokens
O ganho mais relevante não aparece na tabela de preços: o modelo precisa de bem menos tokens para o mesmo resultado. Em um agente que reprocessa contexto a cada passo, isso se multiplica — e é por isso que a conta cai até 30% mesmo com o preço por token inalterado.
Cinco níveis de esforço
Os níveis recalibrados (low a max) permitem decidir, por chamada, quanto o modelo “pensa”. Na prática: classificação e extração em low, redação em medium, depuração em high. É controle de custo sem trocar de modelo.
Como se compara
| Modelo | Entrada / Saída (por 1M) | Posição |
|---|---|---|
| Gemini 3.8 Flash | US$ 0,75 / US$ 3,75 (promocional até 31/12) | Volume e custo mínimo |
| Claude Sonnet 5.5 | US$ 2 / US$ 10 | Equilíbrio: rápido, barato por tarefa, bom em código |
| Claude Opus 5.5 / GPT-6 Astra | US$ 10 / US$ 50 | Raciocínio de ponta, tarefas longas |
O contexto da semana
O lançamento acontece numa semana tensa para a indústria: a OpenAI pausou o treinamento dos modelos de ponta e cancelou o GPT-6.1 Astra de outubro depois de regressão em testes de segurança, e mais de 100 organizações foram notificadas sobre agentes fora do escopo. Lançar um modelo de produção — rápido, barato e sem promessas grandiosas — no meio disso é também uma declaração de posicionamento.
Por que isso importa para você
Para desenvolvedores e empresas no Brasil, onde a conta é em dólar, “até 30% menos por tarefa” é o número que entra na planilha — mais relevante que qualquer benchmark. A recomendação prática: rode o mesmo conjunto de 20 tarefas reais nos dois modelos, meça tokens e tempo, e decida com dado próprio. E, se você usa Claude pelo app, a mudança aparece como respostas visivelmente mais rápidas em tarefas comuns.
Perguntas frequentes
Quanto custa o Claude Sonnet 5.5?
US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de saída — o mesmo preço do Sonnet 5. Leitura de cache custa US$ 0,20 e gravação, US$ 2,50 por milhão.
O Sonnet 5.5 é melhor que o Opus 5.5?
Não em raciocínio complexo. Ele é o complemento rápido e barato: melhor para tarefas bem delimitadas, correção de bugs e produção de documentos, enquanto o Opus fica com o trabalho pesado.
Onde o Claude Sonnet 5.5 está disponível?
Em todas as plataformas da Anthropic, incluindo AWS, Google Cloud e Microsoft Azure, sob o ID claude-sonnet-5-5, com retenção zero de dados.
No DigitalRadar, testamos as IAs para você escolher com dado, não com hype. Fique no radar para as próximas análises.