A Anthropic lançou nesta segunda-feira (28) o Claude Sonnet 5.5, segundo modelo da família Claude 5.5, cerca de uma semana depois do Opus 5.5. O preço por token não mudou. A empresa diz que o ganho está na eficiência: o modelo faria o mesmo trabalho com menos tokens. Uma avaliação independente publicada no mesmo dia confirma o salto de desempenho, mas mostra que essa economia não vale para todos os usos.
Adicione ao Google NotíciasNeste artigo
Preço igual e a promessa de eficiência
O Sonnet 5.5 custa o mesmo que o Sonnet 5:
US$ 2 por milhão de tokens de entrada;
US$ 10 por milhão de tokens de saída;
US$ 0,20 por milhão em leitura de cache;
US$ 2,50 por milhão em escrita de cache.
O Opus 5.5 custa o dobro na entrada e na saída. A janela de contexto continua em 1 milhão de tokens, com entrada de texto e imagem.
Segundo a Anthropic, o modelo é mais de 30% mais rápido que o Sonnet 5, o Sonnet mais rápido já lançado, e custa até 30% menos por tarefa. Clientes de acesso antecipado relatam ganhos grandes. A gestora Balyasny, por exemplo, viu o consumo cair de cerca de 497 mil para 121 mil tokens por resposta em um conjunto de tarefas financeiras.
O outro lado: esforço máximo sai caro
O modelo tem cinco níveis de esforço: low, medium, high, xhigh e max. Quanto maior o nível, mais o modelo raciocina e mais tokens consome. E é aí que a conta muda.
No índice de inteligência da Artificial Analysis, o Sonnet 5.5 no esforço máximo marcou 56 pontos. É o segundo lugar do ranking, 18 pontos acima do Sonnet 5 e só 2 atrás do Opus 5.5 também no máximo. Para chegar lá, porém, usou cerca de 193 mil tokens de saída por tarefa. Segundo a consultoria, é o maior consumo que ela já registrou:
cerca de 60% acima do Opus 5.5 e do Sonnet 5 no esforço máximo;
cerca de 7 vezes o do GPT-6 Astra.
O resultado é um custo de US$ 7,60 por tarefa nesse nível, cerca de 50% acima do Sonnet 5.
As duas leituras não se contradizem. Os ganhos de custo divulgados pela Anthropic aparecem sobretudo nos níveis mais baixos. Nos níveis Low e Medium, o Sonnet 5.5 supera a melhor marca do Sonnet 5 por cerca de um décimo do custo. No máximo, o modelo chega perto do Opus, mas paga caro por isso.
Na relação entre inteligência e custo por tarefa, a Artificial Analysis coloca o Sonnet 5.5 fora da fronteira de eficiência:
nos níveis altos, fica atrás do Opus 5.5;
nos baixos, configurações do GPT-6 Astra ou Sol entregam desempenho equivalente por menos;
o nível high é o mais competitivo, praticamente empatado com o GPT-6 Sol em inteligência e custo por tarefa.
Onde ele se destaca
Em programação com agentes, os números são fortes nas duas medições:
Terminal-Bench 4.0 pela Anthropic: 70,6% no Sonnet 5.5, contra 10,3% do Sonnet 5 e 66,4% do Opus 5.5.
Terminal-Bench 4.0 pela Artificial Analysis: 64% no Sonnet 5.5, contra 60% do Opus 5.5 e do GPT-6 Astra.
A diferença entre as duas medições provavelmente vem de metodologias distintas.
Em trabalho de conhecimento, os resultados ficam praticamente empatados com o Opus 5.5:
GDPval-AA: 1844 contra 1846;
AA-Briefcase: 1811 contra 1822;
AutomationBench-AA: 71% contra 70%.
A ressalva é que o Sonnet 5.5 usa bem mais tokens para chegar lá.
Onde ainda fica atrás
Por ser um modelo de porte menor, o Sonnet 5.5 perde para o Opus 5.5 em conhecimento factual. No AA-Omniscience, acertou 54% contra 66%, embora alucine menos: 47% contra 59%. No Humanity's Last Exam e no SciCode, fica cerca de 6 pontos abaixo. A própria Anthropic reconhece que o Opus segue claramente superior em trabalho complexo e aberto que exige julgamento contínuo.
Comparativo
| Sonnet 5.5 | Sonnet 5 | Opus 5.5 | |
|---|---|---|---|
| Entrada / saída (US$/1M) | 2 / 10 | 2 / 10 | 4 / 20 |
| Escrita de cache (US$/1M) | 2,50 | 2,50 | 5 |
| AA Intelligence Index (max) | 56 | 38 | 58 |
| Terminal-Bench 4.0 (Anthropic) | 70,6% | 10,3% | 66,4% |
| CursorBench 4.0 | 55,5% | 34,1% | 57,8% |
| GDPval-AA | 1844 | 1449 | 1846 |
| OSWorld 2.1 | 80,1% | 57,0% | 81,8% |
| AA-Omniscience (acerto) | 54% | — | 66% |
Fontes: Anthropic e Artificial Analysis. O Opus 5.5 no Terminal-Bench da Anthropic foi medido no esforço Xhigh.

Segurança
Esse é o primeiro Sonnet lançado com salvaguardas de cibersegurança semelhantes às dos modelos mais avançados. Pedidos de maior risco são repassados ao Sonnet 5. Nos testes da Artificial Analysis, esse repasse ocorreu em cerca de 0,1% das tarefas, principalmente no Terminal-Bench.
Disponibilidade
O modelo já está disponível na Claude Platform (claude-sonnet-5-5), AWS, Google Cloud e Microsoft Azure. O Claude Haiku 5.5, voltado a alto volume e baixo custo, chega nas próximas semanas.
Com informações




