A Anthropic lançou nesta terça-feira (22) o Claude Opus 5.5 por US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de saída — 20% menos que o Opus 5 e a metade do preço do Fable 5.1, o modelo mais caro da casa - que ele superou em vários testes de programação agêntica. Horas depois, a OpenAI respondeu com o GPT-6 Sol (US$ 2 / US$ 10) e o GPT-6 Luna (US$ 0,10 / US$ 0,50), ambos 50% mais baratos que os equivalentes da geração 5.6. Em um único dia, o custo de rodar um modelo de fronteira caiu para todo mundo — e a conta de quem usa API mudou de forma relevante. Abaixo, o preço de cada modelo em dólar e em real, quanto sai uma tarefa típica, o que cada um entrega nos benchmarks e um detalhe do Opus 5.5 que pode bagunçar a sua planilha.
Adicione ao Google NotíciasNeste artigo
Os preços, lado a lado
Valores por milhão de tokens, convertidos pelo dólar a R$ 5,10 (22/09). Leitura de cache é o que você paga para reaproveitar um contexto já enviado — em agente que repete o mesmo prompt a cada passo, essa linha costuma ser a que mais pesa.
| Modelo | Entrada (US$ / R$) | Saída (US$ / R$) | Leitura de cache (US$) | Contexto |
|---|---|---|---|---|
| Claude Opus 5.5 | 4,00 / R$ 20,41 | 20,00 / R$ 102,03 | 0,20 | 1 milhão |
| Claude Opus 5 | 5,00 / R$ 25,51 | 25,00 / R$ 127,54 | 0,50 | 1 milhão |
| Claude Fable 5.1 | 10,00 / R$ 51,02 | 50,00 / R$ 255,07 | 0,25 | 1 milhão |
| GPT-6 Astra | 10,00 / R$ 51,02 | 50,00 / R$ 255,07 | 1,00 | 1,05 milhão |
| GPT-6 Sol | 2,00 / R$ 10,20 | 10,00 / R$ 51,02 | 0,20 | 1,05 milhão |
| GPT-6 Luna | 0,10 / R$ 0,51 | 0,50 / R$ 2,55 | 0,01 | 1,05 milhão |
No Opus 5.5 a escrita de cache também caiu, de US$ 6,25 para US$ 5 por milhão, e o processamento em lote (Batch API) sai pela metade: US$ 2 e US$ 10. Há ainda um modo rápido, até 2,5 vezes mais veloz, por US$ 8 / US$ 40 — o dobro do preço padrão. Do lado da OpenAI, o corte do Sol e do Luna é permanente, não promocional: o GPT-5.6 Sol custava US$ 4 / US$ 20 e o Luna, US$ 0,20 / US$ 1,20.
Quanto custa uma tarefa de verdade
Preço por token diz pouco sozinho. Uma conta simples ajuda: uma tarefa de programação que envia 100 mil tokens de contexto (um punhado de arquivos, histórico e instruções) e devolve 20 mil tokens de resposta, sem cache:
| Modelo | Custo da tarefa (US$) | Em reais |
|---|---|---|
| GPT-6 Luna | 0,02 | R$ 0,10 |
| GPT-6 Sol | 0,40 | R$ 2,04 |
| Claude Opus 5.5 | 0,80 | R$ 4,08 |
| Claude Opus 5 | 1,00 | R$ 5,10 |
| Claude Fable 5.1 | 2,00 | R$ 10,20 |
| GPT-6 Astra | 2,00 | R$ 10,20 |
A Anthropic afirma que a economia real do Opus 5.5 fica perto de 40%, não 20%, porque o modelo gasta menos tokens para concluir a mesma tarefa e gera texto mais de 30% mais rápido. Clientes citados pela empresa dão números na mesma direção: a Box relatou consumo de cerca de um terço dos tokens do Opus 5 com respostas 40% menos prolixas; a GitHub disse que ele terminou mais tarefas de terminal que o Opus 5 em menos da metade dos passos; a Deloitte apontou que o Opus 5.5 no esforço mais baixo encontrou 72% dos bugs conhecidos em revisão de código, contra 56% do Opus 5 no esforço alto. São avaliações de clientes, não testes independentes — mas todas apontam para o mesmo lugar: menos passos, menos tokens, conta menor.
O que cada um entrega pelo que cobra
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Programação agêntica (Terminal-Bench 4.0) | 66,4% | 55,8% | 52,3% | 57,9% | 37,3% |
| Programação agêntica (FrontierCode v1.1) | 54,4% | 50,3% | 48,0% | 53,3% | 47,5% |
| Programação no editor (CursorBench 4.0) | 57,8% | 51,8% | 46,6% | — | 41,7% |
| Trabalho de escritório (GDPval-AA v2.1) | 1846 | 1735 | 1708 | 1542 | 1588 |
| Fluxos de negócio (AutomationBench) | 40,0% | 31,4% | 26,9% | 41,4% | 28,8% |
| Raciocínio (Humanity's Last Exam) | 67,7% | 65,6% | 63,6% | 57,2% | — |
| Uso de computador (OSWorld 2.0) | 81,8% | 80,7% | 74,0% | — | — |
O ponto que interessa ao bolso: o Opus 5.5 supera o Fable 5.1 na maioria desses testes custando 60% menos, o que inverte a lógica de "pague mais pelo melhor modelo" dentro da própria Anthropic. Segundo a empresa, no FrontierCode com esforço padrão ele bate o GPT-6 Astra a cerca de 20% do custo por tarefa, e no CursorBench fica 11 pontos à frente do GPT-5.6 Sol por aproximadamente um terço do preço. A própria Anthropic pede cautela com as margens: nesse patamar, alguns pontos de benchmark não viram diferença perceptível no uso real. E o GPT-6 Sol, lançado hoje, ainda não aparece nessas tabelas — a OpenAI divulgou outros números para ele, como 33,2% no AutomationBench 1.0.6 a US$ 0,27 por tarefa e 68,8% no DeepSWE 1.1 no esforço máximo.
O detalhe que pode bagunçar a sua conta
O Opus 5.5 passou a rodar a mesma classe de classificadores de segurança do Fable 5.1 para cibersegurança, biologia e desenvolvimento de modelos de fronteira. Quando um deles dispara, a Anthropic redireciona a requisição para um modelo mais antigo: pedidos marcados como cibersegurança costumam ir para o Opus 4.8; biologia e IA de fronteira, para o Opus 5. A empresa diz que continua sendo possível achar e corrigir bugs no próprio código com o 5.5. Para quem monta agente, porém, isso significa que uma chamada endereçada ao Opus 5.5 pode ser atendida por outro modelo, com outra capacidade — e outro preço — no meio de um fluxo de vários passos. Vale instrumentar o campo que identifica o modelo que respondeu, em vez de assumir que todas as chamadas foram para onde você mandou. Organizações verificadas podem pedir isenção do classificador de biologia pelo Life Sciences Verification Program, e a Anthropic diz que vai estender o programa de verificação em cibersegurança ao modelo nas próximas semanas.
Como escolher sem olhar só a etiqueta
Agente de programação que roda sozinho por horas: Opus 5.5. É onde a diferença de passos e de tokens aparece — e onde o preço por tarefa, não por token, decide.
Volume alto e tarefa simples (classificar, extrair, resumir): GPT-6 Luna, a US$ 0,02 por tarefa no nosso exemplo. Nenhum modelo de fronteira compete nessa faixa.
Meio-termo: GPT-6 Sol, pela metade do preço do Opus 5.5, desde que os seus testes mostrem qualidade suficiente — em programação agêntica a distância para o Opus ainda é grande.
Cache é o maior corte disponível: reaproveitar contexto custa US$ 0,20 por milhão no Opus 5.5 e no GPT-6 Sol, contra US$ 1 no GPT-6 Astra. Em agente que reenvia o mesmo prompt a cada passo, isso muda a conta mais do que trocar de modelo.
Nada disso substitui teste próprio: benchmark mede tarefa padronizada, não o seu problema. Antes de migrar carga de produção, rode a sua própria avaliação com os seus dados.
Preço e disponibilidade
O Opus 5.5 (model id claude-opus-5-5) já está na API da Anthropic, na AWS, no Google Cloud e no Azure, além do Claude Code e dos planos Pro, Max, Team e Enterprise — nesses, o uso entra na cota do plano, sem cobrança por token. O GPT-6 Sol e o GPT-6 Luna estão na API da OpenAI, com liberação gradual no ChatGPT Work e no Codex. Os preços em reais desta página são conversão direta do dólar, sem IOF nem impostos: a cobrança de ambas as empresas é em dólar, no cartão internacional, o que acrescenta 3,5% de IOF ao valor final para pessoa física no Brasil. Os detalhes do lançamento estão no anúncio oficial da Anthropic.




