A Anthropic lançou nesta terça-feira (22) o Claude Opus 5.5 por US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de saída — 20% menos que o Opus 5 e a metade do preço do Fable 5.1, o modelo mais caro da casa - que ele superou em vários testes de programação agêntica. Horas depois, a OpenAI respondeu com o GPT-6 Sol (US$ 2 / US$ 10) e o GPT-6 Luna (US$ 0,10 / US$ 0,50), ambos 50% mais baratos que os equivalentes da geração 5.6. Em um único dia, o custo de rodar um modelo de fronteira caiu para todo mundo — e a conta de quem usa API mudou de forma relevante. Abaixo, o preço de cada modelo em dólar e em real, quanto sai uma tarefa típica, o que cada um entrega nos benchmarks e um detalhe do Opus 5.5 que pode bagunçar a sua planilha.

Adicione ao Google Notícias
Neste artigo
  1. Os preços, lado a lado
  2. Quanto custa uma tarefa de verdade
  3. O que cada um entrega pelo que cobra
  4. O detalhe que pode bagunçar a sua conta
  5. Como escolher sem olhar só a etiqueta
  6. Preço e disponibilidade

Os preços, lado a lado

Valores por milhão de tokens, convertidos pelo dólar a R$ 5,10 (22/09). Leitura de cache é o que você paga para reaproveitar um contexto já enviado — em agente que repete o mesmo prompt a cada passo, essa linha costuma ser a que mais pesa.

ModeloEntrada (US$ / R$)Saída (US$ / R$)Leitura de cache (US$)Contexto
Claude Opus 5.54,00 / R$ 20,4120,00 / R$ 102,030,201 milhão
Claude Opus 55,00 / R$ 25,5125,00 / R$ 127,540,501 milhão
Claude Fable 5.110,00 / R$ 51,0250,00 / R$ 255,070,251 milhão
GPT-6 Astra10,00 / R$ 51,0250,00 / R$ 255,071,001,05 milhão
GPT-6 Sol2,00 / R$ 10,2010,00 / R$ 51,020,201,05 milhão
GPT-6 Luna0,10 / R$ 0,510,50 / R$ 2,550,011,05 milhão

No Opus 5.5 a escrita de cache também caiu, de US$ 6,25 para US$ 5 por milhão, e o processamento em lote (Batch API) sai pela metade: US$ 2 e US$ 10. Há ainda um modo rápido, até 2,5 vezes mais veloz, por US$ 8 / US$ 40 — o dobro do preço padrão. Do lado da OpenAI, o corte do Sol e do Luna é permanente, não promocional: o GPT-5.6 Sol custava US$ 4 / US$ 20 e o Luna, US$ 0,20 / US$ 1,20.

Quanto custa uma tarefa de verdade

Preço por token diz pouco sozinho. Uma conta simples ajuda: uma tarefa de programação que envia 100 mil tokens de contexto (um punhado de arquivos, histórico e instruções) e devolve 20 mil tokens de resposta, sem cache:

ModeloCusto da tarefa (US$)Em reais
GPT-6 Luna0,02R$ 0,10
GPT-6 Sol0,40R$ 2,04
Claude Opus 5.50,80R$ 4,08
Claude Opus 51,00R$ 5,10
Claude Fable 5.12,00R$ 10,20
GPT-6 Astra2,00R$ 10,20

A Anthropic afirma que a economia real do Opus 5.5 fica perto de 40%, não 20%, porque o modelo gasta menos tokens para concluir a mesma tarefa e gera texto mais de 30% mais rápido. Clientes citados pela empresa dão números na mesma direção: a Box relatou consumo de cerca de um terço dos tokens do Opus 5 com respostas 40% menos prolixas; a GitHub disse que ele terminou mais tarefas de terminal que o Opus 5 em menos da metade dos passos; a Deloitte apontou que o Opus 5.5 no esforço mais baixo encontrou 72% dos bugs conhecidos em revisão de código, contra 56% do Opus 5 no esforço alto. São avaliações de clientes, não testes independentes — mas todas apontam para o mesmo lugar: menos passos, menos tokens, conta menor.

O que cada um entrega pelo que cobra

BenchmarkOpus 5.5Fable 5.1Opus 5GPT-6 AstraGPT-5.6 Sol
Programação agêntica (Terminal-Bench 4.0)66,4%55,8%52,3%57,9%37,3%
Programação agêntica (FrontierCode v1.1)54,4%50,3%48,0%53,3%47,5%
Programação no editor (CursorBench 4.0)57,8%51,8%46,6%41,7%
Trabalho de escritório (GDPval-AA v2.1)18461735170815421588
Fluxos de negócio (AutomationBench)40,0%31,4%26,9%41,4%28,8%
Raciocínio (Humanity's Last Exam)67,7%65,6%63,6%57,2%
Uso de computador (OSWorld 2.0)81,8%80,7%74,0%

O ponto que interessa ao bolso: o Opus 5.5 supera o Fable 5.1 na maioria desses testes custando 60% menos, o que inverte a lógica de "pague mais pelo melhor modelo" dentro da própria Anthropic. Segundo a empresa, no FrontierCode com esforço padrão ele bate o GPT-6 Astra a cerca de 20% do custo por tarefa, e no CursorBench fica 11 pontos à frente do GPT-5.6 Sol por aproximadamente um terço do preço. A própria Anthropic pede cautela com as margens: nesse patamar, alguns pontos de benchmark não viram diferença perceptível no uso real. E o GPT-6 Sol, lançado hoje, ainda não aparece nessas tabelas — a OpenAI divulgou outros números para ele, como 33,2% no AutomationBench 1.0.6 a US$ 0,27 por tarefa e 68,8% no DeepSWE 1.1 no esforço máximo.

O detalhe que pode bagunçar a sua conta

O Opus 5.5 passou a rodar a mesma classe de classificadores de segurança do Fable 5.1 para cibersegurança, biologia e desenvolvimento de modelos de fronteira. Quando um deles dispara, a Anthropic redireciona a requisição para um modelo mais antigo: pedidos marcados como cibersegurança costumam ir para o Opus 4.8; biologia e IA de fronteira, para o Opus 5. A empresa diz que continua sendo possível achar e corrigir bugs no próprio código com o 5.5. Para quem monta agente, porém, isso significa que uma chamada endereçada ao Opus 5.5 pode ser atendida por outro modelo, com outra capacidade — e outro preço — no meio de um fluxo de vários passos. Vale instrumentar o campo que identifica o modelo que respondeu, em vez de assumir que todas as chamadas foram para onde você mandou. Organizações verificadas podem pedir isenção do classificador de biologia pelo Life Sciences Verification Program, e a Anthropic diz que vai estender o programa de verificação em cibersegurança ao modelo nas próximas semanas.

Como escolher sem olhar só a etiqueta

  • Agente de programação que roda sozinho por horas: Opus 5.5. É onde a diferença de passos e de tokens aparece — e onde o preço por tarefa, não por token, decide.

  • Volume alto e tarefa simples (classificar, extrair, resumir): GPT-6 Luna, a US$ 0,02 por tarefa no nosso exemplo. Nenhum modelo de fronteira compete nessa faixa.

  • Meio-termo: GPT-6 Sol, pela metade do preço do Opus 5.5, desde que os seus testes mostrem qualidade suficiente — em programação agêntica a distância para o Opus ainda é grande.

  • Cache é o maior corte disponível: reaproveitar contexto custa US$ 0,20 por milhão no Opus 5.5 e no GPT-6 Sol, contra US$ 1 no GPT-6 Astra. Em agente que reenvia o mesmo prompt a cada passo, isso muda a conta mais do que trocar de modelo.

  • Nada disso substitui teste próprio: benchmark mede tarefa padronizada, não o seu problema. Antes de migrar carga de produção, rode a sua própria avaliação com os seus dados.

Preço e disponibilidade

O Opus 5.5 (model id claude-opus-5-5) já está na API da Anthropic, na AWS, no Google Cloud e no Azure, além do Claude Code e dos planos Pro, Max, Team e Enterprise — nesses, o uso entra na cota do plano, sem cobrança por token. O GPT-6 Sol e o GPT-6 Luna estão na API da OpenAI, com liberação gradual no ChatGPT Work e no Codex. Os preços em reais desta página são conversão direta do dólar, sem IOF nem impostos: a cobrança de ambas as empresas é em dólar, no cartão internacional, o que acrescenta 3,5% de IOF ao valor final para pessoa física no Brasil. Os detalhes do lançamento estão no anúncio oficial da Anthropic.