O GPT-5.6 Sol ganhou um modo de execução chamado Fast Mode, que a OpenAI descreve como até 14 vezes mais rápido que o padrão, em troca de dobrar o preço por token.

Adicione ao Google Notícias
Neste artigo
  1. O que muda com o Fast Mode no GPT-5.6 Sol?
  2. Quanto custa usar Sol, Terra e Luna com os novos preços?
  3. Quem tem acesso ao GPT-5.6 e onde o Fast Mode entra nisso?
  4. GPT-5.6 Sol mudou também dentro do ChatGPT; e o Luna ficou ilimitado
  5. Acelerador para poucos ou ferramenta essencial?

Na prática, o Fast Mode entra no lugar do antigo Priority Processing na API e empurra o GPT-5.6 Sol para o topo da fila como opção de baixa latência. Segundo a OpenAI, o modelo roda com velocidade 2,5 vezes maior que a configuração normal, mas ajustes de infraestrutura no pipeline inteiro levam a ganhos de tempo de resposta de até 14 vezes em cenários específicos. O custo sobe na mesma proporção: quem ativa o modo paga o dobro da tarifa normal do Sol em cada chamada.

O que muda com o Fast Mode no GPT-5.6 Sol?

O Fast Mode funciona como um interruptor de desempenho para quem usa o GPT-5.6 Sol via API. Ele substitui o Priority Processing e vira o caminho oficial para reduzir fila e latência no modelo mais sofisticado da família. A OpenAI descreve o pacote como um conjunto de otimizações internas, que rendem velocidade 2,5 vezes maior, somadas a ajustes de priorização que elevam o ganho total a respostas até 14 vezes mais rápidas que o modo padrão em certos fluxos.

A OpenAI não anuncia mudança de capacidade: é o mesmo Sol, com o mesmo foco em coding complexo, pesquisa em cibersegurança e tarefas agentivas longas. A diferença recai no SLA implícito. Quem ativa o Fast Mode assume que vai pagar mais caro em troca de baixa latência, em vez de priorizar economia em workloads sensíveis a preço. Para quem roda assistente em tempo real, trading, monitoramento de segurança ou qualquer UX que dependa de resposta quase instantânea, esse tipo de knob faz mais sentido do que operar preso a um único perfil de fila.

Tela de anúncio do lançamento global do GPT-5.6
OpenAI expandiu o acesso global à família GPT-5.6 após um período de testes restritos (Imagem: reprodução/tecmundo.com.br)

Quanto custa usar Sol, Terra e Luna com os novos preços?

Enquanto o Sol recebe o Fast Mode sem desconto, o choque de tabela recai nos modelos abaixo. A OpenAI cortou 80% do preço do GPT-5.6 Luna e reduziu o GPT-5.6 Terra em 20%. De acordo com a tabela mais recente, o Luna passa a custar US$ 0,20 (R$ 1,02) por milhão de tokens de entrada e US$ 1,20 (R$ 6,12) por milhão de tokens de saída. O Terra sai por US$ 2 (R$ 10,19) por milhão de tokens de entrada e US$ 12 (R$ 61,16) por milhão de tokens de saída.

O GPT-5.6 Sol mantém o mesmo preço base apresentado no lançamento da linha: US$ 5 por milhão de tokens de entrada e US$ 30 por milhão de tokens de saída. Com o Fast Mode ligado, essa conta dobra. Ou seja, o modo rápido eleva o custo para o equivalente a US$ 10 de entrada e US$ 60 de saída por milhão de tokens. O recurso fica claramente direcionado a workloads críticos, não a qualquer micro-serviço rodando trivia. Para Luna e Terra, a combinação de queda agressiva de preço e performance comparável a modelos como Opus 5 (Low) e Gemini 3.6 Flash pressiona concorrentes em cenários de grande volume.

Página destacando corte de preços do GPT-5.6 Luna e Terra
Luna e Terra ficaram mais baratos enquanto o GPT-5.6 Sol ganhou o Fast Mode na API (Imagem: reprodução/tecmundo.com.br)

Quem tem acesso ao GPT-5.6 e onde o Fast Mode entra nisso?

A família GPT-5.6 começou a aparecer em junho de 2026 em uma prévia limitada para cerca de 20 parceiros, dentro de um escopo compartilhado com o governo dos EUA sob o Preparedness Framework, que classifica Sol, Terra e Luna como modelos de alto risco cibernético, biológico e químico. Após a revisão solicitada por uma ordem executiva americana, a OpenAI liberou a linha globalmente em julho, abrindo o acesso a qualquer usuário do ChatGPT e da API.

No chat, o GPT-5.6 Sol virou o modelo premium, voltado a tarefas pesadas; o Terra e o Luna entraram como opções mais baratas para fluxos do dia a dia e alto volume. Usuários gratuitos e assinantes do ChatGPT Go acessam o GPT-5.6 Terra em ferramentas como o ChatGPT Work e o Codex, enquanto quem paga pelos planos Plus, Pro, Business e Enterprise escolhe entre Terra e Luna. O Fast Mode fica restrito à API: todos os modelos 5.6 seguem disponíveis em chat, apps mobile e desktop, mas só integrações diretas via API conseguem acionar esse botão de velocidade no Sol.

GPT-5.6 Sol mudou também dentro do ChatGPT; e o Luna ficou ilimitado

O modo rápido na API não é a única alteração recente no Sol. Em 6 de agosto, a OpenAI reconfigurou o GPT-5.6 Sol dentro do ChatGPT para juntar respostas rápidas e raciocínio profundo em um único modelo. Em vez de escolher entre um modo instantâneo e um modo mais lento, assinantes Plus e Pro passaram a usar um controle deslizante que define quanto esforço o Sol aplica em cada resposta. A empresa descreve o comportamento atualizado como mais direto, com menos formatação desnecessária e mais disposição para corrigir o usuário. Essa mudança vale apenas para o chat; o Sol usado em Work e Codex continua segmentado.

No plano gratuito e no ChatGPT Go, a virada segue por outra via. O GPT-5.6 Luna virou o modelo padrão e o limite de mensagens de texto caiu: o chat de texto passa a ser ilimitado, mantendo travas para upload de arquivo, geração de imagem e ferramentas fora do texto. Quem precisa de mais raciocínio encontra um botão Think, que segura a resposta por mais tempo para o Luna lidar com perguntas difíceis. A OpenAI também adicionou salvaguardas extras para menores, com bloqueio de roleplay romântico e filtros mais rígidos para conteúdo sensível. Para quem usa o ChatGPT no Brasil, isso implica acesso diário mais amplo sem cartão de crédito, enquanto o Fast Mode foca no outro extremo: empresas dispostas a pagar caro para espremer milissegundos.

Acelerador para poucos ou ferramenta essencial?

A combinação de Fast Mode com corte de preços em Luna e Terra aponta uma divisão clara: volume migra para baixo, urgência sobe para o topo. Quem constrói produto de massa, com muito token e pouca margem, tende a ancorar o fluxo em Luna e Terra e reservar o Sol para etapas realmente críticas — especialmente com o dobro do preço no modo rápido. Já quem vende serviço caro apoiado em latência baixa ganha um argumento concreto para embutir o repasse na fatura.

Enquanto a OpenAI aperta o funil de custo e velocidade, as regras de acesso seguem acopladas ao risco regulatório dos EUA. Sol, Terra e Luna continuam classificados como alta capacidade em cibersegurança, biologia e química, o que traz a possibilidade de novas exigências de compliance em setores como saúde e finanças a cada rodada de revisão. A velocidade chega com taxa dobrada por token e com uma camada extra de governança para quem decidir pisar fundo nesse acelerador.