A SpaceXAI lançou nesta segunda-feira (21) o Grok 4.7, novo modelo principal da empresa de Elon Musk, com 500 mil tokens de contexto, raciocínio configurável em quatro níveis e preço de US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de saída na API própria — na OpenRouter, roteadora que já lista o modelo, sai por US$ 1,60 e US$ 4,80. O anúncio oficial descreve o 4.7 como "o modelo para código e todo o resto", treinado com uma rodada mais longa de aprendizado por reforço em tarefas que levam "muitas horas" para concluir, e reporta 38% no Terminal-Bench 4.0, contra 20,3% do Grok 4.6. Musk prometera em 2 de setembro que o modelo sairia "em 10 dias" e "superaria todos os modelos atuais"; a primeira parte atrasou uma semana, e a segunda não se confirma nas medições independentes.
Adicione ao Google NotíciasNeste artigo
O que muda em relação ao Grok 4.6
Segundo a SpaceXAI, o 4.7 usa uma base nova e maior — Musk citou 2,1 trilhões de parâmetros, contra 1,5 trilhão do 4.6 — e passou por treinamento suplementar com dados internos da SpaceX, o que o empresário chama de corpus "único" para engenharia do mundo real. A empresa diz que o modelo verifica melhor o próprio trabalho, administra melhor contextos longos e entende nativamente o Grok Bot, seu agente para desenvolvedores. O corte de conhecimento é maio de 2026, o modelo aceita texto, imagens e arquivos, e o raciocínio é obrigatório, com esforço ajustável de "low" a "xhigh". Há uma variante rápida, com o dobro da velocidade pelo dobro do preço, e uso gratuito pelo Grok Build. O ritmo de lançamentos da SpaceXAI é o mais acelerado do setor: o Grok 4.5 saiu em julho, o 4.6 em 12 de agosto e o 4.7 cinco semanas depois, cada um vendido ao mesmo preço do anterior.
| Benchmark (números da SpaceXAI) | Grok 4.6 | Grok 4.7 |
|---|---|---|
| Terminal-Bench 4.0 (agentes em terminal) | 20,3% | 38,0% |
| CursorBench 4.0 (programação no Cursor) | 40,4% | 46,3% |
| AA Briefcase v1.1 (trabalho de escritório) | 1.546 | 1.657 |
| DeepSWE v1.1 | — | 71,0% |
| HealthBench Professional | — | 56,7% |
| Contexto | 500 mil tokens | 500 mil tokens (saída até 450 mil) |
| Preço na API (entrada / saída, por 1 M de tokens) | US$ 2 / US$ 6 | US$ 2 / US$ 6 (dobra acima de 200 mil tokens de entrada) |
Os testes independentes contam outra história
A Artificial Analysis, que roda os benchmarks por conta própria, deu ao Grok 4.7 (esforço "high") 46 pontos no seu Índice de Inteligência — bem acima da mediana de 24 dos modelos de raciocínio na mesma faixa de preço, mas sem a liderança prometida. No Terminal-Bench 4.0, o laboratório mediu 26%, contra cerca de 60% do GPT-6 Astra, da OpenAI, e 55% do Claude Fable 5.1, da Anthropic; a diferença para os 38% oficiais vem do ambiente de teste, das ferramentas e do orçamento de tokens, que mudam muito o resultado nesse tipo de prova. A leitura do mercado é que o 4.7 é competitivo em preço — custa uma fração dos rivais de fronteira — e em tarefas de escritório, mas continua atrás em agentes de programação de longa duração, justamente a especialidade que a SpaceXAI destacou no anúncio.
Segurança, disponibilidade e o que esperar no Brasil
A empresa diz ter reconstruído a camada de proteções do modelo e reporta 62,4% em um benchmark de biossegurança e 3,3% de pedidos arriscados aceitos no HackerBench. O Grok 4.7 está disponível na API da SpaceXAI, no Cursor, no Grok Build e em roteadores como a OpenRouter, que cobra em dólar e aceita cartão brasileiro; a chegada ao chatbot Grok no X e ao app não foi detalhada no anúncio. Para desenvolvedores brasileiros, o atrativo é o custo: a US$ 2 por milhão de tokens de entrada (cerca de R$ 10,30 pelo câmbio atual), o modelo custa menos da metade dos concorrentes de topo, e a janela de 500 mil tokens comporta bases de código inteiras em um único pedido — desde que a tarefa não exija a resistência de horas que os testes independentes ainda não confirmam.




