O Google anunciou hoje novos modelos da linha Gemini, com foco em quem constrói agentes de IA em produção e precisa de mais eficiência no uso de tokens, menor latência e desempenho confiável em escala. Os lançamentos são o Gemini 3.6 Flash, o 3.5 Flash-Lite e o 3.5 Flash Cyber, todos construídos sobre a base do 3.5 Flash.

Adicione ao Google Notícias

3.6 Flash: o "cavalo de batalha" da empresa

O 3.6 Flash é apresentado como o modelo principal de trabalho, com avanços em programação, tarefas de conhecimento e desempenho multimodal. Ele foi construído diretamente a partir do feedback de desenvolvedores e clientes do 3.5 Flash, entregando ganhos de qualidade ao mesmo tempo em que melhora a eficiência.

Segundo o Google, com base no Artificial Analysis Index, o 3.6 Flash consome 17% menos tokens de saída que o 3.5 Flash e também usa menos etapas de raciocínio e menos chamadas de ferramentas para concluir fluxos de trabalho de várias etapas. Em alguns benchmarks, como o DeepSWE da Datacurve, a redução no uso de tokens chega a 65%.

gemini 3.6 flash grafico

A eficiência vem com preço menor. A US$1,50 por milhão de tokens de entrada e US$7,50 por milhão de tokens de saída, o 3.6 Flash reduz o custo total por tarefa executada por agentes, barateando tanto o desenvolvimento quanto a operação.

Os ganhos de desempenho aparecem em vários benchmarks:

  • Programação: no DeepSWE, o 3.6 Flash sobe para 49% ante 37% do 3.5 Flash, com mais precisão, menos edições indesejadas de código e menos loops de execução.

  • Pesquisa em ML: no MLE Bench, salta de 49,7% para 63,9%.

  • Uso de computador: no OSWorld-Verified, avança de 78,4% para 83,0% — e o uso de computador agora é uma ferramenta nativa via Gemini API e Gemini Enterprise.

  • Trabalho de conhecimento: no GDPval-AA v2, sobe de 1349 para 1421. Clientes como Hebbia e Harvey destacaram sua capacidade em tarefas multimodais, como leitura de documentos, análise de gráficos e dados e elaboração de relatórios.

  • Segurança reforçada

    O 3.6 Flash chega com salvaguardas ampliadas do Frontier Safety nos domínios químico, biológico, radiológico e nuclear (CBRN) e de uso ofensivo em cibersegurança, tornando o modelo substancialmente mais resistente a jailbreaks. Ao mesmo tempo, o modelo foi treinado para reduzir recusas em usos legítimos.

    3.5 Flash-Lite: velocidade e escala

    O 3.5 Flash-Lite é voltado a tarefas de baixa latência e alto volume, como busca com agentes e processamento de documentos. É o modelo mais rápido da série 3.5, rodando a 350 tokens de saída por segundo, segundo a Artificial Analysis. Custa US$0,30 por milhão de tokens de entrada e US$2,50 por milhão de tokens de saída, com qualidade bem superior à do 3.1 Flash-Lite.

    O modelo permite que os desenvolvedores ajustem os níveis de "raciocínio" (thinking levels): mínimos ou baixos para execução de baixo custo e alto volume, ou níveis mais altos para cargas com subagentes de várias etapas. Ele também passa a contar com uso de computador como ferramenta nativa.

    Nos benchmarks, o salto é expressivo: Terminal-Bench 2.1 (54% vs 31%), contexto longo no GDM-MRCR v2 (72,2% vs 60,1%) e execução de tarefas reais no GDPval-AA v2 (1140 vs 642). Em várias avaliações de agentes e programação, o 3.5 Flash-Lite chega a superar o 3 Flash, como no SWE-Bench Pro (54,2% vs 49,6%) e no OSWorld-Verified (74,0% vs 65,1%).

    3.5 Flash Cyber: encontrar e corrigir vulnerabilidades

    Os modelos de IA já se tornaram capazes de encontrar vulnerabilidades de segurança mais rápido do que os sistemas atuais conseguem corrigi-las. Para enfrentar isso, o Gemini 3.5 Flash Cyber é construído sobre o 3.5 Flash e ajustado para localizar e corrigir falhas de cibersegurança a um custo por token menor que o de modelos maiores.

    gemini 3.5 cyber graffico

    Dentro do CodeMender — que usa vários agentes 3.5 Flash Cyber trabalhando juntos para gerar um único relatório combinado —, o modelo atinge desempenho competitivo na fronteira no benchmark CyberGym.

    Pela natureza de "uso duplo" da tecnologia, o Google adotou uma implantação cuidadosa: o modelo ficará disponível exclusivamente para governos e parceiros de confiança via CodeMender, dentro de um programa piloto de acesso limitado, dando aos defensores vantagem para corrigir vulnerabilidades críticas antes que sejam exploradas.

    Preços foram reduzidos - Tabela de preços

    gemini novos preços

    Disponibilidade e o que vem a seguir

    O 3.6 Flash e o 3.5 Flash-Lite já estão disponíveis a partir de hoje. Para desenvolvedores, chegam via Gemini API no Google AI Studio e no Android Studio, com o 3.6 Flash também no Google Antigravity. Para empresas, estão no Gemini Enterprise Agent Platform, e para todos os usuários no app Gemini — com o 3.5 Flash-Lite chegando também à Busca do Google.

    Por fim, o Google adiantou seus próximos passos: o Gemini 3.5 Pro já está em testes com parceiros e deve ser liberado em breve, enquanto a equipe já iniciou o pré-treinamento mais ambicioso da empresa até agora, voltado ao Gemini 4.