O Google lançou em julho de 2026 três modelos da série Flash simultaneamente: o Gemini 3.6 Flash para raciocínio multimodal e agentes, o 3.5 Flash-Lite para trabalho de alto volume e baixa latência, e o 3.5 Flash Cyber, variante focada em remediação de vulnerabilidades.
A decisão estratégica central: preço. O Gemini 3.6 Flash custa US$ 1,50/1M tokens de input e US$ 7,50/1M tokens de output — abaixo dos US$ 1,50/US$ 9,00 da versão 3.5 Flash anterior. Combinado com maior eficiência de tokens, o custo total por tarefa agêntica cai em até 65% em tarefas de engenharia de longo horizonte.
Os números que importam
No benchmark DeepSWE, o 3.6 Flash sobe de 37% (versão 3.5) para 49% — alta de 12 pontos percentuais. No MLE-Bench, sobe de 49,7% para 63,9%. No OSWorld-Verified — benchmark de uso de computador — sobe de 78,4% para 83,0%.
O 3.5 Flash-Lite, focado em volume, processa 350 tokens de output por segundo — o mais rápido da série 3.5. Preço: US$ 0,30/1M tokens de input e US$ 2,50/1M tokens de output.
A mudança arquitetural mais relevante
O Google integrou o computer use diretamente na Gemini API e no Gemini Enterprise como ferramenta client-side nativa — eliminando o software intermediário customizado que engenheiros antes precisavam construir para permitir que modelos operassem sobre um sistema operacional.
Ambos os modelos têm janela de contexto de 1 milhão de tokens e limite de output de 64.000 tokens. Knowledge cutoff: março de 2026.
O elefante na sala
O Gemini 3.5 Pro — modelo flagship que o Google havia sinalizado para o verão de 2026 — não foi lançado. O Gemini 3.1 Pro, predecessor, foi lançado em fevereiro de 2026. Rivais OpenAI e Anthropic lançaram várias gerações de modelos flagship mais potentes desde então. Logan Kilpatrick do Google respondeu no X: "Gemini 3.5 Pro está atualmente em testes com parceiros e planejamos disponibilizá-lo amplamente assim que estiver pronto."

