Google lanzó tres modelos de la serie Flash simultáneamente en julio de 2026: Gemini 3.6 Flash para razonamiento multimodal y agentes, 3.5 Flash-Lite para trabajo de alto volumen y baja latencia, y 3.5 Flash Cyber, una variante enfocada en la remediación de vulnerabilidades.
La decisión estratégica central: el precio. Gemini 3.6 Flash cuesta US$ 1,50/1M tokens de entrada y US$ 7,50/1M tokens de salida — por debajo de los US$ 1,50/US$ 9,00 de la versión 3.5 Flash anterior. Combinado con una mayor eficiencia de tokens, el costo total por tarea agéntica disminuye hasta un 65% en tareas de ingeniería de largo horizonte.
Los números que importan
En el benchmark DeepSWE, el 3.6 Flash sube del 37% (versión 3.5) al 49% — un aumento de 12 puntos porcentuales. En MLE-Bench, sube del 49,7% al 63,9%. En OSWorld-Verified — benchmark de uso de computadora — sube del 78,4% al 83,0%.
El 3.5 Flash-Lite, enfocado en volumen, procesa 350 tokens de salida por segundo — el más rápido de la serie 3.5. Precio: US$ 0,30/1M tokens de entrada y US$ 2,50/1M tokens de salida.
El cambio arquitectónico más relevante
Google integró el computer use directamente en la Gemini API y en Gemini Enterprise como una herramienta nativa del lado del cliente — eliminando el software intermediario personalizado que los ingenieros antes tenían que construir para permitir que los modelos operaran sobre un sistema operativo.
Ambos modelos tienen una ventana de contexto de 1 millón de tokens y un límite de salida de 64.000 tokens. Knowledge cutoff: marzo de 2026.
El elefante en la habitación
El Gemini 3.5 Pro — modelo insignia que Google había señalado para el verano de 2026 — no fue lanzado. El Gemini 3.1 Pro, su antecesor, fue lanzado en febrero de 2026. Los rivales OpenAI y Anthropic han lanzado varias generaciones de modelos insignia más potentes desde entonces. Logan Kilpatrick de Google respondió en X: "Gemini 3.5 Pro está actualmente en pruebas con socios y planeamos ponerlo a disposición de forma amplia tan pronto como esté listo."

