Google lanzó Gemini 3.6 Flash y 3.5 Flash-Lite, más rápidos y baratos que sus antecesores, junto a un modelo especializado en ciberseguridad, 3.5 Flash Cyber. 3.6 Flash reduce 17% los tokens de salida frente a 3.5 Flash; 3.5 Flash-Lite corre a 350 tokens por segundo. Ambos ya están disponibles y bajan el costo de generar contenido o correr agentes.
Qué cambia en la línea Flash
Google anunció los tres modelos el 21 de julio de 2026. Gemini 3.6 Flash es el sucesor directo de 3.5 Flash: mejor en código, trabajo de conocimiento y tareas multimodales. Según el Artificial Analysis Index citado por Google, consume 17% menos tokens de salida que su antecesor para completar la misma tarea, y en benchmarks puntuales como DeepSWE (de Datacurve) la reducción llega a 65%. El precio también baja frente a 3.5 Flash: US$1,50 por millón de tokens de entrada y US$7,50 por millón de tokens de salida, según el anuncio de Google DeepMind.
En pruebas de código y uso de computador, 3.6 Flash supera a 3.5 Flash: 49% contra 37% en DeepSWE, 63,9% contra 49,7% en MLE Bench y 83,0% contra 78,4% en OSWorld-Verified. El uso de computador (computer use) ahora es una herramienta nativa disponible vía Gemini API y Gemini Enterprise, sin integración custom.
3.5 Flash-Lite es el modelo más veloz de la serie 3.5: 350 tokens de salida por segundo, a US$0,30 por millón de tokens de entrada y US$2,50 por millón de salida. Supera a su antecesor 3.1 Flash-Lite y, en varias pruebas de código y agentes, incluso a 3 Flash: 54,2% contra 49,6% en SWE-Bench Pro y 74,0% contra 65,1% en OSWorld-Verified.
3.5 Flash Cyber queda fuera de este cálculo para marketing: es un modelo afinado para encontrar y parchar vulnerabilidades dentro de CodeMender, el agente de seguridad de Google, y la compañía lo reserva a gobiernos y socios de confianza en un piloto de acceso limitado.
| Modelo | Precio por millón de tokens (entrada / salida) | Fortaleza | Mejor para |
|---|---|---|---|
| Gemini 3.6 Flash | US$1,50 / US$7,50 | Menos pasos de razonamiento y llamadas a herramientas por tarea | Redacción larga, análisis de documentos, tareas de conocimiento |
| Gemini 3.5 Flash-Lite | US$0,30 / US$2,50 | 350 tokens de salida por segundo | Agentes de alto volumen, búsqueda, soporte, procesamiento masivo |
3.6 Flash suma además refuerzos de seguridad frente a jailbreaks en los dominios químico, biológico, radiológico, nuclear y de ciberofensiva, entrenado a la vez para minimizar rechazos en usos legítimos. Google adelantó que Gemini 3.5 Pro sigue en pruebas con socios y que ya inició el entrenamiento de Gemini 4, sin fecha de lanzamiento.
La lectura: la carrera ya no es por el modelo más grande
Este lanzamiento confirma una tendencia que ya veníamos siguiendo en julio: la competencia entre OpenAI, Anthropic y Google se mueve al costo por tarea, no solo al benchmark. OpenAI propuso hace días medir la IA por trabajo logrado y no por licencias; Google responde bajando el precio y subiendo la eficiencia de sus modelos de mayor volumen. Eso favorece a las marcas que ya operan agentes de soporte o generan contenido a escala: pueden mover tareas repetitivas a Flash-Lite y reservar el modelo más caro solo para lo que exige calidad. Complica, en cambio, a quienes optimizaron sus pipelines para el pricing anterior sin dejar margen para recalcular: con tokens de salida costando 5 veces más que los de entrada en 3.6 Flash, un flujo de contenido largo mal dimensionado sigue siendo caro aunque el modelo sea más eficiente.
Qué revisar antes de migrar tus workflows de contenido o soporte
- Recalcula el costo real por tarea, no por token: si generas textos largos (posts, fichas de producto, reportes), la baja de 17% en tokens de salida pesa más en tu factura que el precio nominal por millón de tokens.
- Separa las tareas por volumen: pon soporte de alto tráfico y búsquedas de agentes en 3.5 Flash-Lite (350 tokens por segundo, precio más bajo) y deja 3.6 Flash para redacción, análisis de documentos o tareas que exigen más profundidad.
- Corre tu propio benchmark antes de mover producción: los números de Google miden código, agentes y uso de computador, no necesariamente tus prompts de marketing o soporte al cliente.
- Revisa si ya necesitas "computer use": ahora es una herramienta nativa en la API, útil si tienes agentes que deben operar un navegador o una interfaz sin construir integración propia.
- Si tu agente atiende clientes o publica en redes, el refuerzo contra jailbreaks de 3.6 Flash reduce el riesgo de que alguien lo manipule para salirse del guion de marca.
Preguntas frecuentes sobre Gemini 3.6 Flash y 3.5 Flash-Lite
¿Cuánto cuesta usar Gemini 3.6 Flash?
US$1,50 por millón de tokens de entrada y US$7,50 por millón de tokens de salida, según el anuncio de Google del 21 de julio de 2026.
¿En qué se diferencia 3.5 Flash-Lite de 3.6 Flash?
Flash-Lite prioriza velocidad y costo (350 tokens de salida por segundo, US$0,30/US$2,50 por millón de tokens) para tareas de alto volumen; 3.6 Flash prioriza calidad en código, análisis de documentos y trabajo de conocimiento, a mayor precio.




