Google acelera la cadencia Flash: tercer modelo en seis semanas
El 2 de septiembre Google presentó Gemini 3.8 Flash, su tercer modelo de la familia Flash en apenas seis semanas, según informó The Verge. Esta vez llegan dos variantes en un mismo lanzamiento: la versión estándar, descrita por la propia compañía como un modelo "obrero" para tareas agenticas, desarrollo de software y razonamiento multi-paso; y Gemini 3.8 Flash Cyber, una versión afinada para detectar y parchear vulnerabilidades, que se entrega solo a "defensores de confianza" a través del nuevo programa Fairwind.
El movimiento confirma una estrategia de cadencia corta y precios agresivos. Ars Technica destacó que Google no ha publicado un modelo frontier de la línea Pro desde principios de 2026, lo que ha alimentado las dudas sobre si veremos finalmente Gemini 3.5 Pro. Mientras tanto, la familia Flash se ha convertido en el vehículo principal de distribución y precio de Google en el segmento de IA aplicada.
Qué trae 3.8 Flash frente a 3.7
Google sostiene que 3.8 Flash ofrece "saltos significativos" sobre 3.7 en ingeniería de software, tareas agenticas y razonamiento multi-paso, según el CEO Sundar Pichai. La compañía publicó varios benchmarks para respaldarlo:
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidad- DeepSWE v1.1: supera a la mayoría de modelos frontier más grandes en resolución autónoma de problemas de ingeniería de extremo a extremo.
- Vals Finance Agent V2 y Harvey's Legal Agent Benchmark: supera a 3.7 Flash y a otros modelos frontier en flujos de trabajo legales y financieros.
- HLE-Verified (Humanity's Last Exam): 54,9 % en razonamiento multi-paso a través de STEM, humanidades y campos profesionales.
En Agent Arena de Arena.ai, 3.8 Flash debutó en el puesto 14, por encima de DeepSeek-V4-Pro, mientras que 3.7 Flash aparece en el puesto 32; en Text Arena entró en el 7, por delante de Claude Opus 5 y del propio 3.7 Flash, según datos compartidos por VentureBeat.
El modelo admite ventana de contexto de 1 millón de tokens y un límite de salida de 64.000 tokens, e ingiere texto, imágenes, audio, video y PDF. Google introdujo además niveles de "esfuerzo" ajustables (bajo, medio y alto, con medio como valor por defecto) que permiten a los desarrolladores mover la aguja entre coste, latencia y calidad.
Cuánto cuesta y por qué importa el precio
El precio introductorio se mantiene igual que en 3.7 Flash: 0,75 USD por millón de tokens de entrada y 3,75 USD por millón de tokens de salida, disponible hasta el 31 de diciembre de 2026. A partir del 1 de enero de 2027, la tarifa regular pasará a 1,50 USD / 7,50 USD, según la documentación para desarrolladores recogida por Unite.ai.
Artificial Analysis, citada por The Verge, apunta un matiz importante: aunque el precio por token no cambió, el coste real por tarea sube alrededor de un 40 % frente a 3.7 Flash porque el nuevo modelo consume un 30 % más de tokens de salida y completa más turnos en evaluaciones agenticas. Google lo advierte explícitamente: "3.8 Flash trabaja más duro", con pasos extra de razonamiento y llamadas iterativas a herramientas.
Para founders, esto significa que 3.7 Flash sigue siendo una opción válida: Google confirma que lo mantiene "totalmente soportado para cargas de trabajo donde prima la eficiencia". En la práctica, conviene probar ambos y medir coste por tarea completada, no solo por token.
Gemini 3.8 Flash Cyber y el programa Fairwind
La variante 3.8 Flash Cyber está afinada para descubrimiento y parcheo autónomo de vulnerabilidades. El acceso inicial se limita a "defensores de confianza" dentro del Fairwind Program, una iniciativa de Google que prioriza a autoridades gubernamentales, operadores de infraestructura crítica y mantenedores de software. The Verge reportó que el programa cuenta con 650 miembros, entre ellos CrowdStrike y el Center for Internet Security, y que además del modelo entrega el agente CodeMender, capaz de localizar y corregir vulnerabilidades de forma autónoma.
En sus benchmarks de ciberseguridad, Google reportó:
- CyberGym: rendimiento "nivel frontier" en descubrimiento autónomo de vulnerabilidades, por encima de 3.5 Flash Cyber y de modelos significativamente más grandes.
- Benchmark interno en 20 lenguajes de programación: tasa de éxito superior al 70 %.
- CWE-Bench (parcheo): pass@1 del 47,2 % frente al 47,8 % de un modelo frontier líder, con un coste muy inferior.
- Chrome: 2,6 veces más parches correctos en vulnerabilidades que los mejores modelos comerciales más grandes.
- Wiz: 7,5 %–9,7 % más recall en su benchmark interno de pentesting, a un coste 2,3–5,2 veces menor que los modelos frontier líderes.
- Google Cloud Vulnerability Research: descubrimiento de una vulnerabilidad crítica foundational en menos de 2 horas, un proceso que normalmente lleva meses.
Doug Turner, director de ingeniería de Chrome, describió en un vídeo una "apocalipsis de vulnerabilidades" en los últimos meses por la IA generativa: "de un día para otro vimos un crecimiento exponencial en el número de vulnerabilidades reportadas". Entre los hallazgos del nuevo modelo hay un bug en Chromium y Chrome que llevaba 13 años sin ser detectado, pese a haber pasado por "docenas, si no cientos" de revisiones de ingeniería.
La variante Cyber trae además una batería de salvaguardas más permisivas solo para uso defensivo y protecciones reforzadas contra prompt injection (medidas por Gray Swan), además de controles frente a uso indebido en dominios CBRN (químico, biológico, radiológico y nuclear) y ciberataque ofensivo.
Dónde probarlo ya
3.8 Flash está disponible de forma inmediata en Gemini Enterprise, en la API de Gemini vía Google AI Studio, en Google Antigravity (el entorno agent-first de Google, donde ahora corre por defecto), en Android Studio y en Stitch para generación de interfaces. Los suscriptores a Google AI Pro y Ultra también pueden usarlo desde la app de Gemini, AI Mode en Search y Gemini en Google Sheets. La variante Cyber no es de acceso general: las organizaciones pueden solicitar entrada al programa Fairwind.
Qué significa esto para tu startup
La jugada de Google responde a dos presiones de mercado simultáneas. Por un lado, los laboratorios rivales (Anthropic, DeepSeek y otros) han bajado precios en los últimos meses para mantener el compromiso empresarial con herramientas de IA, como recuerda Ars Technica. Por otro, los modelos grandes se han vuelto demasiado caros para escanear bases de código completas, justo cuando la IA generativa ha multiplicado la superficie de ataque y el volumen de vulnerabilidades reportadas.
Para founders, hay tres implicaciones prácticas:
- Construir agentes ya no es prohibitivamente caro. 3.8 Flash iguala o supera a modelos frontier en benchmarks de ingeniería de software y razonamiento multi-paso a una fracción del precio. Si tu producto depende de agentes, el cálculo unitario mejora. Eso sí, mide coste por tarea completada, no por token, porque la versión "trabaja más duro" y gasta más por consulta.
- El coste de la seguridad baja, pero no desaparece. Para equipos pequeños, hallazgos como el bug de 13 años en Chrome o los tiempos de descubrimiento inferiores a 2 horas sugieren que vale la pena explorar 3.8 Flash Cyber en el flujo de revisión, o bien Fairwind si operas infraestructura crítica. Para el resto, mantenerse al día con CodeQL, dependencias y SCA sigue siendo la base.
- La estrategia Flash es la apuesta de Google en el segmento de aplicación. Ante la ausencia de un nuevo Pro y con tres Flashes en seis semanas, Google está compitiendo por defecto en el terreno de coste-rendimiento, donde se decide buena parte de la adopción real. Si tu stack depende de Gemini, evalúa 3.8 frente a 3.7 antes de cambiar.
Acciones concretas para esta semana
- Audita tu coste por tarea agentica. Si ya usas Gemini 3.7 Flash en producción, reproduce tres flujos representativos con 3.8 Flash y compara coste total por tarea finalizada, latencia y tasa de éxito. Decide con números, no con benchmarks.
- Revisa tu política de seguridad con IA. Si gestionas código propio, prioriza integrar herramientas de análisis estático y SCA con un LLM encima para priorización. Si eres proveedor de infraestructura crítica, evalúa solicitar acceso a Fairwind; el listón de entrada es alto pero el coste por hallazgo baja varios órdenes de magnitud.
- Cierra tu stack antes de fin de año. El precio introductorio caduca el 31 de diciembre de 2026 y el salto al precio regular duplica el coste por token. Si 3.8 Flash demuestra ser tu modelo de producción, planifica la migración de prompts y pipelines antes de esa fecha.
Fuentes
- Google's Gemini 3.8 Flash is built for agents, while its Cyber twin hunts vulnerabilities — VentureBeat
- Google says its new Gemini 3.8 Flash model 'works harder' but might cost more — The Verge
- Google releases Gemini 3.8 Flash, its third Flash model in six weeks — Ars Technica
- Google Launches Gemini 3.8 Flash With Cybersecurity Variant — Unite.ai
- Google Completes Acquisition of Wiz — Google Cloud Press Corner (marzo de 2026)
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidad













