TIEMPO DE LECTURA: 8 min

Gemini 3.8 Flash: Google mejora su IA de código y ciberdefensa

Foto de Robinson Lalos
Robinson Lalos
Editor Senior
Gemini 3.8 Flash: Google mejora su IA de código y ciberdefensa

Gemini 3.8 Flash: el caballo de batalla de Google aterriza en Search y en las salas de ciberdefensa

Google ha presentado Gemini 3.8, y lo ha presentado a lo Flash: dos variantes sobre el mismo núcleo de inteligencia, una para el trabajo pesado diario y otra reservada a defensores verificados. Es el tercer lanzamiento Flash en seis semanas —la 3.7 llegó hace solo tres— y la apuesta es clara: mantener el rendimiento de frontera con el precio de la gama media. El resultado: 3.8 Flash es el modelo más capaz de Google en razonamiento y código "al mismo precio y velocidad que la 3.7", y 3.8 Flash Cyber es su mejor arma de ciberseguridad hasta la fecha.

Encabezado oficial del anuncio de Gemini 3.8 Flash y 3.8 Flash Cyber en el blog de Google

El anuncio, firmado por Tulsee Doshi (dirección de producto) y Raluca Ada Popa (líder de seguridad de Gemini en DeepMind), aterriza el 2 de septiembre, días antes de que OpenAI desvelara GPT-6 Astra y Anthropic lanzara Claude Fable 5.1. La semana del 1 de septiembre se ha convertido, sin duda, en la más intensa de la historia reciente de los modelos de frontera.

Los datos clave de Gemini 3.8

Precio de introducción idéntico al de 3.7 Flash: 0,75 $ por millón de tokens de entrada y 3,75 $ de salida, hasta el 31 de diciembre de 2026.
54,9% en HLE-Verified: razonamiento multietapa en ciencias, humanidades y campos profesionales.
Flash Cyber: detección autónoma de vulnerabilidades a nivel frontera y parches automáticos, solo para defensores de confianza vía Fairwind.

Gemini 3.8 Flash: el modelo que, literalmente, trabaja más

Tabla comparativa oficial de Gemini 3.8 Flash frente a otros modelos en distintos benchmarks

La decisión de diseño que explica las ganancias es simple y reveladora: 3.8 Flash trabaja más. En tareas complejas ejecuta pasos de razonamiento extra e itera con las herramientas una y otra vez, asumiendo más tokens a cambio de calidad. En DeepSWE v1.1, la prueba de referencia para resolver problemas de ingeniería complejos de extremo a extremo, supera a la mayoría de los modelos frontera más grandes —y muchos de ellos, considerablemente más caros— a una fracción del coste. En campos que exigían hasta ahora modelos premium, como análisis cuantitativo y legal (Vals Finance Agent V2 y el benchmark legal de Harvey), 3.8 Flash también deja atrás a la 3.7 y a otros modelos frontera. Para quien le importa el gasto, Google deja la válvula: los niveles de esfuerzo bajos siguen disponibles para minimizar tokens, y la 3.7 Flash "sigue plenamente soportada" para cargas de trabajo de eficiencia pura.

Gemini 3.8 Flash frente a su predecesora y al resto

Frente Gemini 3.8 Flash Gemini 3.7 Flash / frontera
Precio de introducción (hasta 31/12/2026) 0,75 $ / 3,75 $ por 1M tokens (in/salida) Igual: la 3.8 mantiene el precio de la 3.7
Después del 1/1/2027 1,50 $ / 7,50 $ por 1M tokens
Código a largo horizonte (DeepSWE v1.1) Supera a la mayoría de modelos frontera más grandes Réferencia del segmento
Razonamiento multidisciplinar (HLE-Verified) 54,9%
Finanzas y legal (Vals Finance V2, Harvey Legal) Supera a 3.7 Flash y a otros modelos frontera

Las demos oficiales no dejan margen para la duda: con un prompt y una instrucción en bucle, 3.8 Flash construye en Google Antigravity un juego 3D de un mago recorriendo un castillo (con texturas generadas por Nano Banana), una versión de Google Maps funcional para DOS —jugable, con direcciones e incluso Street View— y visualizadores 3D de despieces de hardware reales. No son juguetes de escaparate: son la demostración del "horizonte largo" que promete el modelo, la misma dirección por la que van Astra y Fable 5.1. El matiz competitivo: mientras OpenAI y Anthropic apuestan por modelos caros y "críticos", Google defiende que la frontera también se escala con cadetes baratos que no paran de pensar.

Flash Cyber: el modelo que encuentra el fallo y escribe el parche

Gráfico oficial de Gemini 3.8 Flash Cyber en CyberGym (Pass@1) frente a otros modelos

La variante Cyber no es un añadido cosmético: es el modelo de ciberseguridad más capaz de Google hasta la fecha, con rendimiento de frontera en detección autónoma de vulnerabilidades. En CyberGym, el benchmark estándar del sector, supera a la 3.5 Flash Cyber y a modelos frontera mucho más grandes; y en un benchmark interno propio, con vulnerabilidades repartidas por codebases complejos en 20 lenguajes de programación, alcanza un éxito superior al 70%, "un salto impresionante" sobre sus predecesores.

Gráfico oficial de Gemini 3.8 Flash Cyber en CWE-Bench (Pass@1) frente a coste por intento

Parches automáticos: los números que importan

Prueba Gemini 3.8 Flash Cyber Referencia
CWE-Bench (Collinear, externo): parches pass@1 del 47,2% Modelo frontera líder: 47,8%, a coste mucho mayor
Seguridad de Chrome 2,6x más parches correctos Mejores modelos comerciales (mucho más grandes)
Pentesting (Wiz) +7,5-9,7% de recall 1/2,3 a 1/5,2 del coste de otros líderes
Vulnerabilidad crítica en código de Google Encontrada en menos de 2 horas Investigación humana: suele tardar meses

Corregir antes que atacar

Google subraya que la inversión fue deliberada en arreglar, no en explotar: el parcheo automático se priorizó por delante de capacidades ofensivas. Por eso 3.8 Flash Cyber viaja con mitigaciones más permisivas y solo es accesible para defensores de confianza a través del nuevo Programa Fairwind: agencias gubernamentales, operadores de infraestructura crítica y mantenedores de software. La 3.8 Flash estándar, en cambio, mantiene salvaguardas estrictas de CBRN y ciberofensa según su Frontier Safety Framework, y da un salto en robustez ante prompt injection medido por Gray Swan. Es el mismo movimiento que ya hicieron OpenAI (Daybreak) y Anthropic (CVP): la ciberdefensa se convierte en mercado regulado por acceso.

Dónde llega hoy: de tu buscador a la empresa

Miniatura del vídeo: Google Gemini 3.8 Flash, ¿cómo usarlo? (Pau Martí Felip)

Vídeo: guía práctica de Gemini 3.8 Flash · Ver en YouTube

La distribución es amplia y es lo que más cambia para el usuario medio: 3.8 Flash está disponible ya para suscriptores AI Pro y Ultra en la app de Gemini, en el modo IA de Google Search y en Gemini dentro de Google Sheets; las empresas lo reciben en Gemini Enterprise; y los desarrolladores pueden construir sobre él vía la API de Gemini en Google AI Studio y Android Studio, con flujos agente en Antigravity y generación de interfaces en Stitch. La variante Cyber, en cambio, hay que pedirla: el formulario del Programa Fairwind es la única puerta. El único calendario a vigilar es el de la etiqueta de precio: el 1 de enero de 2027 el precio de introducción se duplica (1,50 $ / 7,50 $ por 1M tokens).

Qué supone para la carrera de los modelos

Gemini 3.8 Flash completa el triángulo de la semana. GPT-6 Astra quiere ser el más inteligente y el más autónomo —y paga el precio del umbral crítico en ciber—; Claude Fable 5.1 pelea el precio, la privacidad y la ciencia; y Gemini 3.8 Flash defiende que la frontera es escalable a coste contenido, con un cadete que razona más, parchea solo y ya escribe en el buscador. Si el patrón de las tres semanas previas se mantiene, la pregunta del segundo trimestre de 2026 no es quién tiene el mejor modelo, sino cuánto cuesta usarlo y a quién se le deja coger el cuchillo.

El camino a seguir

Tres cosas marcan el calendario: el fin del precio de introducción el 1 de enero, la expansión del Programa Fairwind y la siguiente Flash —si Google mantiene el ritmo de seis semanas, llegará antes de lo que pensemos. ¿Tu lado en la jugada: un cadete barato que no para de intentar, o un genio caro que lo intenta una vez y acierta? Déjalo en los comentarios.

Publicado el 9/7/2026

Compartir este artículo: