Tres semanas después de Gemini 3.7 Flash, Google volvió a la carga con Gemini 3.8 Flash, un modelo económico que, según la empresa, supera con holgura a su antecesor en programación. El lanzamiento llega en dos versiones: un modelo general de razonamiento y código, y una variante especializada en ciberseguridad llamada 3.8 Flash Cyber.
Es el tercer modelo de la familia Flash en apenas seis semanas. Si esa cadencia es señal de fortaleza o una distracción frente a los modelos de frontera que siguen sin aparecer, Gemini 3.5 Pro y Gemini 4, depende de a quién se le pregunte. El nuevo jefe de DeepMind, Koray Kavukcuoglu, dejó claro que Google no solo persigue la optimización de precio y rendimiento, y que también quiere liderar en capacidad bruta.
¿Qué tan bueno es Gemini 3.8 Flash programando?
De acuerdo con las cifras de la propia Google, Gemini 3.8 Flash alcanza 73,7% en DeepSWE v1.1, el benchmark de tareas de ingeniería de software de horizonte largo. Queda apenas por debajo de Claude Opus 5, que marca 74,0%, y bastante por delante del resto de la tabla.
- Claude Opus 5: 74,0%
- Gemini 3.8 Flash: 73,7%
- GPT-5.6 Sol: 72,7%
- Gemini 3.7 Flash: 65,3%
- Claude Sonnet 5: 53,8%
Google afirma que el modelo le gana a Opus 5 de Anthropic y a GPT-5.6 Sol de OpenAI en varios benchmarks pese a ser mucho más barato. Son benchmarks, eso sí, y el rendimiento en el trabajo real puede sentirse muy distinto. La empresa también asegura mejoras en generación 3D: muestra un juego construido a partir de un solo prompt en su herramienta de programación Antigravity, con texturas generadas por su modelo de imágenes Nano Banana.
¿Cuánto cuesta y dónde se usa?
Gemini 3.8 Flash arranca con un precio rebajado de 0,75 dólares por millón de tokens de entrada y 3,75 dólares por millón de salida, los mismos valores del 3.7 Flash. Desde enero de 2027 la tarifa regular sube a 1,50 y 7,50 dólares, es decir, exactamente el doble.
La comparación con los modelos de punta deja la brecha a la vista, incluso después de que expire el precio introductorio:
| Modelo | Entrada (USD por millón) | Salida (USD por millón) |
|---|---|---|
| Gemini 3.8 Flash | 0,75 (1,50 desde 2027) | 3,75 (7,50 desde 2027) |
| GPT-5.6 Sol | 4,00 | 20,00 |
| Claude Opus 5 | 5,00 | 25,00 |
El modelo está disponible para desarrolladores a través de Google AI Studio, Antigravity y Android Studio. Las empresas lo alcanzan por Gemini Enterprise, y los usuarios finales lo tienen en la aplicación de Gemini, en el modo de inteligencia artificial del buscador y, para suscriptores de pago, en Google Sheets.
¿Por qué el precio por token engaña?
Acá está el detalle que conviene mirar antes de migrar. Google explica parte de la ganancia de rendimiento sobre el 3.7 diciendo que el 3.8 Flash ejecuta pasos de razonamiento adicionales en tareas complejas y llama herramientas de forma iterativa. El modelo "trabaja más duro", según la empresa, lo que se traduce en mayor consumo de tokens y compensa en parte el precio más bajo por unidad.
La plataforma independiente Artificial Analysis le asigna un Intelligence Index de 59, tres puntos sobre los 56 de su antecesor, y lo empata con GPT-5.6 Sol en razonamiento xhigh y con Grok 4.6 en razonamiento medio. Las ganancias vienen sobre todo de los benchmarks agénticos, uso de herramientas y programación.
Pero en costo por tarea el modelo llega a 0,58 dólares, frente a los 0,40 dólares del 3.7 Flash: cerca de 40% más caro pese a que el precio por token no se movió un peso. Sigue en la frontera de Pareto, o sea es el más barato de su nivel de inteligencia, pero el ahorro no es el que sugiere la lista de tarifas. Por eso la propia Google recomienda bajar los niveles de razonamiento o quedarse con el 3.7 Flash, que sigue soportado, cuando lo que importa es la eficiencia de cómputo.
En velocidad, con razonamiento alto el modelo produce unos 300 tokens de salida por segundo y promedia 2,5 minutos por tarea. Es algo más rápido que GPT-5.6 Luna (2,6 minutos) y GPT-5.6 Terra (3,3 minutos), pero más lento que Claude Fable 5.1 (2,1 minutos) y que el propio 3.7 Flash (2,2 minutos). Con razonamiento bajo el tiempo cae a unos 48 segundos.
La versión Cyber no es para cualquiera
Gemini 3.8 Flash Cyber, igual que su antecesor 3.5 Flash Cyber, no es de acceso público. Google lo distribuye por el programa Fairwind a organismos de gobierno, operadores de infraestructura crítica y mantenedores de software. Tiene ajustes de seguridad menos restrictivos que la versión estándar porque está pensado para trabajo defensivo de ciberseguridad.
En CyberGym, el benchmark de referencia para detectar vulnerabilidades en C y C++, la variante marca 86,2% según Google, por sobre el 3.5 Flash Cyber (77,5%), GPT-5.6 Sol (83,6%) y GPT-5.5-Cyber (85,6%). En parcheo automático sobre el CWE-Bench externo llega a 47,2% de Pass@1, casi igualando al modelo de frontera líder, que marca 47,8%, a un costo bastante menor.
El modelo además se ve más resistente a los ataques de inyección de prompts. En el benchmark Gray Swan IPI la tasa de éxito de ataque es de apenas 5,5%. Para dimensionar: DeepSeek V4 Pro queda en 60,1%, Kimi K3 en 52,7% y Grok 4.6 en 51,8%. Solo Claude Opus 5 anda algo mejor, con 4,8%.
¿Le sirve a un equipo pequeño en Chile?
Para un taller de desarrollo o una pyme técnica de la región, la lectura práctica es que la tarifa por token dejó de ser el indicador útil. Lo que hay que medir es el costo por tarea terminada, y ahí la diferencia entre 0,40 y 0,58 dólares se multiplica por el volumen mensual. Un equipo que corra 5.000 tareas agénticas al mes pasa de unos 2.000 a unos 2.900 dólares con el mismo precio de lista, y en enero de 2027, cuando la tarifa se duplique, el mismo trabajo escala otra vez. La recomendación de Google de quedarse en 3.7 Flash para cargas sensibles al costo no es un detalle menor: es la propia empresa admitiendo que el modelo nuevo no reemplaza al viejo en todos los escenarios.




