Gemini 3.8 Flash: Novedades en Programación e Inteligencia Artificial Agéntica
El modelo de trabajo más rápido de Google recibe mejoras en programación, razonamiento agéntico y ciberseguridad — esto es lo que realmente cambió.

Google acaba de lanzar Gemini 3.8 Flash, su tercer lanzamiento de la línea Flash en aproximadamente seis semanas y su modelo de trabajo "más inteligente" hasta la fecha. La propuesta es sencilla: mejoras significativas en ingeniería de software, tareas agénticas y razonamiento en múltiples pasos — a la misma velocidad y precio reducido que 3.7 Flash. Una variante separada, Gemini 3.8 Flash Cyber, está orientada al descubrimiento y corrección de vulnerabilidades de seguridad. Esta guía cubre qué cambió, los benchmarks publicados por Google, cuánto cuesta y dónde encaja si desarrollas agentes de IA.
¿Qué es Gemini 3.8 Flash?
Gemini 3.8 Flash es un modelo multimodal ligero dentro de la línea Flash de Google, optimizado para programación de largo alcance y agentes autónomos. Google lo presenta como "nuestro modelo de trabajo más inteligente", con mejoras sobre 3.7 Flash en ingeniería, trabajo agéntico y razonamiento en dominios especializados (Google).
Se lanzó el 2 de septiembre de 2026, tres semanas después de 3.7 Flash — parte de una cadencia en la que Google ha estado lanzando un nuevo modelo Flash aproximadamente cada tres semanas desde Gemini 3.6 Flash a finales de julio (Thurrott).
El lanzamiento incluye dos variantes construidas sobre la misma inteligencia base:
- Gemini 3.8 Flash — el modelo de trabajo general para programación, agentes y flujos de trabajo empresariales.
- Gemini 3.8 Flash Cyber — un modelo especializado en ciberseguridad para la detección de vulnerabilidades y corrección automatizada, disponible únicamente para defensores de confianza a través del nuevo Programa Fairwind.
Novedades respecto a Gemini 3.7 Flash
El titular es que 3.8 Flash "ofrece mejoras sustanciales" sobre 3.7 Flash mientras "a menudo se aproxima al rendimiento de modelos frontier de mayor coste" — sin aumentar el precio (9to5Google).
Google atribuye el salto a una decisión de diseño: el modelo trabaja más. En tareas complejas realiza más pasos de razonamiento y llama a herramientas de forma iterativa, lo que puede significar un mayor uso de tokens en niveles de esfuerzo más altos. Si el coste computacional es tu principal restricción, Google indica que puedes reducir el nivel de esfuerzo o continuar con 3.7 Flash, que sigue siendo compatible para cargas de trabajo donde la eficiencia es prioritaria.
Este equilibrio importa para los desarrolladores de agentes. Una mayor diligencia y llamadas iterativas a herramientas es exactamente lo que necesitan los bucles de agentes de larga duración — pero también significa que debes vigilar el gasto en tokens en tareas de alto volumen y baja complejidad.
Benchmarks de Gemini 3.8 Flash
Google publicó resultados en programación, finanzas, derecho y razonamiento general. Todas las cifras a continuación provienen de los materiales de lanzamiento de Google, por lo que deben interpretarse como benchmarks del fabricante y no como pruebas independientes.
- DeepSWE v1.1 (Ingeniería de Software de Largo Alcance): 3.8 Flash supera a la mayoría de los modelos frontier más grandes en la resolución autónoma de problemas de ingeniería complejos de principio a fin, a una fracción del coste (Google).
- Vals Finance Agent V2 y Harvey's Legal Agent Benchmark: 3.8 Flash supera a 3.7 Flash y a otros modelos frontier en estos dominios profesionales especializados.
- HLE-Verified (Humanity's Last Exam): 54,9%, que Google cita como evidencia de razonamiento en múltiples pasos en STEM, humanidades y campos profesionales (9to5Google).
El hilo conductor es la capacidad agéntica en dominios donde el modelo debe planificar, usar herramientas y mantenerse enfocado en la tarea a lo largo de muchos pasos — no solo responder a un único prompt.
Una advertencia importante: al igual que el modelo anterior, la fecha de corte de conocimiento de Gemini 3.8 Flash es marzo de 2026 para algunos dominios, mientras que en otros puede estar limitada a enero de 2025 (9to5Google). Planifica proporcionar contexto actualizado o herramientas para cualquier información reciente.
Precios de Gemini 3.8 Flash
Google mantuvo el precio introductorio igual que 3.7 Flash:
- $0,75 por millón de tokens de entrada
- $3,75 por millón de tokens de salida
Esta tarifa introductoria se mantiene hasta el 31 de diciembre de 2026; después, el precio estándar sube a $1,50 por millón de tokens de entrada y $7,50 por millón de tokens de salida (Google). Si estás desarrollando sobre él, ten en cuenta el cambio de precio de enero en cualquier modelo de costes a largo plazo — y recuerda que el comportamiento de "trabajar más" puede incrementar el recuento de tokens de salida en tareas complejas.
Dónde usar Gemini 3.8 Flash
Google lo puso a disposición en plataformas de consumo, desarrolladores y empresas desde el primer día:
- Consumidores: la aplicación Gemini, el Modo IA en Google Search y Gemini en Google Sheets, para suscriptores de Google AI Pro y Ultra (Search Engine Journal).
- Desarrolladores: Google Antigravity, AI Studio, Android Studio y la API de Gemini.
- Empresas: Gemini Enterprise.
Para los desarrolladores de agentes, el acceso a la API es el más relevante — permite integrar 3.8 Flash en tu propia orquestación en lugar de las aplicaciones de Google.
Gemini 3.8 Flash Cyber: la variante de seguridad
La variante Cyber es la parte más novedosa de este lanzamiento. Está orientada a los defensores y prioriza la corrección de vulnerabilidades sobre las capacidades ofensivas. Google reporta un rendimiento de nivel frontier en CyberGym, el benchmark estándar para el descubrimiento autónomo de vulnerabilidades, y una tasa de éxito superior al 70% en un benchmark interno que abarca 20 lenguajes de programación (Google).
Resultados reales que Google cita de sus propios equipos de seguridad:
- El equipo de seguridad de Chrome descubrió que 3.8 Flash Cyber produjo 2,6 veces más parches correctos para vulnerabilidades de Chrome que modelos comerciales mucho más grandes (9to5Google).
- El proveedor de seguridad Wiz midió un 7,5–9,7% mayor recall en un benchmark interno de pruebas de penetración a un coste 2,3–5,2 veces menor que otros modelos frontier líderes.
- El equipo de Investigación de Vulnerabilidades en la Nube de Google lo utilizó para encontrar una vulnerabilidad crítica de base en menos de dos horas — un trabajo que normalmente lleva meses.
La limitación: 3.8 Flash Cyber está restringido al Programa Fairwind para gobiernos de confianza, operadores de infraestructura crítica y mantenedores de software. No es un lanzamiento de API general.
¿Deberías cambiar de 3.7 Flash?
Una guía de decisión rápida basada en lo que publicó Google:
- ¿Desarrollas agentes de programación o de múltiples pasos? 3.8 Flash es la actualización — la ingeniería de largo alcance mejorada y el uso de herramientas son precisamente el punto fuerte.
- ¿Ejecutas tareas simples de alto volumen donde el coste es lo principal? Mantente en 3.7 Flash o usa un nivel de esfuerzo más bajo; el comportamiento de "trabajar más" puede incrementar las facturas de tokens.
- ¿Trabajo defensivo de seguridad y eres elegible para Fairwind? Solicita acceso a 3.8 Flash Cyber.
- ¿Necesitas conocimiento actualizado? Integra recuperación de información o herramientas en tiempo real — la fecha de corte significa que el modelo no conocerá eventos recientes por sí solo.
Haz esto con tu propia fuerza de trabajo de IA
Gemini 3.8 Flash está diseñado exactamente para el patrón sobre el que funciona Eigent: agentes de largo alcance que llaman a herramientas, planifican y ejecutan trabajo real en lugar de responder a un único prompt. Eigent es una aplicación de escritorio de código abierto tipo "Cowork" — una fuerza de trabajo multi-agente que automatiza flujos de trabajo localmente, para que puedas dirigir modelos capaces a tareas de programación, investigación y documentos manteniendo los datos en tu máquina. Si estás evaluando las mejoras agénticas de 3.8 Flash, descubre cómo funciona la revisión de PRs en GitHub con una fuerza de trabajo de agentes, o compara notas con nuestro análisis de los mejores agentes de programación de IA de código abierto. Descarga Eigent para construir el tuyo propio.
Recent Posts

Claude Fable 5.1 y Mythos 5.1: Novedades Explicadas
Claude Fable 5.1 y Mythos 5.1 explicados: el mismo modelo en dos niveles de salvaguarda, con nuevos benchmarks, un costo aproximadamente 25 a 45 por ciento menor y detalles de acceso.

GPT-6 Astra: Qué hace realmente el nuevo modelo de OpenAI
GPT-6 Astra es el nuevo modelo insignia de OpenAI. Aquí encontrarás qué hace, cómo rinde en benchmarks, cuánto cuesta y las advertencias detrás de los titulares sobre AGI.

Muse Spark 1.3: El Modelo Frontier de Meta para Código y Agentes, Explicado
Muse Spark 1.3 es el nuevo modelo frontier de Meta para código y agentes. Consulta benchmarks, precios, las variantes xhigh y max, qué cambió y cómo se compara.