Gemini 4 Argon: Novedades, Benchmarks y Precios
El nuevo modelo frontier de Google está diseñado para trabajo largo y de múltiples pasos en programación, derecho, finanzas y ciberdefensa — esto es lo que realmente cambió.

Google acaba de anunciar Gemini 4 Argon, su nuevo modelo frontier diseñado para mantener un razonamiento profundo a lo largo de flujos de trabajo largos y de múltiples pasos. La propuesta: rendimiento frontier en ingeniería de software del mundo real, trabajo de conocimiento empresarial como derecho y finanzas, y ciberdefensa — el tipo de tareas que requieren muchos pasos de un agente, no un solo prompt. Esta guía cubre las novedades, los benchmarks publicados por Google, el costo, el salto a un límite de 1M tokens de salida y quién obtiene acceso primero.
¿Qué es Gemini 4 Argon?
Gemini 4 Argon es el último modelo frontier de Google, posicionado como su "nueva era de inteligencia frontier". Google lo describe como diseñado para mantener un razonamiento profundo a través de flujos de trabajo complejos de largo horizonte, ofreciendo rendimiento frontier en ingeniería de software del mundo real, trabajo de conocimiento empresarial como derecho y finanzas, y ciberdefensa (Google).
Fue anunciado el 30 de septiembre de 2026. A diferencia de un lanzamiento de modelo típico, Argon no está disponible de forma amplia desde el primer día — Google lo está implementando primero a un conjunto de ciberdefensores de confianza a través de su Programa Fairwind, y luego expandiéndolo a desarrolladores, empresas y consumidores a medida que refuerza las salvaguardas (Google).
Novedades en Gemini 4 Argon
El cambio principal para los desarrolladores es la capacidad de razonar más tiempo en un solo paso.
- Límite de 1M tokens de salida. Google amplió significativamente el límite de tokens de salida del modelo a un líder del sector de 1M tokens, frente a los anteriores 64K. La afirmación es que cuando el modelo tiene margen para generar cientos de miles de tokens en una sola trayectoria, puede añadir un nuevo nivel de profundidad en el razonamiento y resolver problemas difíciles de una sola vez (Google).
- Enfoque en largo horizonte. Argon está ajustado para tareas que requieren planificación, uso de herramientas y mantenerse en la tarea a través de muchos pasos — desde la depuración cotidiana hasta migraciones de bases de código a gran escala.
- Trabajo de conocimiento multimodal. Google destaca su fortaleza cuando la tarea requiere comprensión visual — análisis profesional de gráficos, extracción de detalles de videos largos y actuación a través de una serie de documentos.
Para contexto, este es un lanzamiento más importante que la reciente actualización de Gemini 3.8 Flash: Argon es un modelo de nivel frontier orientado a las tareas más difíciles y largas, en lugar de trabajo de alto volumen y bajo costo.
Benchmarks de Gemini 4 Argon
Todas las cifras a continuación provienen de los materiales de lanzamiento de Google, por lo que deben leerse como benchmarks reportados por el proveedor y no como pruebas independientes (Google).
- DeepSWE v1.1 (ingeniería de software de largo horizonte): 77,9%, que Google califica como un nuevo estado del arte para tareas de ingeniería del mundo real y largo horizonte.
- Vals Index: Argon es el modelo líder en este índice, que mide el impacto económico en finanzas, programación, derecho y trabajo fiscal, ponderado por la contribución de cada sector al PIB de EE. UU.
- AutomationBench (Zapier): ocupa el puesto n.º 1 con una puntuación de 51,3%, midiendo la ejecución de extremo a extremo en funciones empresariales clave.
- LVBench (comprensión de video largo): 91,7%, que Google cita como estado del arte.
- CWE-bench v1 (remediación de vulnerabilidades): empata en el primer lugar con una puntuación máxima del 68%.
Google también compartió resultados internos: afirma que Argon ayudó a investigadores de computación cuántica a superar una línea base publicada en un 40% en minutos, y que los agentes de Argon produjeron un decodificador de video en Rust (para libgav1) que funciona 2,7 veces más rápido que un port de Rust existente con salida idéntica. Tratar estos como ejemplos internos ilustrativos, no como benchmarks reproducibles.
Precios de Gemini 4 Argon
Google estableció un precio introductorio:
- $2 por millón de tokens de entrada
- $10 por millón de tokens de salida
- Tokens de entrada en caché con un precio un 95% inferior al precio del token de entrada
Después del período introductorio, el precio estándar sube a $4 por millón de tokens de entrada y $20 por millón de tokens de salida (Google). Si estás planificando con Argon, ten en cuenta que el límite de 1M tokens de salida más los precios frontier de salida significa que las trayectorias largas y con muchos tokens pueden volverse costosas rápidamente — presupuesta para la salida, no solo para la entrada.
Liderazgo en ciberseguridad defensiva
La ciberseguridad es el centro de este lanzamiento. Google entrenó a Argon para ser altamente capaz en defensa: puede encontrar, validar y parchear de forma autónoma vulnerabilidades críticas de software. Para los defensores de confianza y los equipos internos de Google, Google afirma que lanzará Argon sin salvaguardas cibernéticas para que puedan usar sus capacidades defensivas de nivel frontier completas (Google).
Un ejemplo temprano que cita Google: el proveedor de seguridad Wiz, usando Argon a través de su iniciativa Scan for Good, descubrió una vulnerabilidad crítica que exponía información personal sensible en software de salud utilizado por hospitales en todo el mundo — un riesgo grave que Google afirma que los modelos frontier anteriores habían pasado por alto.
Esto se basa en la dirección cibernética que Google inició con su variante Gemini 3.8 Flash Cyber, extendiendo el descubrimiento y parcheo autónomo de vulnerabilidades a un modelo de nivel frontier.
Seguridad y el despliegue por fases
Dado que Argon ofrece capacidades de nivel frontier — incluyendo ciberseguridad — Google lo está restringiendo y reforzando las salvaguardas antes de un lanzamiento amplio. La empresa afirma que está:
- Participando en el proceso voluntario del gobierno de EE. UU. para acceso previo al lanzamiento de modelos.
- Rechazando solicitudes dañinas de ciberseguridad y CBRN (químico, biológico, radiológico y nuclear) según su Marco de Seguridad Frontier, preservando la investigación legítima de doble uso.
- Reforzando la protección contra la inyección indirecta de prompts (indirect prompt injection), donde instrucciones maliciosas ocultas en el contexto intentan secuestrar el modelo — Google afirma un liderazgo en robustez en el benchmark de Inyección Indirecta de Prompts de Gray Swan.
- Monitoreando la cadena de pensamiento y las acciones de Argon para detectar desalineación y detener la ejecución cuando sea necesario (Google).
Quién obtiene Gemini 4 Argon y cuándo
El acceso es escalonado:
- Ahora: ciberdefensores de confianza a través del Programa Fairwind, más los equipos internos de Google.
- Próximamente: desarrolladores, empresas y consumidores, comenzando con clientes de API de pago y suscriptores de Google AI Ultra.
En resumen, Argon aún no es un lanzamiento de disponibilidad general. Si desarrollas agentes, la conclusión práctica es planificar para ello en lugar de hacer prototipos hoy — y estar atento a la apertura de la API de pago.
¿Debería importarte si desarrollas agentes?
El diseño de Argon — trayectorias largas, uso intensivo de herramientas y un límite de 1M tokens de salida — se corresponde directamente con las cargas de trabajo agénticas: migraciones de bases de código, investigación financiera o legal de múltiples pasos, y remediación de seguridad que abarca muchos archivos. Las preguntas abiertas son el costo con los precios frontier de salida y cuándo puedes llamarlo realmente fuera de Fairwind. Hasta entonces, el más reciente Gemini 3.8 Flash sigue siendo la opción accesible para bucles de agentes de alto volumen.
Haz esto con tu propia fuerza laboral de IA
Los modelos frontier como Gemini 4 Argon solo son útiles si algo los orquesta en trabajo real y de múltiples pasos — planificación, llamada a herramientas y finalización de una tarea de principio a fin. Eigent es una aplicación de escritorio "Cowork" de código abierto: una fuerza laboral multi-agente que se ejecuta localmente, para que puedas dirigir modelos capaces a flujos de trabajo de programación, investigación y documentos mientras mantienes tus datos en tu máquina. Descubre cómo una fuerza laboral de agentes gestiona la revisión de PRs en GitHub, o lee nuestro análisis de Gemini 3.8 Flash para programación y agentes. Descarga Eigent para construir el tuyo propio.
Recent Posts

Eigent Release Notes v1.0.5: Session Recovery, Task Queues & Better Previews
Eigent v1.0.5 improves Session recovery, task queues, process and file previews, Space settings, and model support.

Claude Opus 5.5: Novedades, Benchmarks y Precios
Claude Opus 5.5 explicado: el primer modelo Claude 5.5, un 40% más económico que Opus 5, salida un 30% más rápida, nuevos benchmarks de codificación agéntica, precios y seguridad.

GPT-6 Sol y Luna: Los Modelos de Codificación y Agentes de OpenAI más Económicos
GPT-6 Sol y Luna amplían la familia GPT-6 de OpenAI por debajo de Astra con grandes reducciones de precio y mejor codificación. Esto es lo que cambió, los benchmarks y cuándo usar cada uno.