GPT-6 Astra: Qué hace realmente el nuevo modelo de OpenAI
El nuevo modelo insignia de OpenAI logra grandes avances en uso de computadora y ciencia — pero los benchmarks tienen asteriscos, un precio premium y un lanzamiento por fases.

OpenAI ha comenzado a lanzar GPT-6 Astra, su modelo insignia más reciente, y el lanzamiento llegó con una afirmación inusualmente audaz: el presidente de la compañía, Greg Brockman, cerró la rueda de prensa con "Bienvenidos a la era de la AGI." Detrás del titular hay un modelo diseñado para realizar trabajo en computadora — controlar aplicaciones, rellenar hojas de cálculo, construir sitios web — en lugar de simplemente describir cómo hacerlo. Esta publicación analiza qué hace Astra realmente, cómo rinde en benchmarks, cuánto cuesta y las advertencias que vale la pena conocer antes de planificar en torno a él.
¿Qué es GPT-6 Astra?
Astra es el modelo más reciente y capaz de OpenAI, posicionado como un salto en el uso autónomo de computadoras. OpenAI lo lanzó a un conjunto limitado de clientes, calificándolo como el sistema de IA más inteligente del mundo y el primer modelo en activar protecciones de seguridad internas avanzadas dadas sus capacidades cibernéticas. La compañía afirma que establece un nuevo estándar para el control autónomo de sistemas informáticos y la realización de tareas en nombre del usuario — cosas como rellenar hojas de cálculo y crear sitios web desde cero.
El enfoque de OpenAI es que esto representa un nuevo modo de computación. En lugar de requerir una integración de API dedicada para cada aplicación, Astra está diseñado para navegar por el software de la misma manera que lo hace una persona — trabajando en navegadores, hojas de cálculo, sitios web y aplicaciones de escritorio, produciendo documentos terminados y ejecutando flujos de trabajo de múltiples pasos en lugar de simplemente indicarte cómo hacerlos.
Esa es la parte más importante para quienes desarrollan agentes de IA: un modelo que opera el mismo software que usan las personas es un trabajador de propósito general, no un chatbot con plugins.
La afirmación sobre la "era de la AGI" — qué tan en serio tomarla
OpenAI apostó fuerte por la narrativa de la AGI, pero matizó la definición. Brockman dijo que personalmente cree que OpenAI ha alcanzado la AGI mientras dejaba a los usuarios decidir si Astra cumple con la definición — "Creo que podría ser con este modelo", dijo, antes de cerrar con "Bienvenidos a la era de la AGI."
Cabe destacar que el término ha perdido su antiguo peso contractual. Cuando se le preguntó si OpenAI estaba declarando formalmente que había alcanzado la AGI, Brockman dijo que el término ya no estaba vinculado a un disparador contractual — una referencia a su acuerdo anterior con Microsoft — y lo describió en cambio como un "concepto de misión o concepto espiritual."
Léase esto como un encuadre de marketing más que como un hito técnico. La historia interesante está en las capacidades y las advertencias, no en la etiqueta.
Benchmarks de GPT-6 Astra: dónde lidera y los asteriscos
Las ganancias reales de Astra aparecen en el uso de computadora y en tareas científicas más que en programación. Vale la pena leer estos números con las notas al pie que el propio OpenAI adjuntó.
La programación es un paso modesto, no un resultado aplastante. En la prueba de programación agéntica DeepSWE v1.1, Astra obtuvo 74,1% frente al 70,8% de GPT-5.6 Sol. Pero eso no es una ventaja clara sobre los rivales — Meta reportó 75,4% para Muse Spark 1.3 en su configuración de razonamiento máximo, y Gemini 3.8 Flash y Claude Opus 5 rondan el 74% en el ranking público, con rangos de incertidumbre superpuestos. En otras palabras, no hay un rey claro de la programación.
El uso de computadora es donde el salto es real. En el benchmark OSWorld V2-Offline para trabajo con aplicaciones de escritorio, OpenAI afirma que Astra obtuvo 72,6%, frente al 65,7% de Sol, y redujo el tiempo promedio por tarea de aproximadamente 75 minutos a 40. Esa ganancia en eficiencia — igual o mejor puntuación en menos tiempo — es posiblemente más útil que un número de precisión como titular.
Las puntuaciones en ciencia y razonamiento son altas, con advertencias. Astra obtuvo 98,6% en ARC-AGI-3 y 97,6% en FrontierMath Tier 4. Los asteriscos importan: el resultado de ARC-AGI-3 refleja a Astra más un arnés de agente (agent harness) que retiene el razonamiento entre turnos, y OpenAI tiene acceso exclusivo a parte del benchmark FrontierMath, cuyo desarrollador financió. Los benchmarks que miden "el modelo más el andamiaje de OpenAI" no son comparables directamente con una puntuación de modelo sin procesar.
El resumen honesto: Astra es genuinamente sólido en uso de computadora y tareas de investigación, aproximadamente a la par en programación, y varios de sus números más llamativos dependen del propio arnés y acceso a benchmarks de OpenAI.
Precio de GPT-6 Astra
Astra es un modelo premium. Una vez que esté disponible en la API, Astra costará $10 por millón de tokens de entrada y $50 por millón de tokens de salida — 2,5 veces el precio promocional actual de Sol, aunque coincide con el precio de Anthropic para Fable 5.1.
Para contexto, eso está muy por encima de las opciones frontier más económicas. El precio estándar de Muse es $1,25 / $4,25 por millón de tokens de entrada/salida, y los precios introductorios de Google para Gemini 3.8 Flash son $0,75 / $3,75.
El contraargumento de OpenAI es que el precio por token no es lo mismo que el costo por tarea: una tarifa más alta por token no necesariamente significa una factura más alta si el modelo termina un trabajo en menos pasos y necesita menos reintentos. El problema es que los datos del lanzamiento son demasiado escasos para demostrar que esos ahorros compensan el precio premium, así que trata "más barato por tarea" como una afirmación que debes verificar en tus propias cargas de trabajo.
Por ahora la línea es solo Astra y Astra Pro — a diferencia de GPT-5.6, OpenAI no ha anunciado variantes Luna, Terra y Sol para esta generación.
¿Cuándo puedes usarlo? El lanzamiento por fases
Probablemente aún no puedas usar Astra. El modelo se está lanzando en fases, y OpenAI dijo que un grupo limitado de empresas en su programa de ciberseguridad basado en solicitudes, Daybreak, obtiene acceso primero.
El acceso más amplio sigue. Astra estará disponible "en los próximos días" para clientes de ChatGPT Plus, Pro, Business y Enterprise, y para desarrolladores de la API. Los usuarios de Pro, Business y Enterprise también obtienen GPT-6 Astra Pro, y el modelo está programado para llegar a la API de OpenAI y a AWS.
Por qué la ciberseguridad condicionó el lanzamiento
La razón del lanzamiento escalonado es la capacidad cibernética de Astra. Es el primer modelo que OpenAI ha designado como alcanzando su umbral de ciberseguridad "crítico" bajo su marco de preparación — lo que significa que potencialmente puede encontrar y explotar vulnerabilidades previamente desconocidas en sistemas bien protegidos sin orientación humana paso a paso.
Eso no es hipotético. En las pruebas de OpenAI, el modelo desarrolló exploits para navegadores y sistemas operativos reforzados y encontró dos vulnerabilidades previamente desconocidas, que OpenAI dice que está divulgando a los mantenedores. Como resultado, la versión de acceso estándar de Astra rechaza algunos trabajos avanzados de ciberseguridad como el descubrimiento de exploits, y las tareas de API que activan una verificación de ciberseguridad se detienen por completo en lugar de pausarse para su aprobación.
También hay un aspecto de alineación que vale la pena señalar: OpenAI reveló que el razonamiento escrito de Astra fue más difícil de monitorear que el de Sol en pruebas diseñadas para provocar evasión de monitoreo — un recordatorio de que más capacidad no significa automáticamente más transparencia.
Qué significa GPT-6 Astra para los agentes de IA
Dejando de lado el discurso sobre la AGI, el cambio práctico es este: los modelos frontier están siendo construidos para operar software directamente, rellenando hojas de cálculo y construyendo sitios en lugar de describir cómo hacerlo. Para los equipos que desarrollan flujos de trabajo con agentes, destacan tres conclusiones:
- El uso de computadora es el nuevo campo de batalla. Las mayores ganancias están en operar aplicaciones de escritorio y navegador, no en chat sin procesar. Diseña flujos de trabajo en torno a agentes que hacen clic, escriben y verifican — no solo responden.
- El arnés supera al modelo sin procesar. Varias de las mejores puntuaciones de Astra provienen del andamiaje que lo rodea: razonamiento persistente entre ventanas de contexto, compactación y la capacidad de seguir trabajando mientras te hace una pregunta. El sistema importa tanto como los pesos del modelo.
- El costo y el acceso son restricciones reales. Un precio premium y un lanzamiento escalonado con restricciones cibernéticas significan que un único modelo frontier no será la opción correcta para cada tarea. Enrutar los pasos más simples a modelos más económicos mantiene las facturas bajo control.
Pon a trabajar un agente de uso de computadora hoy mismo
No tienes que esperar una invitación de Daybreak para construir agentes que operen software real. Eigent es una aplicación de escritorio "Cowork" local y de código abierto que ejecuta una fuerza de trabajo multi-agente en tu navegador, archivos y herramientas — el mismo patrón de "hacer el trabajo, no solo describirlo" que Astra persigue, pero agnóstico al modelo y auto-alojado, para que puedas conectar el modelo que mejor se adapte a cada tarea. Descubre cómo una fuerza de trabajo automatiza trabajos de múltiples pasos en el hub de flujos de trabajo de Eigent, o descarga Eigent y construye tu primer agente de uso de computadora esta tarde.
Recent Posts

Claude Fable 5.1 y Mythos 5.1: Novedades Explicadas
Claude Fable 5.1 y Mythos 5.1 explicados: el mismo modelo en dos niveles de salvaguarda, con nuevos benchmarks, un costo aproximadamente 25 a 45 por ciento menor y detalles de acceso.

Gemini 3.8 Flash: Novedades en Programación e Inteligencia Artificial Agéntica
Gemini 3.8 Flash ofrece grandes mejoras en programación y razonamiento agéntico al mismo precio reducido, además de una nueva variante 3.8 Flash Cyber. Benchmarks, precios y cómo utilizarlo.

Muse Spark 1.3: El Modelo Frontier de Meta para Código y Agentes, Explicado
Muse Spark 1.3 es el nuevo modelo frontier de Meta para código y agentes. Consulta benchmarks, precios, las variantes xhigh y max, qué cambió y cómo se compara.