OpenAI ha presentado GPT-6 Astra, su modelo más avanzado hasta la fecha y uno de los mayores saltos de la compañía hacia una inteligencia artificial capaz de realizar trabajos completos en un ordenador. Astra puede navegar por webs, utilizar aplicaciones de escritorio, modificar hojas de cálculo, crear documentos y presentaciones, programar o trabajar con herramientas profesionales. El avance viene acompañado de una advertencia poco habitual: es el primer modelo de OpenAI que alcanza el nivel Critical en capacidades de ciberseguridad según su Preparedness Framework.
Las claves de GPT-6 Astra en 20 segundos
- GPT-6 Astra puede operar navegadores, aplicaciones, hojas de cálculo y otras interfaces para completar tareas de varios pasos.
- OpenAI publica un 99,9 % en ARC-AGI-3, 98 % en FrontierMath Tier 4 y 100 % en ExploitBench.
- El modelo dispone de 1,05 millones de tokens de contexto y hasta 128.000 tokens de salida.
- Es el primer modelo de OpenAI clasificado como Critical por sus capacidades de ciberseguridad.
- El despliegue comienza de forma limitada antes de llegar a ChatGPT y la API durante los próximos días.
La diferencia respecto a generaciones anteriores está menos en conversar mejor y más en hacer cosas directamente. OpenAI presenta Astra como un sistema preparado para recibir una tarea, utilizar diferentes herramientas y completar un flujo de trabajo sin que el usuario tenga que dirigir manualmente cada movimiento.
La compañía evita presentar oficialmente el lanzamiento como una declaración formal de que ha alcanzado la inteligencia artificial general (AGI). Greg Brockman, cofundador y presidente de OpenAI, sí utilizó la expresión «AGI era» durante la presentación a medios, según VentureBeat. Es una afirmación distinta de demostrar que existe consenso científico sobre que Astra constituye una AGI.
Astra quiere utilizar el ordenador como lo haría una persona
Una de las características que mejor explica el cambio es su capacidad de computer use. Hasta ahora, integrar un modelo con aplicaciones empresariales solía depender en buena medida de interfaces de programación de aplicaciones (API), conectores y herramientas diseñadas específicamente para cada servicio.
Astra puede trabajar además directamente con interfaces gráficas.
OpenAI asegura que el modelo puede rellenar formularios online, actualizar registros en un CRM, organizar calendarios, investigar en Internet y trasladar los resultados a documentos o correos electrónicos.
También puede trabajar con datos científicos, generar gráficos, construir sitios web y comprobar posteriormente su funcionamiento. La compañía muestra además ejemplos de creación de documentos, presentaciones y hojas de cálculo que respetan plantillas existentes.
Eso acerca el modelo al concepto de agente de propósito general para el ordenador: una IA que no necesita necesariamente una integración específica para cada pequeño paso de un proceso.
Los resultados de OSWorld 2.0 publicados por OpenAI sirven para medir parte de esta evolución. Astra alcanza un 72,6 % realizando las tareas evaluadas en aproximadamente 40 minutos de media, frente al 65,7 % de GPT-5.6 Sol y unos 75 minutos. OpenAI calcula que Astra completa esas pruebas aproximadamente un 47 % más rápido.
El cambio puede tener consecuencias importantes para el software empresarial. Si los modelos son capaces de manejar aplicaciones existentes mediante sus propias interfaces, determinadas automatizaciones podrían construirse sin desarrollar una integración específica para cada acción.
Eso no elimina las API. Cuando existen, siguen proporcionando una forma estructurada, predecible y normalmente más eficiente de intercambiar información. Pero la interfaz gráfica puede convertirse en una vía adicional para automatizar software antiguo o herramientas que carecen de integraciones adecuadas.
Un 99,9 % en ARC-AGI-3 y el salto en tareas profesionales
Los primeros resultados publicados por OpenAI son elevados, aunque requieren interpretar cada benchmark por separado.
En ARC-AGI-3, diseñado para evaluar la capacidad de adaptarse a entornos desconocidos y resolver problemas nuevos, OpenAI comunica una puntuación máxima del 99,9 % para GPT-6 Astra, frente al 7,8 % indicado para GPT-5.6 Sol.
La ARC Prize Foundation afirma, en una declaración publicada por OpenAI, que Astra superó su referencia de eficiencia de acciones humanas en el 96 % de los niveles evaluados.
El resultado merece una precaución metodológica. OpenAI explica que sus evaluaciones pueden utilizar configuraciones, herramientas y harnesses diferentes, y que los resultados obtenidos en sus entornos de investigación no tienen por qué coincidir exactamente con ChatGPT en producción.
En matemáticas, Astra alcanza un 98 % en FrontierMath Tier 4 según los datos oficiales publicados por OpenAI. La compañía también había comunicado en agosto avances sobre diez problemas abiertos de matemáticas y ciencias de la computación teórica, con resultados posteriormente sometidos a verificación formal.
Otro resultado destacado aparece en BenchCAD, dedicado a tareas de diseño asistido por ordenador. Astra alcanza un 95,9 % de solapamiento geométrico en la configuración presentada por OpenAI, frente al 83,3 % de GPT-5.6 Sol.
Son precisamente este tipo de pruebas las que muestran hacia dónde está desplazándose la competición. Los modelos ya no se comparan únicamente por responder preguntas de conocimiento o resolver problemas matemáticos, sino por su capacidad para interactuar con herramientas y producir un resultado terminado.
El 100 % en ExploitBench viene acompañado de una advertencia
El dato probablemente más delicado no está relacionado con matemáticas ni programación convencional.
GPT-6 Astra alcanza un 100 % en ExploitBench, una evaluación relacionada con capacidades de explotación de vulnerabilidades. OpenAI considera que el modelo ha alcanzado el umbral Critical de ciberseguridad definido en su Preparedness Framework.
La clasificación tiene consecuencias prácticas.
Según OpenAI, con las herramientas y accesos apropiados Astra puede encontrar vulnerabilidades desconocidas y desarrollar métodos para explotarlas en sistemas bien protegidos sin necesitar que una persona guíe continuamente el proceso.
La misma capacidad puede utilizarse defensivamente para encontrar fallos antes que un atacante, pero también introduce posibilidades evidentes de abuso.
Por ese motivo, la compañía afirma haber reforzado las medidas de seguridad alrededor del modelo, incluyendo mayor aislamiento de los sistemas internos, cifrado de checkpoints, monitorización de las trayectorias completas y evaluaciones de alineamiento que pueden bloquear el uso interno de determinados modelos.
Este aspecto ayuda también a explicar el despliegue gradual de Astra. La disponibilidad inicial está restringida mientras OpenAI amplía progresivamente el acceso.
La compañía sostiene que el ritmo de lanzamiento de futuros modelos dependerá cada vez más de si dispone de las salvaguardas necesarias para desplegar sus capacidades, y no únicamente de cuándo el modelo esté técnicamente preparado.
1,05 millones de tokens y un precio muy superior a Sol
Astra también aumenta considerablemente algunos límites técnicos.
La documentación para desarrolladores especifica una ventana de contexto de 1.050.000 tokens y un máximo de 128.000 tokens de salida. Su conocimiento tiene fecha de corte del 30/04/2026.
El salto tiene un coste.
OpenAI fija para la API estándar un precio de 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida.
Esto sitúa Astra principalmente en trabajos donde la capacidad adicional justifique el coste: desarrollo de software complejo, investigación, análisis profesional, automatizaciones largas o tareas que necesitan manejar grandes cantidades de contexto.
El despliegue comienza con un conjunto limitado de organizaciones. OpenAI prevé extenderlo durante los próximos días a usuarios de ChatGPT Plus, Pro, Business y Enterprise, además de ofrecerlo mediante su API. La compañía también anuncia disponibilidad a través de Microsoft Azure y AWS Bedrock.
Los planes Pro, Business y Enterprise recibirán además acceso a GPT-6 Astra Pro.
El cambio importante está en pasar de responder a ejecutar
Astra representa también una evolución de lo que significa comparar modelos de inteligencia artificial.
Durante años, buena parte de la competición se concentró en quién respondía mejor a una pregunta. Después llegó el razonamiento prolongado. La siguiente etapa está trasladando esa competencia al mundo de los agentes capaces de mantener una tarea durante mucho tiempo y utilizar herramientas para completarla.
Un modelo puede recibir el encargo de investigar un mercado, navegar por diferentes fuentes, organizar los datos en una hoja de cálculo, analizarlos, generar gráficos y preparar finalmente una presentación.
El usuario deja de pedir únicamente una respuesta y comienza a delegar un proceso.
Eso explica por qué las capacidades de computer use pueden terminar teniendo más importancia práctica que unas décimas adicionales en determinados benchmarks. El valor de un agente empresarial dependerá de si puede completar correctamente un trabajo real, respetar los permisos concedidos y saber detenerse cuando una acción supera su autorización.
Precisamente ahí aparece la contradicción que acompañará a esta generación de modelos. Cuanto más útil resulta un agente porque puede actuar sin supervisión constante, más importantes se vuelven los límites que determinan qué puede hacer por su cuenta.
GPT-6 Astra lleva esa tensión mucho más lejos que sus predecesores. Sus cifras muestran un salto considerable en varias pruebas, pero su clasificación de riesgo en ciberseguridad deja otra señal igual de importante: a partir de cierto nivel, lanzar un modelo más capaz ya no depende únicamente de terminar de entrenarlo.
Preguntas frecuentes
¿Qué es GPT-6 Astra?
GPT-6 Astra es el nuevo modelo avanzado de OpenAI orientado a razonamiento, programación, investigación, tareas profesionales y uso autónomo del ordenador. Puede interactuar con navegadores y aplicaciones para ejecutar procesos de varios pasos.
¿Cuánto contexto admite GPT-6 Astra?
La documentación de OpenAI especifica una ventana de contexto de 1.050.000 tokens y hasta 128.000 tokens de salida.
¿GPT-6 Astra es una AGI?
OpenAI presenta Astra como una nueva generación de inteligencia y Greg Brockman ha hablado del comienzo de la «era de la AGI». Esto no equivale a que exista consenso científico o industrial en considerar que el modelo haya demostrado inteligencia artificial general.
¿Por qué OpenAI considera peligroso GPT-6 Astra?
Astra es el primer modelo de OpenAI que alcanza el nivel Critical de capacidades de ciberseguridad dentro de su Preparedness Framework. La compañía afirma que, con las herramientas adecuadas, puede encontrar vulnerabilidades desconocidas y desarrollar formas de explotarlas con un elevado grado de autonomía.










