OpenAI ha revelado GPT-6 Astra, una nueva generación de modelo de inteligencia artificial diseñado para el desarrollo de software, tareas profesionales complejas y uso autónomo de ordenadores. Sus capacidades en ciberseguridad han progresado notablemente, alcanzando por primera vez el nivel «Critical» definido por el Preparedness Framework de OpenAI.
GPT-6 Astra marca una nueva etapa significativa en los modelos de la empresa. OpenAI lo posiciona como un avance crucial para el desarrollo de software, las ciencias, las matemáticas, el trabajo profesional y la utilización autónoma de ordenadores. El modelo está diseñado específicamente para llevar a cabo tareas agentivas multietapa e intervenir en entornos de software con una mayor autonomía.
Avances en Ciberseguridad Autónoma
La ciberseguridad es uno de los campos donde este progreso es más significativo. OpenAI estima que Astra alcanza el umbral «Critical» de su Preparedness Framework, un logro inédito para sus modelos anteriores.
Con las herramientas y accesos adecuados, Astra tiene la capacidad de identificar vulnerabilidades desconocidas e incluso desarrollar medios para explotarlas en sistemas altamente protegidos sin requerir intervención humana en cada etapa. Durante una evaluación interna, por ejemplo, el modelo descubrió dos vulnerabilidades zero-day que posteriormente fueron utilizadas en una cadena de explotación simulada.
Estas impresionantes capacidades han llevado a OpenAI a reforzar drásticamente las protecciones alrededor del modelo. La compañía anunció haber retrasado ciertas etapas de su desarrollo y lanzamiento con el objetivo primordial de mejorar sus mecanismos contra los usos ciber maliciosos y cualquier acción no autorizada. Astra incorpora, entre otros elementos, rechazos integrados al modelo, clasificadores de seguridad, una vigilancia constante de sus acciones y mecanismos capaces de interrumpir operaciones potencialmente no autorizadas.
Rendimiento y Desafíos de Control
Además, OpenAI afirma que Astra respeta más las restricciones explícitas de seguridad que GPT-5.6 Sol en diversas evaluaciones. En un conjunto de pruebas de evasión relacionadas con ciberseguridad, Astra rechazó el 91,5 % de las peticiones prohibidas, una mejora notable respecto al 59 % registrado por GPT-5.6 Sol.
No obstante, la empresa es transparente sobre los desafíos inherentes a su tecnología, reconociendo que la vigilancia se vuelve más difícil a medida que avanzan las capacidades de los modelos y prevé la necesidad de controles adicionales susceptibles de ralentizar o interrumpir tareas legítimas.
La llegada de Astra ocurre en un contexto donde las capacidades agentivas son simultáneamente mucho más útiles y considerablemente más difíciles de controlar. OpenAI planea un despliegue gradual del modelo, manteniendo el acceso a sus funciones de ciberseguridad más avanzadas bajo una regulación estricta. Greg Brockman, presidente de OpenAI, estima que esta generación podría marcar la entrada en una nueva era de Inteligencia Artificial General (AGI), aunque admite que la definición misma de AGI sigue siendo objeto de debate e interpretación.
Con GPT-6 Astra, OpenAI franchisce un nuevo umbral en las capacidades de sus modelos agentivos; sin embargo, este progreso sitúa a la seguridad, la alineación y el control de los sistemas autónomos en el centro de los desafíos relacionados con las próximas generaciones de inteligencia artificial.