OpenAI ha dado a conocer recientemente GPT-6 Astra, un modelo de inteligencia artificial que ha sido calificado como el más avanzado y alineado hasta la fecha. Este anuncio se produce tras el reconocimiento del modelo como Crítico en términos de capacidades de ciberseguridad según su marco de preparación.
El modelo ha logrado una puntuación del 100% en ExploitBench, superando el 78.5% de su predecesor, GPT-5.6 Sol. Esta evaluación mide la capacidad de un modelo para convertir vulnerabilidades de software conocidas en exploits funcionales. OpenAI destaca que Astra también presenta tasas significativamente más altas de ejecución de código arbitrario en comparación con su anterior versión, lo que incluye la utilización de vulnerabilidades de día cero.
Astra no solo es capaz de aprovechar vulnerabilidades no divulgadas para ejecutar código en navegadores reforzados, sino que también puede desarrollar exploits de escalada de privilegios en sistemas operativos endurecidos, siempre que se le permita funcionar sin restricciones. Esta capacidad dual genera preocupaciones, ya que las herramientas que pueden ayudar a los defensores a identificar debilidades también pueden ser utilizadas por actores maliciosos para explotarlas.
Para mitigar estos riesgos, OpenAI ha decidido limitar la versión de Astra que se está lanzando a revisiones de código seguro y parches, rechazando solicitudes relacionadas con la creación de pruebas de concepto (PoC) para vulnerabilidades. La empresa ha anunciado que, a través de OpenAI Daybreak, planea ampliar el acceso y lanzar medidas de seguridad menos restrictivas en las próximas semanas, lo que permitirá flujos de trabajo defensivos más completos, incluyendo la validación de vulnerabilidades y análisis de malware.
OpenAI también ha implementado medidas más fuertes para mejorar la robustez del modelo ante posibles abusos. Esto incluye un sistema de monitorización más contextualizado y salvaguardias adicionales para detectar y contener desalineaciones. Astra es más propenso a operar dentro de los límites establecidos por el usuario y su entorno, aunque la empresa ha advertido que las comprobaciones de seguridad pueden interrumpir tareas legítimas, lo que obligará al usuario a revisar las acciones antes de continuar.
En el contexto de su lanzamiento, OpenAI ha presentado una nueva iniciativa para proporcionar acceso subvencionado a sus modelos, capacitación práctica y asistencia técnica a sectores de infraestructura crítica, como sistemas de agua, proveedores de electricidad, gobiernos estatales y locales, bancos y organizaciones con recursos de seguridad limitados. Este proyecto global, denominado Daybreak for Frontline Defenders, tiene como objetivo destinar 1.000 millones de dólares para ayudar a los defensores en el uso de capacidades de ciberseguridad de IA para proteger servicios esenciales contra ciberataques.
Asimismo, OpenAI ha establecido un piloto con el Centro de Análisis e Información de Múltiples Estados de EE.UU. (MS-ISAC) para proporcionar acceso a un grupo inicial de defensores del sector público y sistemas de agua, junto con capacitación guiada y asistencia práctica.
La compañía ha señalado que existe una 'ventana del defensor', una oportunidad que se reduce para utilizar la IA en el cierre de brechas de seguridad antes de que los atacantes las aprovechen. "Nuestro papel es ayudar a poner herramientas poderosas en manos de los defensores para que puedan proteger los sistemas y las personas de las que son responsables", concluyó OpenAI.