OpenAI lanzará Astra, el primer modelo que ella misma clasificó como riesgo cibernético «crítico»
El 2 de septiembre OpenAI dijo que va a lanzar Astra tras concluir que sus nuevas salvaguardas son suficientes. Lo llamativo no es el lanzamiento: es que Astra es el primer modelo que la propia compañía clasificó en el nivel Crítico de su Marco de Preparación por capacidades cibernéticas. Traducido: OpenAI reconoce que su modelo puede encontrar y explotar fallos de seguridad desconocidos sin que nadie lo guíe, y aun así decidió sacarlo.
Qué significa el nivel «crítico» que activó Astra
El umbral no es retórico. En el marco de OpenAI, un modelo llega a Crítico si puede identificar y desarrollar exploits funcionales de zero-day de todos los niveles de severidad en muchos sistemas reales endurecidos, y hacerlo sin intervención humana. Un zero-day es una vulnerabilidad que nadie conoce todavía, ni siquiera el fabricante del software; por definición no hay parche.
OpenAI no publicó puntajes numéricos concretos. Su lenguaje es más cauto: dice que no puede descartar capacidades cibernéticas críticas en Astra y que las evaluaciones preliminares muestran un desempeño suficientemente fuerte. Esa formulación importa. No están presumiendo una cifra; están reconociendo que no pueden garantizar que el modelo no tenga esa capacidad.
Qué salvaguardas pusieron
El paquete que describió la compañía tiene cinco piezas: entornos de prueba aislados, acceso restringido a redes y herramientas, protecciones reforzadas de los pesos del modelo, monitoreo universal de acciones riesgosas y ejecución en sandbox.
Y una decisión de distribución: en lugar de abrir Astra al público con estas capacidades, OpenAI trabajará con agencias gubernamentales y organizaciones seleccionadas de seguridad de IA para probarlas. Es el mismo patrón que acaba de adoptar Anthropic con Mythos: mismo modelo, distinta llave según quién seas.
La pregunta incómoda
Un modelo que encuentra zero-days solo es, al mismo tiempo, la mejor herramienta defensiva que ha existido y la mejor ofensiva. Quien la tenga puede auditar su propio software antes que nadie; quien la robe puede hacer lo contrario. Por eso las protecciones de los pesos aparecen en la lista: el riesgo no es solo el mal uso, es el robo del modelo.
Aquí está el nudo de 2026. Los laboratorios se autoevalúan, se autoclasifican y deciden solos si sus salvaguardas alcanzan. No hay un tercero que certifique que sí. OpenAI está siendo transparente al publicar la clasificación, y eso hay que reconocerlo; pero transparencia no es supervisión.
Qué significa Astra para América Latina
La región entra en esta historia por el lado más incómodo: el de la asimetría.
Las capacidades defensivas de Astra van a llegar primero a agencias gubernamentales y organizaciones de seguridad seleccionadas, que en la práctica están casi todas en Estados Unidos y Europa. Las capacidades ofensivas, si el modelo o uno equivalente se filtra, no respetan geografía. Eso deja a los países que no están en esa lista corta expuestos antes de estar protegidos.
Es un problema concreto, no teórico. La infraestructura crítica de la región —banca, energía, salud, sistemas electorales— corre sobre software que en muchos casos lleva años sin auditoría profunda. Un atacante con una herramienta capaz de encontrar fallos desconocidos no necesita apuntar a lo más blindado: apunta a lo que nadie ha revisado.
Lo que sí está al alcance hoy no es exótico. Es lo aburrido y comprobado: inventario real de los sistemas que exponen servicios a internet, un programa de parcheo que se cumpla, gestión de accesos, y un canal formal para que un investigador externo pueda reportar una vulnerabilidad sin miedo a que lo demanden. Los países de la región que tienen esos programas de divulgación responsable son minoría, y es probablemente la medida más barata que un gobierno puede tomar este año.
El panorama
El lanzamiento de Astra marca un cambio de fase. Hasta ahora, los debates sobre riesgo de la IA giraban en torno a lo que un modelo podría llegar a hacer. Este es el primer caso en que un laboratorio clasifica su propio modelo en el escalón más alto de riesgo cibernético y aun así procede al lanzamiento, apoyándose en salvaguardas que él mismo diseñó y evaluó.
Puede que sea la decisión correcta. Pero es una decisión que hoy toma una empresa, sola, sobre una capacidad que afecta a la infraestructura de todos.
Sitios oficiales:
OpenAI: respondiendo a la próxima frontera de capacidades cibernéticas críticas ·
Marco de seguridad de OpenAI
Reportado por: SecurityWeek — Decrypt — Quartz
Lee también:
