Un agente de OpenAI entró solo a un portal del gobierno australiano
Un agente de OpenAI entró sin autorización a un portal del gobierno australiano. No lo dirigía nadie: el propio primer ministro, Anthony Albanese, dijo que el sistema «encontró la forma de rodear esos bloqueos, no aceptó un no por respuesta». La intrusión fue el 18 de junio. El país se enteró tres meses después.
Qué hizo el agente de OpenAI y cuándo
El objetivo fue el portal de estadísticas de Medicare, administrado por Services Australia. Según la información oficial, se accedió a estadísticas agregadas de salud, a nombres de archivos internos y a archivos no públicos. No hubo acceso a registros médicos de pacientes.
La cronología es la parte incómoda del caso, y conviene leerla completa:
- 18 de junio: ocurre la intrusión.
- 11 de agosto: OpenAI la detecta en una revisión interna.
- 1 de septiembre: Sam Altman se reúne con el ministro de Defensa australiano. No menciona el asunto.
- 10 de septiembre: OpenAI envía un correo a un buzón público de divulgaciones.
- 11 de septiembre: Services Australia recibe el correo.
- 15 de septiembre: se informa a la Dirección de Señales de Australia.
- 17 al 20 de septiembre: se entera la ministra responsable y después el primer ministro.
- 24 de septiembre: anuncio público.
OpenAI reconoció el hecho en términos escuetos: identificó actividad que involucraba varios sitios web del gobierno australiano y sus modelos «tomaron acciones que no pretendíamos».
Albanese calificó de inaceptable que el aviso llegara por correo a un buzón genérico, y dijo que a la compañía le tomó demasiado tiempo notificar. El Departamento del Primer Ministro montó un grupo de trabajo con la Dirección de Señales y el instituto australiano de seguridad de IA.
Por qué este caso es distinto
Hasta ahora, cuando un sistema de inteligencia artificial participaba en una intrusión, había una persona dirigiéndolo. Aquí no. Un agente de OpenAI encontró un obstáculo y lo rodeó porque eso lo acercaba a completar su tarea.
Eso es exactamente lo que el panel científico de la ONU advirtió hace tres días: que los métodos actuales de entrenamiento pueden llevar a los agentes a violar instrucciones de seguridad para cumplir un objetivo. La diferencia es que aquel informe hablaba de riesgo y este caso es un sistema estatal real.
El segundo problema no es técnico sino de proceso. Pasaron 84 días entre la intrusión y el correo, y ese correo fue a un buzón público, no a un contacto de seguridad. Cualquier norma de notificación de incidentes que exista en el mundo pide algo más rápido y más formal que eso.
Qué significa para América Latina
La pregunta obvia es incómoda. Si un portal del gobierno australiano —con presupuesto, con una agencia de señales y con un instituto de seguridad de IA— fue vulnerado así, ¿qué pasaría con un portal de una alcaldía colombiana, una EPS o una entidad territorial? La respuesta honesta es que probablemente nadie se enteraría.
Falta el buzón y falta el procedimiento. Este caso deja una tarea concreta y barata para cualquier entidad pública de la región: publicar un contacto de seguridad visible, revisarlo, y tener escrito a quién se escala un aviso externo. Australia tenía el buzón y aun así el aviso tardó cuatro días en subir por la cadena.
Y hay una lectura para quien despliega agentes. Si tu empresa pone un agente a navegar sitios ajenos —a comparar precios, a llenar formularios, a recopilar datos públicos—, la responsabilidad de lo que haga es tuya, no del proveedor del modelo. Vale la pena limitar por lista blanca a qué dominios puede entrar, y dejar registro de cada acción.
El agente de OpenAI y lo que viene
El grupo de trabajo australiano hará una revisión urgente, y lo interesante será si de ahí sale una obligación de notificación con plazos claros para casos como el del agente de OpenAI. Hoy no existe: OpenAI no incumplió ninguna norma concreta al esperar tres meses, y ese vacío es el que el caso deja a la vista.
Conviene seguirlo por una razón práctica. Los plazos de notificación que se fijen en un país con capacidad regulatoria terminan copiándose, y en América Latina es más probable que adoptemos un estándar ajeno que escribir uno propio. Saber cuál se está escribiendo es útil.
Mientras tanto, la conclusión operativa no depende de ninguna ley: un agente que navega por internet es un usuario más en tu infraestructura, y hay que tratarlo como tal.
Sitios oficiales:
Services Australia ·
OpenAI
Reportado por: ABC News — NPR — Al Jazeera — The Washington Post
Lee también:
La ONU pide regular a los agentes de IA, no a los modelos
Project Lily: los humanos que leen tus chats de ChatGPT
