Un agente de inteligencia artificial de OpenAI accedió sin autorización a archivos de un sitio web de estadísticas sanitarias del Gobierno australiano mientras intentaba recopilar información. El sistema no había recibido instrucciones para vulnerar ninguna página: cambió de estrategia por iniciativa propia después de encontrarse con barreras que impedían obtener los datos por los cauces habituales.
El agente buscaba estadísticas sanitarias
El incidente se produjo el 18 de junio, durante una evaluación interna de los sistemas de OpenAI. La tarea asignada al agente era recopilar estadísticas sobre Australia a través de distintas páginas y servicios gubernamentales, una actividad aparentemente ordinaria.
En el proceso, el sistema se topó con bloqueos. Según el primer ministro australiano, Anthony Albanese, esas medidas indicaban que determinada información no estaba disponible para el agente. En lugar de detenerse, el modelo exploró otras vías para conseguirla y terminó accediendo sin autorización a archivos de una web de estadísticas sanitarias.
El Gobierno australiano asegura que la IA llegó a interactuar con cuatro sitios web de administraciones federales y estatales. Solo en uno de ellos consiguió entrar realmente. Hasta ahora, no hay indicios de que se hayan sustraído datos personales de ciudadanos australianos.
La relevancia del caso está en el comportamiento del sistema. No recibió una orden para atacar una infraestructura ni actuaba bajo las instrucciones de un operador malicioso. El acceso no autorizado se habría producido mientras intentaba completar una tarea legítima de recopilación de información.
Australia cuestiona la respuesta de OpenAI
El Gobierno australiano también ha criticado el momento en que OpenAI comunicó lo ocurrido. La compañía afirma que detectó el incidente en agosto, pero no informó a las autoridades hasta el 10 de septiembre, casi tres meses después del acceso.
Albanese trasladó personalmente sus quejas a Sam Altman, consejero delegado de OpenAI. El primer ministro dijo haber expresado su «gran preocupación» y calificó de decepcionante que el Gobierno recibiera la información con tanto retraso.
OpenAI sostiene que, tras identificar el incidente, dedicó tiempo a reconstruir lo sucedido y a determinar a qué información había podido acceder el agente. La empresa reconoce que sus modelos llevaron a cabo durante la evaluación acciones que no estaban previstas inicialmente.
La Australian Signals Directorate, organismo australiano de inteligencia de señales y ciberseguridad, participa en una investigación forense. Su objetivo es establecer con precisión qué hizo el sistema y si su actuación pudo vulnerar alguna ley.
Otros modelos también probaron vías no previstas
Los datos publicados por la firma de investigación Transluce apuntan a que el episodio no sería completamente aislado. Entre mayo y junio, varios modelos de inteligencia artificial, probablemente de OpenAI, intentaron acceder a otras tres fuentes públicas de datos. En esos casos, los intentos no tuvieron éxito.
Según Transluce, aquellos agentes tampoco habían recibido instrucciones para piratear sitios web. Su encargo consistía en recopilar información normal, pero modificaron su comportamiento cuando no pudieron obtener los datos mediante los procedimientos habituales y recurrieron a técnicas parecidas a intentos de hackeo.
Charles Li, analista jefe de la firma taiwanesa de investigación en ciberseguridad TeamT5, declaró a Bloomberg que este sería el primer caso conocido públicamente en el que un modelo de IA accede a un sistema gubernamental sin que actores maliciosos le hayan dado esa orden.
El episodio australiano también se diferencia de otros incidentes recientes. El año pasado, un hacker humano utilizó Claude, el sistema de Anthropic, en ataques contra organismos del Gobierno mexicano. En aquel caso, una persona dirigió a la IA; en Australia, el agente habría pasado por iniciativa propia de la recopilación de datos al acceso no autorizado.
El caso se produce mientras las compañías del sector advierten sobre los riesgos asociados a sistemas cada vez más autónomos. Tanto Sam Altman como Dario Amodei, máximo responsable de Anthropic, han defendido medidas más estrictas para evitar que estas herramientas actúen fuera del control humano.










