El sistema recibió una tarea para buscar estadísticas de salud y terminó obteniendo información que el portal no le había entregado.
Un agente de inteligencia artificial desarrollado por OpenAI obtuvo acceso no autorizado a un portal del Gobierno de Australia durante una evaluación interna de la compañía y logró consultar archivos que no estaban disponibles públicamente, reveló el primer ministro australiano, Anthony Albanese, según informó Reuters.
El incidente ocurrió el 18 de junio en el Medicare Statistics Reporting Service, un portal público administrado por Services Australia que contiene estadísticas relacionadas con el sistema de salud, como información agregada sobre gasto. Según el Gobierno australiano, el agente accedió tanto a archivos públicos como no públicos, aunque hasta ahora no existe evidencia de que haya obtenido información personal o expedientes de pacientes. Las investigaciones continúan.
OpenAI confirmó posteriormente el acceso y explicó que ocurrió mientras sus modelos participaban en una evaluación interna y trataban de localizar respuestas y estadísticas sobre Australia. La compañía aseguró que durante ese proceso sus modelos “tomaron acciones que no pretendíamos”.
La empresa afirmó que su revisión no encontró evidencia de acceso a expedientes de pacientes y precisó que la información obtenida incluyó estadísticas agregadas de salud y nombres de archivos internos.
Una tarea de investigación terminó en un acceso no autorizado
El ministro de Defensa y primer ministro interino de Australia, Richard Marles, explicó que el modelo había recibido inicialmente una tarea “benigna”: investigar estadísticas médicas y de salud.
Durante la búsqueda, el agente consultó cuatro sitios australianos. Según Marles, interactuó de manera autorizada —como podría hacerlo cualquier integrante del público— con páginas del Departamento de Salud de Victoria, un sitio del Gobierno de Nueva Gales del Sur y el Australian Institute of Health and Welfare.
La situación cambió al llegar al portal de Services Australia. Marles indicó que el agente solicitó determinada información, no la recibió y posteriormente consiguió acceder a ella de forma no autorizada.
“Efectivamente hackeó ese portal médico y obtuvo esa información de todas maneras”, explicó el ministro en una entrevista con la radio pública australiana ABC.
Marles señaló que el impacto conocido hasta ahora parece limitado debido a la naturaleza de los datos obtenidos, pero calificó el comportamiento del agente como un incidente serio precisamente porque el sistema actuó fuera de los límites previstos para cumplir su tarea.
OpenAI tardó casi tres meses en informar al Gobierno
El acceso ocurrió el 18 de junio, pero OpenAI ha señalado que no detectó la actividad hasta agosto, cuando realizaba una revisión más amplia sobre comportamientos no alineados de sus modelos. La compañía notificó a Services Australia el 10 de septiembre, casi tres meses después del incidente.
Albanese informó que habló directamente con el director ejecutivo de OpenAI, Sam Altman, para transmitirle la “extrema preocupación” del Gobierno australiano y cuestionar tanto la demora como la forma en que la empresa comunicó lo ocurrido.
“Esta situación es obviamente inaceptable”, afirmó el primer ministro, según The Guardian.
El Gobierno creó un grupo de trabajo encabezado por el Departamento del Primer Ministro y Gabinete y mantiene una investigación forense con apoyo de la Australian Signals Directorate. Las autoridades buscan establecer el alcance exacto del incidente y determinar si otros sistemas gubernamentales fueron afectados. Por ahora, el Gobierno sostiene que no hay evidencia de un compromiso más amplio de la red de Services Australia.
Segundo incidente conocido de OpenAI en pocos meses
El caso se conoce en momentos en que aumenta la atención internacional sobre la capacidad de los agentes de inteligencia artificial para ejecutar acciones autónomas fuera de los límites previstos por sus desarrolladores.
Delfino.CR informó esta semana que el Panel Científico Internacional Independiente sobre Inteligencia Artificial de Naciones Unidas advirtió que las salvaguardas utilizadas actualmente podrían estar quedándose atrás frente al avance de estos sistemas. El análisis tomó como caso de estudio otro incidente protagonizado por agentes de OpenAI durante pruebas internas de ciberseguridad.
En ese episodio, ocurrido en julio, modelos de la compañía encontraron vías para comunicarse entre ejecuciones que debían permanecer aisladas, sortear restricciones y acceder a infraestructura de producción de la plataforma Hugging Face en busca de información que les permitiera superar una evaluación.
El incidente australiano ocurrió aproximadamente un mes antes que el de Hugging Face, aunque fue detectado y divulgado posteriormente. Reuters lo describió como el primer caso conocido de un agente de inteligencia artificial que consigue vulnerar un sitio gubernamental.
Hasta ahora, OpenAI no ha identificado públicamente cuál de sus modelos estuvo involucrado en el acceso al portal australiano ni ha detallado el mecanismo técnico mediante el cual logró superar las restricciones que impedían consultar los archivos no públicos. La compañía aseguró que su revisión continúa.
