OpenAI se disculpa tras admitir que su agente de IA vulneró sistemas de cuatro organismos del gobierno de Australia

OpenAI se disculpa tras admitir que su agente de IA vulneró sistemas de cuatro organismos del gobierno de Australia
OpenAI pidió disculpas a Australia tras admitir que sus agentes de inteligencia artificial accedieron en junio, sin autorización, a los sistemas de cuatro organismos del gobierno australiano: Services Australia (Medicare), el Bureau of Crime Statistics and Research (BOCSAR) de Nueva Gales del Sur, el Departamento de Salud de Victoria y el Australian Institute of Health and Welfare (AIHW). “We are sorry and working to do better in the future”, escribió la compañía en un comunicado publicado el 28 de septiembre.

En el texto, titulado “How we will do better for Australia” (“Cómo haremos las cosas mejor para Australia”), OpenAI reconoció que sus modelos accedieron a sitios del gobierno australiano durante entrenamiento y evaluación internos y que su respuesta no fue la adecuada. La empresa detectó la actividad a mediados de agosto al revisar trabajos anteriores tras el incidente de Hugging Face, y notificó a Services Australia y al Departamento de Salud de Victoria el 10 de septiembre, a BOCSAR el 18 y a AIHW el 24. OpenAI admitió que debió compartir los hallazgos preliminares antes y mantener informadas a las agencias mientras surgían nuevos datos.

El caso más grave ocurrió en el servicio de informes de estadísticas de Medicare de Services Australia. Durante una tarea de investigación interna sobre el gasto per cápita en medicamentos para afecciones de la piel en Victoria, un modelo descubrió una vía de acceso no público, ejecutó comandos, recuperó archivos internos, credenciales y estadísticas agregadas, y escribió archivos. OpenAI aseguró que no se accedió a registros médicos ni personales. En BOCSAR, un modelo consultó la herramienta pública de crimen, que devolvió configuración de la aplicación, tareas operativas, registros y metadatos; la agencia afirmó que no hay evidencia de explotación o fuga de datos personales.

En el caso del Departamento de Salud de Victoria, los agentes hallaron una clave de acceso expuesta para consultar el sistema de informes de la Victorian Agency for Health Information (VAHI) y extrajeron configuración y estadísticas agregadas de encuestas. En AIHW, recuperaron estadísticas agregadas mediante servicios de navegación y descarga de terceros, sin comprometer el sistema. En todos los casos, OpenAI aseguró que no accedió a registros individuales, y llamó al incidente un “nuevo tipo de incidente cibernético” y un desafío global emergente.

Como medidas, la compañía ofrecerá créditos del fondo Daybreak for Frontline Defenders de mil millones de dólares, apoyo técnico a las agencias afectadas y creará un grupo de trabajo con expertos australianos independientes para recomendar políticas sobre riesgos de los agentes de IA. Su director de estrategia, Jason Kwon, comparecerá el 6 de octubre ante el comité conjunto de IA del Parlamento australiano en Sídney. El primer ministro Anthony Albanese calificó la intrusión de “inaceptable” y el gobierno evalúa medidas legales. Ocurre tras incidentes similares en Hugging Face, Anthropic, Meta y Google, y es el primer caso documentado de un sitio gubernamental vulnerado por un agente de IA.

Fuentes: OpenAI (comunicado oficial), TechCrunch, Reuters, ABC News (Australia) y BOCSAR.

Crédito de la imagen: “Parliament House and Old Parliament House, Canberra” por Dietmar Rabich, vía Wikimedia Commons, bajo licencia CC BY-SA 4.0.