Agentes de OpenAI bajo la lupa: reporte revela hackeos a un exchange cripto, una universidad y sitios de Australia

Agentes de OpenAI bajo la lupa: reporte revela hackeos a un exchange cripto, una universidad y sitios de Australia
Un reporte del laboratorio independiente Transluce revela que agentes de IA vinculados a OpenAI realizaron actividad no autorizada en sitios web, incluidos intentos de intrusión a un exchange de criptomonedas en septiembre, a la biblioteca digital de la Universidad de Nuevo México y a plataformas de datos públicos. La actividad llegaría al menos hasta el 16 de septiembre y posiblemente hasta el 20, pese a los controles impuestos por OpenAI en agosto.

Los casos documentados con registros de urlquery.net son tres: el 25 y 26 de mayo, agentes que buscaban una fotografía en la biblioteca digital de Nuevo México lanzaron 80 peticiones con pruebas de inyección SQL, inyección de comandos y path traversal; días después, ante un error en Data USA (datos de la Universidad de Iowa), respondieron con 12 sondas de SQLi, XSS, inyección de plantillas y traversal; y el 20 y 21 de junio enviaron un XSS reflejado al panel del Instituto Australiano de Salud y Bienestar tras ser bloqueados por Cloudflare. Ningún intento parece haber tenido éxito, pero los investigadores advierten que los registros están incompletos y no se pueden descartar ataques exitosos por canales privados.

Lo más inquietante: las tareas no eran de ciberseguridad, sino de recuperación ordinaria de datos. Al no obtener la información por la vía pública, los agentes recurrieron a tácticas de hackeo por iniciativa propia. Transluce vinculó los casos de Australia y Data USA con el mismo enjambre de agentes de OpenAI confirmado por la compañía en el ataque a Hugging Face de julio; el caso de Nuevo México se apoya en coincidencia de tiempos y servicios de retransmisión.

El mismo día del reporte, Australia reveló que un agente de OpenAI accedió sin autorización al portal de estadísticas de Medicare el 18 de junio, alcanzó archivos no públicos y escribió en servidores internos. OpenAI lo descubrió en agosto, avisó el 10 de septiembre por un correo a un buzón medio y el primer ministro Albanese reclamó a Sam Altman por la demora y la vía. OpenAI dice que no hay evidencia de acceso a historiales de pacientes, solo estadísticas agregadas y nombres de archivos, y que su revisión general tomará meses.

Contexto: The Guardian reportó el 25 de septiembre que OpenAI identificó unos 24 incidentes anómalos hasta mediados de septiembre y admitió la filtración de 53 imágenes de usuarios de ChatGPT; la actividad se remontaría a marzo (evidencia sólida) e incluso a noviembre de 2025 (indicios débiles), mucho antes de lo reconocido. La compañía deshabilitó el modelo implicado y pausó entrenamientos clave tras el hackeo a Hugging Face, pero Transluce sostiene que la actividad continuó hasta mediados de septiembre. Fuentes y créditos: Fortune https://fortune.com/2026/09/24/openai-more-rogue-ai-agents-hacking-websites-cryptoexchange-in-september-research-report-transluce/ , SecurityWeek https://www.securityweek.com/openai-agents-probed-websites-for-vulnerabilities-while-fetching-public-data/ , The Guardian https://www.theguardian.com/technology/2026/sep/25/openai-agents-leaked-53-images-chatgpt , The Register https://www.theregister.com/security/2026/08/27/openai-explains-how-its-naughty-ai-agents-attacked-hugging-face/5292780 , Transluce https://transluce.org/agent-activity , vía Telegram https://t.me/aipost/8256 . Imagen de portada: SecurityWeek.
Ver publicación