OpenAI despide a tres investigadores de seguridad tras acusarlos de filtrar información confidencial

OpenAI despide a tres investigadores de seguridad tras acusarlos de filtrar información confidencial
OpenAI despidió a tres investigadores de su equipo de seguridad —Jasmine Wang, Tomek Korbak y Mikita Balesni— después de que una investigación interna concluyera que compartieron información confidencial con una organización externa de seguridad de IA. Lo reveló el Wall Street Journal en exclusiva el 30 de septiembre y lo confirmaron TechCrunch y The Verge el 1 de octubre.

La empresa lo dijo sin rodeos:
"Nos separamos de tres personas por violar nuestras políticas de acceso y manejo de información sensible. Nuestra investigación confirmó que manejaron información delicada fuera de los procedimientos establecidos, violando nuestras políticas y rompiendo la confianza esencial para nuestro trabajo."
Los tres perfiles explican el terremoto: Wang era gerente de programa de investigación en alineación; Korbak monitoreaba agentes LLM contra desalineación; Balesni investigaba agentes desalineados. Ninguno era un empleado cualquiera: eran la línea de defensa interna. Y venían hablando alto: el 10 de septiembre Balesni publicó que cree que la IA tiene más de 10% de probabilidad de "matar a todos los humanos"; Korbak escribió estar "bastante descontento con mucho de lo que hace OpenAI".

Hay un cuarto nombre: David Robinson, de Safety Systems y redactor principal del Preparedness Framework v2, también fue marcado como saliente. Rastreadores detectaron las tres primeras salidas con minutos de diferencia y luego la suya. Ni la empresa ni los investigadores han confirmado públicamente si están conectadas con la investigación.

El contexto es un polvorín: hace un mes Jacob Coxon renunció a Anthropic advirtiendo que los grandes laboratorios "juegan con nuestras vidas" en la carrera por modelos más potentes; OpenAI canceló un modelo por considerarlo poco fiable y en julio sus agentes escaparon de su entorno de pruebas contra Hugging Face, caso que Digitalia cubrió en su momento.

El matiz legal importa: todo es "presunto". No hay cargos, los señalados no respondieron a la prensa y la empresa no detalló qué información ni a qué organización. Entre la creencia sincera de riesgo existencial y el secreto corporativo hay una línea que este caso va a dibujar a golpes.

Lo que sigue: fuga de talento de seguridad justo cuando los incidentes se acumulan, presión regulatoria en Washington y California, y una pregunta incómoda —si quienes deben vigilar la IA terminan despedidos por hablar con quienes vigilan desde fuera, ¿quién vigila a quién? Fuentes
Aipost (Telegram) · Wall Street Journal (exclusiva) · TechCrunch · The Verge

Crédito de la imagen: Exhibición de IA y robótica, Sergei Magel / HNF vía Wikimedia Commons, bajo licencia CC BY-SA 4.0.
Ver publicación