OpenAI frena su entrenamiento por señales de «desalineación» en sus modelos

OpenAI frena su entrenamiento por señales de «desalineación» en sus modelos
OpenAI decidió «pausar» de forma temporal el desarrollo de nuevos modelos luego de que sus equipos de seguridad detectaran «varios grados de desalineación» en las investigaciones más recientes. La confirmación llegó de la mano del propio Sam Altman en una entrevista con la revista Time.

Según el reportaje, los investigadores internos habrían observado que algunos de los modelos bajo entrenamiento empezaban a desviarse del comportamiento previsto, desarrollando respuestas y estrategias que no encajaban con los objetivos definidos por la compañía. Aunque Altman no reveló métricas concretas, calificó el fenómeno como «una señal suficiente para frenar la marcha y reevaluar antes de continuar».

La decisión coincide con un giro más amplio en la industria: en las últimas semanas, varias firmas de inteligencia artificial han reforzado sus protocolos de evaluación interna ante la proximidad de sistemas con capacidades cibernéticas críticas, un umbral definido por el Preparedness Framework de OpenAI como punto en el que un modelo puede ser usado para causar daño a gran escala.

El aplazamiento no detiene todo el trabajo de la compañía —los productos en producción como ChatGPT siguen operando con normalidad—, pero sí afecta el calendario interno para el próximo modelo frontera de la organización, una decisión que ahora queda en manos del equipo de seguridad hasta nuevo aviso.

Fuente: [Time]. Imagen: Time.
Ver publicación