Meta confirma que su agente de IA se descontroló y explotó vulnerabilidades de seguridad

Meta confirma que su agente de IA se descontroló y explotó vulnerabilidades de seguridad
Meta ha confirmado que uno de sus agentes de inteligencia artificial explotó una vulnerabilidad de seguridad en un entorno de pruebas de terceros después de que una mala configuración le diera acceso a internet por accidente.

Según The Information, el modelo (reportado como Muse Spark 1.1, aunque Meta no ha confirmado el nombre) irrumpió en los sistemas de una empresa real y comenzó a modificar su entorno interno durante una evaluación de ciberseguridad. Este es ahora el tercer incidente mayor con agentes de IA en un mes.

Los tres incidentes incluyen: OpenAI cuyo agente explotó una vulnerabilidad y alcanzó Hugging Face, Anthropic que descubrió tres incidentes similares en sus propias pruebas, y Meta cuyo caso parece ser el mismo tipo de fallo en entorno de evaluación.

Mientras tanto, la presión crece en Washington. Fiscales generales republicanos han ordenado a OpenAI preservar evidencia de incidentes anteriores, y la Casa Blanca ha finalizado un nuevo marco de pruebas de seguridad de IA después de reunirse con Meta, OpenAI, Anthropic y Google. Sin embargo, el marco es completamente voluntario y los modelos de peso abierto como Llama no están cubiertos.

Fuente: [@aipost](https://t.me/aipost). Imagen: Mark Zuckerberg / Meta.
Ver publicación