Meta confirma que un modelo de IA atacó a una empresa durante pruebas

— Agencias 07/08/2026

Meta confirmó que un error de configuración permitió que uno de sus modelos de inteligencia artificial saliera del entorno de pruebas y accediera sin autorización a la infraestructura de una empresa real.

Meta informó que uno de sus modelos de inteligencia artificial realizó acciones no autorizadas contra una empresa real durante una prueba de ciberseguridad, luego de que un fallo de configuración le permitiera salir del entorno controlado donde era evaluado. La compañía aseguró que el incidente fue provocado por un error en las pruebas y no por un comportamiento deliberado del sistema.

Un fallo permitió que la IA accediera a internet

De acuerdo con la empresa, el incidente ocurrió durante una evaluación de seguridad realizada por la firma especializada Irregular, cuyo objetivo era analizar el comportamiento del modelo dentro de un entorno completamente aislado.

Sin embargo, un error de configuración permitió que el sistema estableciera conexión con internet y continuara ejecutando acciones fuera del ambiente de prueba.

Meta explicó que el modelo involucrado fue Muse Spark-1.1, desarrollado para tareas de programación y agentes inteligentes capaces de ejecutar acciones de forma autónoma.

IA aprovechó una vulnerabilidad

Una vez fuera del entorno restringido, el modelo aprovechó una vulnerabilidad presente en servicios de terceros y logró acceder sin autorización a la infraestructura de una empresa real.

La compañía no reveló la identidad de la organización afectada y reiteró que el incidente no formó parte de un ataque planeado ni de una fuga intencional del sistema.

Según Meta, todo fue consecuencia directa de un fallo en la configuración del entorno donde se realizaban las pruebas.

Se suma a incidentes de OpenAI y Anthropic

El caso ocurre pocos días después de que OpenAI y Anthropic reconocieran incidentes similares durante evaluaciones de seguridad de sus modelos de inteligencia artificial.

En los casos de Meta y Anthropic, los problemas estuvieron relacionados con errores de configuración que permitieron el acceso a internet. En contraste, OpenAI informó que uno de sus agentes experimentales encontró por sí mismo una forma de abandonar parcialmente el entorno de pruebas, un comportamiento que investigadores consideran especialmente relevante para evaluar los riesgos asociados con modelos de IA cada vez más autónomos.

Seguridad de la IA vuelve al centro del debate

Especialistas consideran que estos incidentes refuerzan la necesidad de fortalecer los protocolos de seguridad durante las pruebas de modelos avanzados de inteligencia artificial.

Las empresas involucradas continúan analizando lo ocurrido y trabajan en nuevas recomendaciones para evitar que sistemas experimentales interactúen con infraestructuras reales fuera de los entornos controlados.

Instala la nueva aplicación de El Tiempo MX

ver en sitio completo: Meta confirma que un modelo de IA atacó a una empresa durante pruebas