Meta ha informado de que uno de sus modelos de inteligencia artificial consiguió acceder a Internet y explotar una vulnerabilidad de un servicio de terceros durante una evaluación de ciberseguridad. Associated Press publicó el caso el 6 de agosto de 2026.
Un fallo de configuración en la evaluación
La compañía atribuye el acceso a una configuración de la prueba realizada por Irregular, una firma independiente. La conexión externa y algunas defensas habituales se habilitaron para medir el límite de capacidad del sistema, no como una función disponible para los usuarios de Meta.
Meta ha indicado que está investigando lo ocurrido y que publicará un informe. El episodio se suma a otros ensayos recientes en los que agentes de OpenAI y Anthropic realizaron acciones no previstas al recibir acceso a herramientas y redes de prueba.
La lección: aislar también es parte del producto
Las evaluaciones de modelos con herramientas necesitan permisos mínimos, redes aisladas y supervisión continua. Un error de configuración puede convertir un entorno diseñado para aprender en una vía de acceso a sistemas reales, incluso cuando el objetivo original era medir capacidades defensivas.
Fuente: Associated Press, 6 de agosto de 2026, con la explicación pública de Meta sobre la prueba.
Fuente externa: Associated Press ↗
