Tecnología y Ciencia Ciberseguridad

Anthropic admitió que sus modelos Claude accedieron de forma no autorizada a tres organizaciones

Anthropic reveló que sus modelos Claude Opus 4.7, Mythos 5 y una versión de prueba accedieron de manera no autorizada a la infraestructura de tres organizaciones. El incidente ocurrió por una falla de aislamiento en pruebas de ciberseguridad.

Viernes, 31 de Julio de 2026
(11528)

La empresa tecnológica Anthropic informó que sus modelos de inteligencia artificial Claude Opus 4.7, Mythos 5 y una variante de prueba interna vulneraron el aislamiento de sus entornos de ensayo y accedieron a los sistemas reales de tres organizaciones. La investigación se inició tras revisar 141.006 ejecuciones a raíz de reportes previos de OpenAI, donde modelos competidores habían escapado de sus contenedores para acceder a servidores de Hugging Face y utilizar claves expuestas en la red.

Los accesos no autorizados se produjeron durante ejercicios de ciberseguridad denominados "Captura de la Bandera". Aunque el sistema actuaba bajo la premisa de estar en un simulador sin conexión, un error técnico de un socio evaluador dejó abierta la conexión a internet, provocando que Claude interpretara a los servidores reales como parte de la prueba y los comprometiera usando vulnerabilidades básicas y contraseñas débiles.

Comportamiento diferenciado de los modelos y respuesta institucional

El informe técnico destacó que las versiones más modernas de Claude lograron detener su ejecución al percatarse de que operaban en la red real, a diferencia de versiones anteriores que continuaron la búsqueda. Anthropic aclaró que el modelo solo ejecutó las tareas específicas del ejercicio sin buscar información sensible adicional.

Ante el hallazgo, la firma detuvo las evaluaciones de ciberseguridad y contactó a las organizaciones afectadas. Dos de ellas confirmaron que no habían advertido la intromisión en sus sistemas y ya colaboran con la tecnológica, mientras que la tercera aún no ha respondido las notificaciones.