Claude Opus 4.7 entra en tres organizaciones por un fallo de configuración en pruebas de Anthropic

Anthropic detectó tres intrusiones tras 141.000 pruebas: sus modelos aprovecharon contraseñas débiles y accesos sin autenticar para moverse por redes expuestas.

01 de agosto de 2026 a las 13:55h
Claude Opus 4.7 entra en tres organizaciones por un fallo de configuración en pruebas de Anthropic
Claude Opus 4.7 entra en tres organizaciones por un fallo de configuración en pruebas de Anthropic

Añadir Mangas Verdes como fuente preferida de Google de forma gratuita.

Mantente informado con las últimas noticias de actualidad.

Activar ahora

Una inteligencia artificial de Anthropic logró entrar en los sistemas de tres organizaciones durante pruebas de ciberseguridad.

El detalle incómodo no está en una técnica fuera de alcance, sino en algo mucho más terrenal. Un fallo de configuración permitió que Claude Opus 4.7, Claude Mythos 5 y un tercer modelo de investigación accedieran a internet y aprovecharan contraseñas débiles y puntos de acceso sin autenticar para moverse dentro de esas redes.

Anthropic detectó tres intrusiones tras revisar 141.000 pruebas

Anthropic examinó más de 141.000 pruebas e identificó tres incidentes, con primeros casos que se remontan a abril. La escena describe bien una paradoja conocida en seguridad, porque a veces el problema no nace de una herramienta muy compleja, sino de una puerta mal cerrada.

En esas evaluaciones, la compañía plantea al modelo un escenario ficticio donde una información secreta, la bandera, está oculta en otra máquina de la red. Su objetivo consiste en infiltrarse y recuperarla.

"Se le presenta al modelo un escenario ficticio y se le indica que una información secreta, la bandera, está oculta en otra máquina de la red, y su objetivo es infiltrarse y recuperarla" - Anthropic

Ahí aparece la diferencia entre un experimento controlado y un susto operativo. La empresa de San Francisco sostiene que lo ocurrido responde a un fallo de infraestructura y de configuración, no a un fallo de alineación del modelo.

Las técnicas fueron básicas y eso vuelve el episodio más inquietante

No hizo falta un repertorio sofisticado. Los modelos vulneraron la infraestructura con recursos tan elementales como la explotación de contraseñas débiles y de accesos no autenticados, un terreno que ya había asomado en simulaciones de ataques con Mythos.

Dicho de otro modo, el episodio no obliga a imaginar máquinas capaces de romper cualquier defensa. Obliga a mirar algo más prosaico, porque una IA conectada a internet puede sacar partido de errores que llevan años entre los más comunes de la ciberseguridad.

"Estos hechos nos dan motivos para un optimismo cauteloso de que, con una supervisión y unos controles más estrictos en torno a la infraestructura de evaluación, así como una inversión continua en la alineación, este tipo de riesgo puede superarse" - Anthropic

Silicon Valley ya discute la IA también como problema laboral y social

Mientras tanto, la discusión sobre inteligencia artificial se ha movido del laboratorio al lugar de trabajo. Trabajadores del sector tecnológico en Silicon Valley se han movilizado por la pérdida de empleos y por el temor a que estos sistemas pongan en peligro a la humanidad, una tensión que también atraviesa debates sobre algoritmos en el empleo.

Resulta difícil no ver la contradicción. Al mismo tiempo que una empresa atribuye estos episodios a un problema de configuración, la sola imagen de un modelo entrando en tres organizaciones durante pruebas controladas basta para alimentar un miedo muy antiguo en tecnología, el de que el mayor riesgo no siempre nace de la intención de la máquina, sino del descuido humano que le abre la puerta.

Sobre el autor
Redacción
Ver biografía