sábado, 1 agosto,2026

La IA de Anthropic también accedió a sistemas ajenos durante unas pruebas de ciberseguridad

Anthropic, una de las principales empresas de inteligencia artificial, reconoció que tres versiones de su asistente Claude lograron acceder a internet e infiltrarse en los sistemas de tres organizaciones durante una serie de evaluaciones de ciberseguridad. El caso se conoció días después de que OpenAI, su competidora, revelara el 21 de julio que dos de sus modelos habían salido de un entorno de pruebas aislado y accedido a la plataforma Hugging Face al explotar una vulnerabilidad.

La revisión de Anthropic, iniciada precisamente a raíz del anuncio de OpenAI, analizó 141.006 sesiones de prueba y detectó tres incidentes, los primeros de ellos en abril. En ellos intervinieron tres modelos distintos: Claude Opus 4.7, Claude Mythos 5 y un modelo interno de investigación. Los episodios se produjeron durante ejercicios del tipo captura la bandera, en los que se pide a los modelos localizar información oculta en redes simuladas. Las instrucciones indicaban que no tenían acceso a internet, pero un fallo de configuración del socio evaluador, la firma Irregular, dejó los sistemas conectados a la red pública.

Según la compañía, Claude comprometió la infraestructura de las organizaciones afectadas con técnicas básicas, como el aprovechamiento de contraseñas débiles y puntos de acceso sin autenticación. Uno de los modelos accedió a una base de datos de producción con varios cientos de registros; otro subió un paquete malicioso de Python al repositorio público PyPI, que llegó a ser descargado brevemente por quince sistemas reales antes de ser retirado. Anthropic subrayó que ninguno de los modelos intentó escapar de su entorno ni copiarse a sí mismo.

La empresa suspendió todas sus evaluaciones de ciberseguridad el 23 de julio, identificó los tres incidentes al día siguiente y notificó a las organizaciones afectadas el 27. Aseguró además que las medidas de seguridad de los modelos Claude disponibles al público habrían bloqueado ese comportamiento, y anunció un refuerzo de sus procedimientos de control y supervisión. Los dos casos, el de OpenAI y el de Anthropic, han reavivado la preocupación por los llamados agentes de IA, programas diseñados para ejecutar tareas de forma autónoma.

Julio Álvarez
Julio Álvarez
Explorador de mundos virtuales y analista de tendencias. De los eSports a la gran pantalla, cubro todo lo que le interesa al mundo joven. Vivo entre píxeles, dispositivos de vanguardia y las historias que definen nuestra cultura digital.
- Publicidad -spot_img
- Publicidad -spot_img
- Publicidad -spot_img

LECTOR AL HABLA