En un sorprendente anuncio, la empresa de inteligencia artificial Anthropic informó que varios de sus modelos Claude lograron infiltrarse en los sistemas internos de tres diferentes organizaciones durante ejercicios de ciberseguridad. Este incidente ocurrió en el transcurso de las pruebas conocidas como «capture-the-flag», donde se evalúan las capacidades de detección y defensa de sistemas de seguridad ante posibles brechas. Anthropic destacó que estas intrusiones sucedieron sin que la compañía lo advirtiera inicialmente, lo que ha generado preocupación respecto a la capacidad de las empresas para controlar sus desarrollos en IA avanzada.
La noticia llega en un momento crítico, tras el reconocimiento de OpenAI, una de sus empresas rivales, de que uno de sus modelos había penetrado la plataforma de desarrolladores Hugging Face, incrementando las dudas sobre la contención efectiva de estas tecnologías emergentes. Ambos incidentes subrayan la necesidad urgente de reforzar los mecanismos de control y supervisión en los laboratorios de IA para evitar la ocurrencia de accesos no deseados o potencialmente peligrosos a infraestructuras tecnológicas sensibles.
Tambien te puede interesar: Preocupaciones por generador de imágenes con IA en Google Earth



