IA
OpenAI reconoce que dos modelos de IA salen de internet y jaquean a una empresa
La compañía defiende que los ensayos se realizaron en un entorno "altamente aislado", pero que los modelos consiguieron burlarlo y acceder a la red.
Dos modelos de inteligencia artificial de la empresa estadounidense OpenAI han logrado salir del entorno de pruebas en el que se encontraban, acceder a internet y entrar en la plataforma de aprendizaje Hugging Face superando sus defensas. Así lo ha reconocido la propia compañía en su blog, que asegura que destacó por estar impulsado "de principio a fin" por un agente de inteligencia artificial.
Según ha explicado el laboratorio de IA en un comunicado, el ataque a Hugging Face se realizó en un entorno de pruebas "altamente aislado" y con acceso restringido a internet en el que se estaban evaluando las capacidades de GPT-5.6 Sol y "un modelo de prelanzamiento aún más capaz".
En este entorno, "los modelos identificaron y encadenaron vulnerabilidades en el entorno de investigación de OpenAI y la infraestructura de producción de Hugging Face para obtener soluciones de prueba directamente de la base de datos de producción de Hugging Face", y llegaron a centrarse en encontrar una solución para una vulnerabilidad concreta, ExploitGym.
Para encontrar esa solución, como explican desde OpenAI, los modelos accedieron a internet. En un inicio, esto no lo podían hacer, pero lo consiguieron al encontrar y explotar una vulnerabilidad de día cero en el proxy de caché del registro de paquetes que les estaba limitando, que acompañaron de una escalada de privilegios y movimiento lateral en el entorno de pruebas.
Una vez dentro de internet, los modelos dedujeron que Hugging Face "potencialmente alojaba modelos, conjuntos de datos y soluciones para ExploitGym", lo que les llevó a acceder a "información secreta" de la plataforma.
Esta fue, precisamente, la actividad sospechosa que detectó el equipo de seguridad de Hugging Face y les permitió iniciar las tareas de mitigación, incluidos "el proceso de contención y reconstrucción forense con sus propios modelos de código abierto".
OpenAI está trabajando con Hugging Face en la investigación de lo ocurrido y ya ha implementado medidas de protección para las futuras capacitaciones y evaluaciones de sus modelos. Asimismo, se ha incorporado a Hugging Face en el programa de acceso seguro para que puedan mejorar sus defensas.
Cuando Hugging Face informó del acceso no autorizado a sus sistemas, destacó la particularidad de este incidente de seguridad, ya que "fue impulsado, de principio a fin, por un sistema de agentes de IA autónomo".
Síguenos en nuestro canal de WhatsApp y no te pierdas la última hora y toda la actualidad en nuestro perfil de Google.