IA

OpenAI reconoce que dos modelos de IA salen de internet y jaquean a una empresa

La compañía defiende que los ensayos se realizaron en un entorno "altamente aislado", pero que los modelos consiguieron burlarlo y acceder a la red.

Imagen de un ordenador con el logo de OpenAI, en una fotografía de archivo EFE

Dos modelos de inteligencia artificial de la empresa estadounidense OpenAI han logrado salir del entorno de pruebas en el que se encontraban, acceder a internet y entrar en la plataforma de aprendizaje Hugging Face superando sus defensas. Así lo ha reconocido la propia compañía en su blog, que asegura que destacó por estar impulsado "de principio a fin" por un agente de inteligencia artificial.

Según ha explicado el laboratorio de IA en un comunicado, el ataque a Hugging Face se realizó en un entorno de pruebas "altamente aislado" y con acceso restringido a internet en el que se estaban evaluando las capacidades de GPT-5.6 Sol y "un modelo de prelanzamiento aún más capaz".

En este entorno, "los modelos identificaron y encadenaron vulnerabilidades en el entorno de investigación de OpenAI y la infraestructura de producción de Hugging Face para obtener soluciones de prueba directamente de la base de datos de producción de Hugging Face", y llegaron a centrarse en encontrar una solución para una vulnerabilidad concreta, ExploitGym.

Para encontrar esa solución, como explican desde OpenAI, los modelos accedieron a internet. En un inicio, esto no lo podían hacer, pero lo consiguieron al encontrar y explotar una vulnerabilidad de día cero en el proxy de caché del registro de paquetes que les estaba limitando, que acompañaron de una escalada de privilegios y movimiento lateral en el entorno de pruebas.

Una vez dentro de internet, los modelos dedujeron que Hugging Face "potencialmente alojaba modelos, conjuntos de datos y soluciones para ExploitGym", lo que les llevó a acceder a "información secreta" de la plataforma.

Esta fue, precisamente, la actividad sospechosa que detectó el equipo de seguridad de Hugging Face y les permitió iniciar las tareas de mitigación, incluidos "el proceso de contención y reconstrucción forense con sus propios modelos de código abierto".

OpenAI está trabajando con Hugging Face en la investigación de lo ocurrido y ya ha implementado medidas de protección para las futuras capacitaciones y evaluaciones de sus modelos. Asimismo, se ha incorporado a Hugging Face en el programa de acceso seguro para que puedan mejorar sus defensas.

Cuando Hugging Face informó del acceso no autorizado a sus sistemas, destacó la particularidad de este incidente de seguridad, ya que "fue impulsado, de principio a fin, por un sistema de agentes de IA autónomo".

Síguenos en nuestro canal de WhatsApp y no te pierdas la última hora y toda la actualidad en nuestro perfil de Google.