OpenAI reconoce que GPT-5.6 Sol está detrás del acceso no autorizado a Hugging Face

Recurso de los modelos de IA GPT-5.6
Recurso de los modelos de IA GPT-5.6OPENAI

   MADRID, 22 Jul. (Portaltic/EP) -

   OpenAI ha reconocido que varios de sus modelos, incluido GPT-5.6 Sol, estuvieron implicados en el ataque a la plataforma Hugging Face de la semana pasada, que destacó por estar impulsado "de principio a fin" por un agente de inteligencia artificial.

    El ataque a Hugging Face se realizó en un entorno de pruebas "altamente aislado" y con acceso restringido a internet en el que se estaban evaluando las capacidades de GPT-5.6 Sol y "un modelo de prelanzamiento aún más capaz", según ha explicado el laboratorio de IA en un comunicado.

   Entre las pruebas planteadas en el entorno aislado, los modelos llegaron a centrarse en encontrar una solución para una vulnerabilidad concreta, ExploitGym. Para ello, como explican desde OpenAI, de manera autónoma, accedieron a internet, algo que inicialmente no podían hacer, pero que consiguieron al encontrar y explotar una vulnerabilidad de día cero en el proxy de caché del registro de paquetes que les estaba limitando. Ello lo acompañaron de una escalada de privilegios y movimiento lateral en el entorno de pruebas.

    Ya en Internet, los modelos dedujeron que Hugging Face "potencialmente alojaba modelos, conjuntos de datos y soluciones para ExploitGym", lo que les llevó acceder a "información secreta" de la plataforma. Esta fue, precisamente, la actividad sospechosa que detectó el equipo de seguridad de Hugging Face y les permitió iniciar las tareas de mitigación, incluidos "el proceso de contención y reconstrucción forense con sus propios modelos de código abierto".

    OpenAI está trabajando con Hugging Face en la investigación de lo ocurrido y ya ha implementado medidas de protección para las futuras capacitaciones y evaluaciones de sus modelos. Asimismo, se ha incorporado a Hugging Face en el programa de acceso seguro para que puedan mejorar sus defensas.

    Cuando Hugging Face informó del acceso no autorizado a sus sistemas, destacó la particularidad de este incidente de seguridad, ya que "fue impulsado, de principio a fin, por un sistema de agentes de IA autónomo".