OpenAI reconoce que GPT-5.6 Sol está detrás del acceso no autorizado a Hugging Face

Recurso de los modelos de IA GPT-5.6
Recurso de los modelos de IA GPT-5.6- OPENAI

   MADRID, 22 Jul. (Portaltic/EP) -

   OpenAI ha reconocido que varios de sus modelos, incluido GPT-5.6 Sol, estuvieron implicados en el ataque a la plataforma Hugging Face de la semana pasada, que destacó por estar impulsado "de principio a fin" por un agente de inteligencia artificial.

    El ataque a Hugging Face se realizó en un entorno de pruebas "altamente aislado" y con acceso restringido a internet en el que se estaban evaluando las capacidades de GPT-5.6 Sol y "un modelo de prelanzamiento aún más capaz", según ha explicado el laboratorio de IA en un comunicado.

     "Los modelos identificaron y encadenaron vulnerabilidades en el entorno de investigación de OpenAI y la infraestructura de producción de Hugging Face para obtener soluciones de prueba directamente de la base de datos de producción de Hugging Face".

   Entre las pruebas planteadas en el entorno aislado, los modelos llegaron a centrarse en encontrar una solución para una vulnerabilidad concreta, ExploitGym. Para ello, como explican desde OpenAI, de manera autónoma, accedieron a internet, algo que inicialmente no podían hacer, pero que consiguieron al encontrar y explotar una vulnerabilidad de día cero en el proxy de caché del registro de paquetes que les estaba limitando. Ello lo acompañaron de una escalada de privilegios y movimiento lateral en el entorno de pruebas.

    Ya en Internet, los modelos dedujeron que Hugging Face "potencialmente alojaba modelos, conjuntos de datos y soluciones para ExploitGym", lo que les llevó acceder a "información secreta" de la plataforma. Esta fue, precisamente, la actividad sospechosa que detectó el equipo de seguridad de Hugging Face y les permitió iniciar las tareas de mitigación, incluidos "el proceso de contención y reconstrucción forense con sus propios modelos de código abierto".

    OpenAI está trabajando con Hugging Face en la investigación de lo ocurrido y ya ha implementado medidas de protección para las futuras capacitaciones y evaluaciones de sus modelos. Asimismo, se ha incorporado a Hugging Face en el programa de acceso seguro para que puedan mejorar sus defensas.

    Cuando Hugging Face informó del acceso no autorizado a sus sistemas, destacó la particularidad de este incidente de seguridad, ya que "fue impulsado, de principio a fin, por un sistema de agentes de IA autónomo".

Artículos Relacionados

Últimas noticias sobre estos temas

Contenido patrocinado