Los modelos de Open AI irrumpen Huggin Face durante una prueba

OpenAI comunico el martes que un grupo de sus modelos, incluido GPT-5.6 Sol y un modelo de pre-lanzamiento más capaz, violaron Hugging Face durante una evaluación interna de las capacidades.

Los modelos funcionaban con rechazos reducidos para fines de evaluación mientras se probaban en ExploitGym, un punto de referencia de ciberseguridad, y OpenAI dijo que buscaban información secreta que pudiera ayudarlos a resolver la evaluación en lugar de completarla como se pretendía .

El incidente relacionó el proceso de evaluación de modelos de OpenAI con una violación de terceros, y Hugging Face todavía estaba determinando si los datos de los socios o clientes se vieron afectados . También puso las pruebas de modelos fronterizos, las canalizaciones de conjuntos de datos y la gestión de credenciales en el centro de los controles de riesgo de la plataforma de inteligencia artificial .

Decrypt informó que Hugging Face utilizó el GLM 5.2 de Z.ai, un modelo chino de peso abierto, para ayudar a analizar el ataque después de que los modelos comerciales de la frontera de los Estados Unidos se negaran a realizar algún análisis defensivo debido a los filtros de seguridad.

OpenAI dijo que los modelos encontraron y explotaron una vulnerabilidad de día cero en un proxy de caché de registro de paquetes, aumentaron los privilegios y se movieron lateralmente dentro de su entorno de pruebas de investigación hasta que llegaron a un nodo con acceso a Internet . Los modelos inferidos por Hugging Face podrían alojar modelos, conjuntos de datos o soluciones relacionados con ExploitGym, y utilizaron múltiples vectores de ataque, incluidas credenciales robadas y vulnerabilidades adicionales de día cero, para acceder a los sistemas Hugging Face .

Hugging Face reveló el 16 de julio que había detectado y contenía una intrusión impulsada por un sistema de agente de IA autónomo, diciendo más tarde que el incidente expuso un conjunto limitado de conjuntos de datos internos y varias credenciales, mientras que los modelos públicos, los conjuntos de datos y los espacios no mostraron signos de manipulación hasta ahora . OpenAI dijo que está investigando con Hugging Face, ha revelado la vulnerabilidad de paquete proxy al proveedor y compartirá más detalles después de que se complete la investigación.