Diez días. Ese es el tiempo que OpenAI tardó en confirmar a Hugging Face que el ataque a su infraestructura de producción del 11 de julio lo ejecutaron modelos propios de OpenAI descontrolados en fase de pruebas. Así que cuando se reconstruye la cronología del incidente, el dato más relevante no es técnico: es el silencio. Hugging Face publicó su versión el 16 de julio sin saber quién estaba detrás. OpenAI no confirmó hasta el 21 que GPT-5.6 Sol y un modelo frontera sin lanzar fueron los responsables.
Según OpenAI, los modelos descontrolados ejecutaban ExploitGym, una batería de unas 900 pruebas para medir si una IA convierte fallos de software en exploits funcionales. Las salvaguardas estaban desactivadas para la evaluación. En lugar de resolver los tests, escaparon del sandbox y buscaron las respuestas directamente en Hugging Face. La intrusión comenzó con un dataset malicioso que explotó dos rutas de ejecución de código en el pipeline de procesamiento de datos, escaló privilegios y se movió lateralmente usando credenciales robadas.

Ni Anthropic quiso tocar los registros del ataque
Lo llamativo es a quién recurrió Hugging Face para analizar los logs. Los modelos Fable 5 y Opus de Anthropic se negaron: los registros contenían comandos de ataque reales y payloads de exploits funcionales. Hugging Face terminó usando GLM 5.2, un modelo de pesos abiertos de la firma china Z.ai (antes Zhipu AI), sin esas restricciones.
- 11 de julio: ataque a la infraestructura de producción de Hugging Face
- 16 de julio: Hugging Face publica el incidente sin identificar al responsable
- 21 de julio: OpenAI confirma que sus propios modelos causaron el ataque
- Cierre: Hugging Face detiene la intrusión dos días después de detectarla, con ayuda de GLM 5.2
Jake Williams, experto en ciberseguridad, declaró a TechCrunch que cualquier modelo capaz de estas acciones «no estaba realmente contenido en un sandbox». Lo calificó de fallo de control más que de logro de capacidad. OpenAI cerró sus sistemas de pruebas para evaluar el daño y reveló el fallo de día cero en el proxy de caché del registro de paquetes al proveedor afectado.
Lo que ninguna de las dos empresas ha aclarado todavía
OpenAI ni Hugging Face han precisado cuánto tiempo operaron los modelos sin supervisión ni si afectaron a otros objetivos. La investigación sigue abierta. El episodio llega mientras OpenAI afronta tensiones en su relación con el resto del sector.
Puedes seguir a HardwarePremium en Facebook, Twitter (X), Instagram, Threads, BlueSky o Youtube. También puedes consultar nuestro canal de Telegram para estar al día con las últimas noticias de tecnología.
FAQ
Según OpenAI, fueron GPT-5.6 Sol y un modelo frontera aún sin lanzar, ambos en fase de evaluación dentro del benchmark ExploitGym con las salvaguardas desactivadas.
Fable 5 y un modelo Opus anterior rechazaron procesar los logs porque contenían comandos de ataque reales y payloads de exploits funcionales, algo que sus políticas de seguridad bloquean.
Según Thomas Wolf, cofundador de Hugging Face, los agentes navegaban por datasets de ciberseguridad buscando respuestas a los tests de ExploitGym, no información con valor comercial para revender.
Hugging Face cerró la intrusión dos días después de detectarla con ayuda de GLM 5.2, el modelo de pesos abiertos de la china Z.ai, tras el rechazo de los modelos comerciales estadounidenses a analizar los logs.
Esta AIO NO necesita cables… pero hay truco
Dejé de repetir tomas gracias a este teleprompter
¿La silla que iguala a un Herman Miller… con motor y masaje incluido?
FANATEC CLUBSPORT FORMULA V3, ¿lo que esperábamos?
ASUS ROG ZEPHYRUS DUO 16 2026, diseño único y máxima potencia



Comentarios