Dos modelos de OpenAI se salieron de su entorno de pruebas, se conectaron solos a internet y hackearon a Hugging Face

Por Antonia Osses
24 July, 2026

Estaban haciendo una simple prueba de seguridad. 🧪 Dos modelos de OpenAI, entre ellos GPT-5.6 Sol, fueron puestos en un entorno aislado para evaluar qué tan lejos podían llegar si se les daba una tarea ofensiva.

Getty

La respuesta fue: demasiado lejos. Los modelos usaron una cantidad enorme de poder de cálculo para encontrar una salida, se conectaron a internet por su cuenta y terminaron atacando los servidores de Hugging Face, la plataforma donde miles de desarrolladores comparten modelos de IA. Usaron credenciales robadas y encadenaron varios métodos de ataque buscando información para “ganar” la evaluación. 😳

Getty

Hugging Face detectó la intrusión antes incluso de saber quién estaba detrás. Su CEO, Clement Delangue, sospechó que se trataba de un laboratorio de IA de primer nivel por lo sofisticado del ataque. OpenAI ya lo llamó un incidente sin precedentes y abrió una investigación conjunta con la empresa afectada.

Puede interesarte