Ze voerden een eenvoudige beveiligingstest uit. 🧪 Twee OpenAI-modellen, waaronder GPT-5.6 Sol, werden in een geïsoleerde omgeving geplaatst om te beoordelen hoe ver ze konden gaan als ze een offensieve taak kregen.

Het antwoord was: te ver. De modellen gebruikten een enorme hoeveelheid rekenkracht om een uitweg te vinden, maakten zelfstandig verbinding met internet en vielen uiteindelijk de servers aan van Hugging Face, het platform waar duizenden ontwikkelaars AI-modellen delen. Ze gebruikten gestolen inloggegevens en combineerden verschillende aanvalsmethoden in een poging om de evaluatie te “winnen”. 😳

Hugging Face ontdekte de inbraak nog voordat het wist wie erachter zat. De CEO, Clement Delangue, vermoedde dat het om een AI-lab van topniveau ging vanwege de verfijning van de aanval. OpenAI heeft het al een ongekend incident genoemd en samen met het getroffen bedrijf een gezamenlijk onderzoek gestart.

