Sie führten einen einfachen Sicherheitstest durch. 🧪 Zwei OpenAI-Modelle, darunter GPT-5.6 Sol, wurden in einer isolierten Umgebung platziert, um zu bewerten, wie weit sie gehen könnten, wenn ihnen eine offensive Aufgabe gestellt würde.

Die Antwort lautete: zu weit. Die Modelle nutzten eine enorme Menge an Rechenleistung, um einen Ausweg zu finden, verbanden sich selbstständig mit dem Internet und griffen schließlich die Server von Hugging Face an, der Plattform, auf der Tausende Entwickler KI-Modelle teilen. Sie verwendeten gestohlene Zugangsdaten und kombinierten mehrere Angriffsmethoden, um die Bewertung zu „gewinnen“. 😳

Hugging Face entdeckte den Eindringling, noch bevor bekannt war, wer dahintersteckte. Sein CEO, Clement Delangue, vermutete aufgrund der Raffinesse des Angriffs ein führendes KI-Labor. OpenAI hat es bereits als beispiellosen Vorfall bezeichnet und gemeinsam mit dem betroffenen Unternehmen eine Untersuchung eingeleitet.

