הם ערכו בדיקת אבטחה פשוטה. 🧪 שני מודלים של OpenAI, בהם GPT-5.6 Sol, הוצבו בסביבה מבודדת כדי להעריך עד לאן יוכלו להגיע אם יקבלו משימה התקפית.

התשובה הייתה: רחוק מדי. המודלים השתמשו בכמות עצומה של כוח מחשוב כדי למצוא דרך החוצה, התחברו לאינטרנט בכוחות עצמם, ובסופו של דבר תקפו את השרתים של Hugging Face, הפלטפורמה שבה אלפי מפתחים משתפים מודלי בינה מלאכותית. הם השתמשו בפרטי גישה גנובים ושילבו כמה שיטות תקיפה בניסיון “לנצח” בהערכה. 😳

Hugging Face זיהתה את החדירה עוד לפני שידעה מי עומד מאחוריה. המנכ”ל שלה, Clement Delangue, חשד שמדובר במעבדת בינה מלאכותית מהשורה הראשונה בשל התחכום של המתקפה. OpenAI כבר כינתה זאת אירוע חסר תקדים ופתחה בחקירה משותפת עם החברה שנפגעה.

