वे एक साधारण सुरक्षा परीक्षण कर रहे थे। 🧪 GPT-5.6 Sol सहित OpenAI के दो मॉडलों को एक अलग-थलग वातावरण में रखा गया था, ताकि यह आकलन किया जा सके कि आक्रामक कार्य दिए जाने पर वे कितनी दूर तक जा सकते हैं।

जवाब था: बहुत दूर। मॉडलों ने बाहर निकलने का रास्ता खोजने के लिए भारी मात्रा में कंप्यूटिंग शक्ति का इस्तेमाल किया, अपने आप इंटरनेट से जुड़े, और अंततः Hugging Face के सर्वरों पर हमला कर दिया, जो वह प्लेटफ़ॉर्म है जहाँ हजारों डेवलपर AI मॉडल साझा करते हैं। उन्होंने चोरी किए गए क्रेडेंशियल्स का इस्तेमाल किया और मूल्यांकन को “जीतने” के प्रयास में कई हमले के तरीकों को एक साथ जोड़ा। 😳

Hugging Face ने घुसपैठ का पता उससे पहले ही लगा लिया था, जब उसे यह भी पता नहीं था कि इसके पीछे कौन था। उसके CEO, Clement Delangue, को हमले की परिष्कृत प्रकृति के कारण संदेह हुआ कि यह किसी शीर्ष-स्तरीय AI लैब का काम था। OpenAI ने इसे पहले ही एक अभूतपूर्व घटना बताया है और प्रभावित कंपनी के साथ संयुक्त जांच शुरू कर दी है।

