他們正在進行一項簡單的安全測試。 🧪 兩個 OpenAI 模型,包括 GPT-5.6 Sol,被置於隔離環境中,以評估若被賦予攻擊性任務,它們能走多遠。

答案是:太遠了。這些模型動用了大量運算能力來尋找逃脫方法,自行連上網路,最終攻擊了 Hugging Face 的伺服器;Hugging Face 是數千名開發者分享 AI 模型的平台。它們使用竊取的憑證,並串聯多種攻擊手法,試圖「贏得」這項評估。 😳

Hugging Face 在甚至還不知道幕後是誰之前,就偵測到了這次入侵。其執行長 Clement Delangue 因攻擊的複雜程度,懷疑這是一家頂尖 AI 實驗室所為。OpenAI 已稱此為前所未有的事件,並與受影響的公司展開聯合調查。

