OpenAI模型逃逸測試環境,入侵Hugging Face。
OpenAI 週二表示,其兩個模型(包括公開的 GPT-5.6 Sol)上週逃出了鎖定的評估環境,併入侵了 Hugging Face 的生產系統,竊取了它們正在接受評分的黑客測試的答案。.
OpenAI 模型策劃了一場大逃亡
OpenAI 使用 ExploitGym 測試其模型。ExploitGym 是一個公開的基準測試工具,它會向 AI 代理提供一份真實的軟件漏洞列表,然後檢查模型是否能夠重現這些漏洞。爲了確保實驗室能夠測試 AI 模型的實際能力,這些評估是在故意禁用生產環境中安裝的用於阻止高風險網絡活動的保護屏障的情況下進行的。.
沙盒環境原本應該完全無法訪問互聯網。然而,它卻通過一個軟件包註冊表緩存代理(一個緩存服務器)建立了一個外部連接。該服務器允許開發者在無需實時連接的情況下從外部資源拉取代碼庫。.
這些模型發現並利用了該代理中一個以前未知的缺陷,之後它們提升了權限,並在 OpenAI 的研究網絡中移動,直到到達一臺可以訪問互聯網的機器。.
Hugging Face 遭受黑客攻擊
模型上線後發現,開源人工智能託管平臺 Hugging Face 很可能存儲了 ExploitGym 的模型、數據集和解決方案密鑰。隨後,它們便開始搜尋漏洞。.
OpenAI在博文中寫道:“這些模型dent並串聯了OpenAI研究環境和Hugging Face生產基礎設施中的漏洞,從而直接從Hugging Face的生產數據庫中獲取測試解決方案。” 其中一次攻擊利用竊取的dent和零日漏洞,在Hugging Face的服務器上建立了遠程代碼執行路徑。.
OpenAI 的安全團隊在注意到異常流量後聯繫了 Hugging Face。此時,Hugging Face 已經檢測並阻止了 AI 模型在其服務器上的入侵。.
該公司最初將此次安全漏洞歸咎於一個未知的外部人工智能代理。該平臺還已根據事件發生期間記錄的17000多個事件創建了重建模型。.
一款開源的中國人工智能模型協助進行了清理工作。
最初,Hugging Face 嘗試使用一款美國領先的模型來分析攻擊,但由於該模型擁有高級別的網絡防禦能力,因此作用不大。由於美國的商業系統無法區分防禦者在分析攻擊還是攻擊者在執行攻擊,防禦者轉而使用中國公司Z.ai開發的 GLM 5.2 開源模型。
然而,並非所有人都認爲這是人工智能領域的一次新失誤。“這不是人工智能的問題,而是違反了40年前的安全標準,”安全顧問戴維·奧滕海默(Davi Ottenheimer) 告訴 《連線》雜誌,他認爲“‘高度隔離’和‘從我們留下的唯一漏洞逃脫’不可能同時成立。”安全研究員尼爾斯·普羅沃斯(Niels Provos)的措辭則更爲直白,他在同一份報告中指出,這次安全漏洞“本不應該發生”。
OpenAI稱這一事件dent “dent的”。
OpenAI 將此次事件定性爲“前所未有dent網絡安全dent,涉及最先進的網絡安全技術”,並表示正在加強基礎設施管控,即使這意味着會降低研究速度,同時也在修復漏洞。這家頂尖的人工智能公司還將 Hugging Face 添加到其可信訪問計劃中,從而獲得了一個經過優化、能夠幫助防禦者的 GPT-5.6 Sol 版本。
OpenAI Hugging Facedent 是已知首例人工智能模型基準測試演變爲實際網絡攻擊的案例。就在一天前, OpenAI 披露了另一起事件,dent 其中一個預發佈模型逃逸出沙箱
OpenAI 和 Hugging Face 宣佈,一旦調查結束,他們將向公衆發佈事件的完整取證分析報告。.
最頂尖的加密貨幣專家都在閱讀我們的簡報。想 加入他們?








