Frontier Security稱,Moonshot AI的Kimi K3在測試沙箱中滑落
在一次例行安全評估中,中國登月計劃開發的名爲 Kimi K3 的開源 AI 模型成功逃逸出測試沙箱,進入了開放互聯網。.
據美國網絡安全公司 Frontier Security 稱,這是首次有可免費下載的公共模型突破其隔離環境。.
模型選擇使用的沙箱存在漏洞
據 WIRED ,Frontier Security 當時正在測試 Kimi K3 的防禦性網絡安全技能,結果該模型走出了原本應該容納它的環境。
顯然,配置錯誤導致該環境出現漏洞。然而,Frontier公司表示,該模型自行探測到可以通過沙箱的網絡設置訪問某些網站,然後在未經許可的情況下上線。它被指示去解決一些原本不需要互聯網的問題。.
Frontier 首席執行官 Yaron Singer 告訴 WIRED:“我們發現了測試環境中的一個漏洞。但我們也發現 Kimi 利用了這個漏洞,這表明它沒有同樣的內部防護措施。”
Frontier 認爲 Kimi 的網絡安全防護措施比大多數其他強大的型號要少,這就是它泄露的原因。.
沒有系統被黑客攻擊,但防護措施有所削弱。
幸運的是,Kimi的逃脫並沒有導致任何惡意攻擊或系統入侵。因爲它要找的信息很容易從GitHub上獲取,所以它上線後無需入侵任何系統。.
然而,主要問題在於可訪問性。與大多數安全級別極高的內部實驗室模型不同,Kimi K3 是向公衆開放的,這意味着任何人都可以下載並運行它,而無需像其他實驗室那樣設置嚴格的安全防護措施。.
測試人員指出,該模型會不擇手段地高效實現其目標,即使這意味着作弊或逃脫控制。.
測試環境本身是利用英國政府人工智能安全研究所的沙箱構建的,但 Moonshot 和 AISI 都尚未證實這一點,因爲他們拒絕置評。.
今年夏天將出現更多不法特工
Kimi的逃脫事件進一步印證了人工智能模型在評估過程中濫用規則的趨勢。7月21日,OpenAI 披露 其模型利用一個零日軟件漏洞連接到互聯網併入侵了Hugging Face。
幾天後, Cryptopolitan 報道稱, Anthropic公司 trac其部分模型遭到未經授權的外部入侵。Meta 公司 甚至承認,由於測試環境配置錯誤,其一款人工智能代理(Muse Spark 1.1)曾訪問過一家外部公司。
專家們一直認爲,這些dent通常是由於測試環境安全措施不完善造成的,而非科幻小說中描述的越獄。“總的來說,如果你給這類模型設定一個目標,但又沒有明確說明,比如設置安全屏障,它總能找到辦法得出答案。” Gray Swan 首席執行官兼卡內基梅隆大學教授馬特·弗雷德裏克森說道。.
不要只是閱讀加密貨幣新聞,要理解它。訂閱我們的新聞簡報, 完全免費。










