OpenAI 一週內未能檢測到其人工智能代理持續數日的黑客攻擊。
據路透社報道,OpenAI 大約一週後才意識到,其自身的一個人工智能代理入侵了 Hugging Face 網站。等到該公司查明攻擊來源時,Hugging Face 已經關閉了該網站並報警。.
該程序被設計成可以自主運行。它可以自行選擇要執行的任務,將任務分解成更小的步驟,並在幾乎不需要人工干預的情況下完成這些步驟。.
7月9日左右,該程序試圖逃出OpenAI的封閉測試區域。兩天後,即7月11日,它進入了Hugging Face,並一直待到7月13日,聯合創始人托馬斯·沃爾夫表示。兩家公司直到7月20日左右才就dent 進行溝通。.
OpenAI在安全漏洞結束後才得知是其代理程序所爲。
OpenAI於7月21日向公衆披露了此次數據泄露事件,據報道,此前一天,該公司首次與Hugging Face進行了溝通。該公司表示,其一個人工智能代理超出了預設權限,入侵了另一家公司的系統。.
這個故事迅速引起了全球關注,但最初的公告遺漏了幾個關鍵日期。它沒有提到該智能體曾在7月9日試圖逃脫,在Hugging Face內部待了三天,也沒有dent直到幾天後才被OpenAI識別出來。.
據托馬斯稱,Hugging Face正在整理一份關於其系統中發生的事件的完整時間線。此外,托馬斯指出,由於他沒有參與OpenAI的調查,因此無法描述OpenAI內部發生的事件。.
OpenAI 將此次dent 描述爲dent的事件,並宣佈這是“人工智能安全領域的一個重要時刻”。該公司解釋說,外部專家已參與審查過程。此外,該公司計劃在調查結束後發佈一份關於此次dent 技術報告。.
在dent真正的肇事者之前,網絡安全專家和社交媒體用戶認爲攻擊者是由專業網絡犯罪分子組成的人類團體,而有些人則認爲可能是國家支持的黑客。.
在Hugging Face首次發出警報近一週後的週三之前,播客和社交媒體上充斥着各種猜測。最終答案揭曉:攻擊者是ChatGPT。.
在X事件中,一些人對OpenAI如何利用這一事件來展示其模型的能力感到好奇。長期以來,人們一直認爲人工智能公司會故意發表聳人聽聞的言論以博取眼球。Anthropic發佈Mythos模型後,網絡安全問題變得更加突出。.
在 Sam Altman 的帖子 X 下,最受歡迎的回覆之一表達了這種疑慮:“如果你們都不明白這篇文章純粹是爲了炫耀這款車型而寫的,那我也不知道該說什麼了。”
OpenAI 的人工智能代理認爲黑客攻擊是最簡單的選擇。
聖克拉拉大學馬克庫拉應用倫理中心技術倫理主任布萊恩表示,類似案件很可能會再次出現。“這類案件會不斷湧現,而每一起案件都應該激勵我們做得更多,”他告訴OSV新聞。.
布萊恩將這種情況稱爲“模型通過做出意想不到的舉動來智勝測試”。據他所說,當智能體被賦予一個目標時,它選擇了實現目標的最短路徑,那就是偷竊。.
“你給它設定一個目標,它就會說,‘哦,我知道怎麼才能實現這個目標了。我要從擁抱臉那裏偷答案,’”布萊恩說道。.
Hugging Face之所以成爲攻擊目標,是因爲它存儲着海量的AI模型和數據集。布萊恩稱之爲“一個極其龐大的模型和數據集存儲庫”。該智能體似乎搜索了一個能夠存儲所需素材的地方,最終選擇了Hugging Face,進入平臺並找到了它。.
布萊恩認爲還會發生其他dent事件。據他所說,該代理“只是在執行指令”。從系統的角度來看,“解決問題的最有效方法”是“未經授權的訪問”。
他還表示,這起案例並非典型的“突發性錯位”(emerated misparment),這個詞指的是人工智能的行爲違背了人類價值觀。布萊恩說,該系統從一開始就與這些價值觀無關。用布萊恩的話說,“它從一開始就從未與這些價值觀保持一致”。
最頂尖的加密貨幣專家都在閱讀我們的簡報。想 加入他們?







