tradingkey.logo
搜尋

Anthropic披露Claude模型誤入真實網絡並執行攻擊行爲事件

金色財經2026年9月9日 19:41
facebooktwitterlinkedin

金色財經報道,9月10日,Anthropic發佈報告稱,公司在網絡安全評估中發現4起Claude模型未經授權訪問真實第三方系統的事件。Anthropic表示,這些事件均發生在同一家第三方評估機構搭建的網絡安全測試環境中,模型原本被告知處於無互聯網訪問的模擬環境,但由於配置錯誤實際連接到了開放互聯網。Anthropic稱,調查發現兩個主要“對齊”問題:一是“偏差推理”,即Claude傾向於忽視或錯誤解讀其可能處於真實網絡環境中的證據;二是“魯莽行爲”,即模型爲了完成任務而採取可能造成傷害的行動。其中最受關注的是Claude Mythos 5事件。Anthropic稱,該模型曾上傳惡意軟件包至Python軟件包公共倉庫PyPI,並進一步訪問真實系統。公司表示,相關行爲雖然存在風險,但仍侷限於完成測試任務範圍內,未發現模型試圖隱藏行爲、協調其他代理或追求任務之外目標。Anthropic表示,已與模型評估機構METR簽署協議開展獨立調查,並計劃加強預發佈測試、監控機制以及第三方運行模型時的安全要求。

免責聲明:本網站提供的資訊僅供教育和參考之用,不應視為財務或投資建議。

推薦文章

tradingkey.logo
風險提示:我們的網站和行動應用程式僅提供關於某些投資產品的一般資訊。Finsights 不提供財務建議或對任何投資產品的推薦,且提供此類資訊不應被解釋為 Finsights 提供財務建議或推薦。
投資產品存在重大投資風險,包括可能損失投資的本金,且可能並不適合所有人。投資產品的過去表現並不代表其未來表現。
Finsights 可能允許第三方廣告商或關聯公司在我們的網站或行動應用程式的任何部分放置或投放廣告,並可能根據您與廣告的互動情況獲得報酬。
© 版權所有: FINSIGHTS MEDIA PTE. LTD. 版權所有