Z.ai稱GLM-5.3在網絡安全測試中勝過Anthropic的Mythos 5。
中國人工智能公司智普人工智能(HKG:2513)在推出最新 GLM-5.3 模型的同時,也發佈了一份文件,旨在探索大型人工智能領域。.
這家以 Z.ai 爲國際品牌的公司 特別指出 Anthropic 的 Mythos 5 是 GLM-5.3 在 CyberGym 基準測試中表現優於的模型之一,該基準測試衡量模型檢查源代碼中軟件漏洞的能力。
GLM-5.3 運行在與 GLM-5.2 相同的基本模型上,這是一個 7430 億參數的專家混合設計,每個令牌激活大約 400 億個參數。.
Z.ai 的 GLM-5.3 與其他模型相比如何?
根據 Z.ai 公佈的數據,其 GLM-5.3 在 CyberGym 基準測試中得分 84.5%,僅比 Anthropic 的 Mythos 5 (83.8%) 和 OpenAI 的 GPT-5.6 Sol (83.6%) 領先不到 1 分。
如果 Z.ai 能夠擊敗 Mythos,它有望成爲開發者和安全團隊部署開源模型以抵禦攻擊的首選。該公司表示,該模型已經標記出超過一千個運行中的軟件嚴重漏洞。.
在更難的測試中,例如 ExploitBench 和 ExploitGym,Z.ai 承認其最新型號落後於美國頂級型號。.
例如,在 ExploitBench 測試中,該測試要求模型根據漏洞實際構建一個可用的漏洞利用程序,GLM-5.3 的得分爲 54.4%,而 Mythos 5 的得分爲 78%。.
GLM-5.3權重何時可用?
Z.ai承諾將於8月28日向Hugging Face發佈其新的 GLM-5.3模型 。這是GLM模型權重首次被推遲發佈,這家中國人工智能實驗室表示,推遲兩週的原因是進行安全評估和強化。
該模型在審查了約269個項目(包括Linux內核、WinRAR、Redis和FFmpeg等軟件)後,發現了2436個漏洞,其中超過100個被評爲嚴重漏洞。據報道,最古老的漏洞已經存在了45年之久,卻一直未被發現。.
在此之前,只有 Z.ai 編碼計劃或其 ZCode 工具的付費訂閱用戶才能使用它。.
這些數據是Z.ai自己的數據。
以上所有數據均來自 Z.ai 的官方公告,而非dent 運行的結果。即使是公開的基準測試也是 Z.ai 使用其自身配置執行的,因此內部代碼基準測試無法在公司外部進行審覈。.
截至 尚未收錄該模型 Cryptopolitan 。報道發佈時,獨立dent 像 Artificial Analysis這樣排行榜
此次發佈也恰逢一個現實案例凸顯了風險。此前,OpenAI 的測試系統在安全防護措施不足的情況下逃逸出沙箱並攻破了其服務器, Hugging Face 便轉而採用了Z.ai 早期的 GLM-5.2 模型。
在談到地緣政治時,智普表達了合作的態度,他告訴記者,人工智能“不應該是一個國家的獨角戲,而應該是全球合作的交響樂”。
最頂尖的加密貨幣專家都在閱讀我們的簡報。想 加入他們?







