tradingkey.logo
搜索

Z.ai称GLM-5.3在网络安全测试中胜过Anthropic的Mythos 5。

Cryptopolitan2026年8月14日 13:31
facebooktwitterlinkedin

中国人工智能公司智普人工智能(HKG:2513)在推出最新 GLM-5.3 模型的同时,也发布了一份文件,旨在探索大型人工智能领域。.

这家以 Z.ai 为国际品牌的公司 特别指出 Anthropic 的 Mythos 5 是 GLM-5.3 在 CyberGym 基准测试中表现优于的模型之一,该基准测试衡量模型检查源代码中软件漏洞的能力。

GLM-5.3 运行在与 GLM-5.2 相同的基本模型上,这是一个 7430 亿参数的专家混合设计,每个令牌激活大约 400 亿个参数。.

Z.ai 的 GLM-5.3 与其他模型相比如何?

根据 Z.ai 公布的数据,其 GLM-5.3 在 CyberGym 基准测试中得分 84.5%,仅比 Anthropic 的 Mythos 5 (83.8%) 和 OpenAI 的 GPT-5.6 Sol (83.6%) 领先不到 1 分。

如果 Z.ai 能够击败 Mythos,它有望成为开发者和安全团队部署开源模型以抵御攻击的首选。该公司表示,该模型已经标记出超过一千个运行中的软件严重漏洞。.

在更难的测试中,例如 ExploitBench 和 ExploitGym,Z.ai 承认其最新型号落后于美国顶级型号。.

例如,在 ExploitBench 测试中,该测试要求模型根据漏洞实际构建一个可用的漏洞利用程序,GLM-5.3 的得分为 54.4%,而 Mythos 5 的得分为 78%。.

GLM-5.3权重何时可用?

Z.ai承诺将于8月28日向Hugging Face发布其新的 GLM-5.3模型 。这是GLM模型权重首次被推迟发布,这家中国人工智能实验室表示,推迟两周的原因是进行安全评估和强化。

该模型在审查了约269个项目(包括Linux内核、WinRAR、Redis和FFmpeg等软件)后,发现了2436个漏洞,其中超过100个被评为严重漏洞。据报道,最古老的漏洞已经存在了45年之久,却一直未被发现。.

在此之前,只有 Z.ai 编码计划或其 ZCode 工具的付费订阅用户才能使用它。.

这些数据是Z.ai自己的数据。

以上所有数据均来自 Z.ai 的官方公告,而非dent 运行的结果。即使是公开的基准测试也是 Z.ai 使用其自身配置执行的,因此内部代码基准测试无法在公司外部进行审核。.

截至 尚未收录该模型 Cryptopolitan 。报道发布时,独立dent 像 Artificial Analysis这样排行榜

此次发布也恰逢一个现实案例凸显了风险。此前,OpenAI 的测试系统在安全防护措施不足的情况下逃逸出沙箱并攻破了其服务器, Hugging Face 便转而采用了Z.ai 早期的 GLM-5.2 模型。

在谈到地缘政治时,智普表达了合作的态度,他告诉记者,人工智能“不应该是一个国家的独角戏,而应该是全球合作的交响乐”。

最顶尖的加密货币专家都在阅读我们的简报。想 加入他们?

免责声明:本网站提供的信息仅供教育和参考之用,不应视为财务或投资建议。

推荐文章

tradingkey.logo
风险提示:我们的网站和移动应用程序仅提供关于某些投资产品的一般信息。Finsights 不提供财务建议或对任何投资产品的推荐,且提供此类信息不应被解释为 Finsights 提供财务建议或推荐。
投资产品存在重大投资风险,包括可能损失投资的本金,且可能并不适合所有人。投资产品的过去表现并不代表其未来表现。
Finsights 可能允许第三方广告商或关联公司在我们的网站或移动应用程序的任何部分放置或投放广告,并可能根据您与广告的互动情况获得报酬。
© 版权所有: FINSIGHTS MEDIA PTE. LTD. 版权所有