Z.aiによると、サイバーテストでGLM-5.3がAnthropicのMythos 5をわずかに上回ったとのこと。
中国のAI企業であるZhipu AI(香港証券取引所:2513)は、最新モデルであるGLM-5.3の発表と同時に公開した文書で、大きな獲物を狙っているようだ。.
国際的にZ.aiとして事業を展開する同社は、 具体 、Anthropic社のMythos 5を 的に挙げた。
GLM-5.3は、GLM-5.2と同じ基本モデルに基づいて動作します。これは、7430億個のパラメータを持つエキスパート混合モデルであり、トークンごとに約400億個のパラメータをアクティブ化します。.
Z.aiのGLM-5.3は、他のモデルと比べてどうですか?
Z.aiが公表した数値によると、同社の GLM-5.3 はCyberGymベンチマークで84.5%のスコアを記録したが、これはAnthropicのMythos 5(83.8%)とOpenAIのGPT-5.6 Sol(83.6%)をわずか1ポイント上回る程度である。
Mythosを凌駕すれば、Z.aiは攻撃対策としてオープンウェイトモデルの導入を検討している開発者やセキュリティチームにとって、トップの座に躍り出る可能性がある。同社によれば、このモデルはすでに稼働中のソフトウェアで1000件以上の深刻なバグを検出しているという。.
ExploitBenchやExploitGymといったより難易度の高いテストでは、Z.aiは最新モデルが米国のトップモデルに劣ることを認めている。.
例えば、脆弱性から実際に動作するエクスプロイトを構築するようモデルに要求するExploitBenchでは、GLM-5.3のスコアは54.4%で、Mythos 5の78%を下回った。.
GLM-5.3の重みデータはいつ利用可能になりますか?
Z.aiは、新しいGLM-5.3モデルの重みを 8月28日にHugging Faceに公開することを約束した。これはGLMモデルの重みとしては初めての公開延期であり、中国のAI研究所は、2週間の遅延の理由として安全性の評価と強化を挙げている。
このモデルが発見した2,436件の脆弱性のうち、100件以上が重大な脆弱性と評価された。これは、Linuxカーネル、WinRAR、Redis、FFmpegなどで使用されているソフトウェアを含む約269のプロジェクトを検証した結果である。最も古い脆弱性は、45年間も気づかれずに放置されていたという。.
それまでは、Z.aiコーディングプランまたはそのZCodeハーネスの有料会員のみが利用できます。.
これらの数字はZ.ai独自のものです。
上記の数値はすべてZ.aiの発表によるものであり、dent した実行結果ではありません。公開ベンチマークもZ.aiが独自の構成で実行したため、社内コードベンチは社外から監査することはできません。.
にはまだこのモデルは追加されていない Cryptopolitan 。執筆時点では、 Artificial Analysis独立dent などの リーダーボード
今回の発表は、そのリスクを如実に示す事例と重なる。Hugging Face 、OpenAIのテストシステムが、制限を緩和した状態でサンドボックスから脱出し、サーバーを侵害した後に、Z.aiの以前のGLM-5.2というモデルを採用したのだ。
地政学的な観点から、智普氏は協調的な姿勢を示し、記者団に対し、AIは「一国による単独の取り組みではなく、世界的な協力による交響曲であるべきだ」と述べた。
最も賢い暗号通貨マインドを持つ人々はすでに私たちのニュースレターを読んでいます。参加してみませんか?ぜひ ご参加ください。









コメント (0)
$ボタンをクリックし、シンボルを入力して、株式、ETF、またはその他のティッカーシンボルをリンクします。