MetaのMuse Codeにはクラッシュセーフログが付属しているが、ベンチマークではClaude Opus 5が優位を保っている。
Metaは水曜日、端末ベースのコーディングエージェントであるMuse Code(ベータ版)をリリースした。 同社が公開したグラフによると、Muse CodeはほとんどのコーディングテストでOpenAIのCodexとGoogleのAntigravityを上回ったものの、Metaが公開したすべてのベンチマークでAnthropicのClaude Opus 5に敗れた。
Muse CodeはOpus 5より劣るが、クラッシュセーフログを追加
Muse Codeは、Metaが7月に米国の開発者向けに公開したコーディングモデルのアップデート版であるMuse Spark 1.2を基盤としています。.
Metaが発表したコーディングベンチマークでは、Muse Spark 1.2はOpus 5に劣るものの、ほとんどのベンチマークでCodexとAntigravityを上回っている。Metaは、このモデルは「より大規模で高性能なモデルが今後登場する予定であり、最先端技術への次なる一歩となる」と述べている。
同社によると、バージョン1.2は、トレーニング中のコーディングタスクに費やすコンピューティング能力を向上させた結果、コード生成、デバッグ、大規模コードベースの理解において性能が向上したという。.
ある事例研究では、このモデルは1,000回以上のツール呼び出しを行い、最長24時間かけてNVIDIA Hopperチップ用のGPUカーネルを書き換えた。その際、既存のライブラリからコピーしないように指示されたベースラインから作業を行った。.
Muse Codeは、すべてのモデル呼び出し、ツール実行、承認、編集を記録するローカルイベントログを保持しています。Metaは、 ブログ記事 。
クラッシュが発生した場合、エージェントは中断したところから処理を再開できます。また、エージェントはセッション全体を通してバックグラウンドのサブエージェントを実行し続けます。.
MetaのCEOであるマーク・ザッカーバーグ氏は、ブログ記事の中で次のように述べています 。「ジョブが十分に大きくなると、それは複数のサブエージェントに分散され、それぞれが独立したワークツリー内で並行して動作します。」さらに、「作業中のコピーは一切変更されません。テストでは、ゲームの6つの機能を同時に構築しましたが、競合は一切発生しませんでした。」と付け加えています。
本日、Muse Codeのベータ版をリリースしました。これは、大規模なリポジトリ全体にわたるソフトウェアエンジニアリングタスク(変更計画、コード記述、結果検証など)を一元的に処理するターミナルコーディングエージェントです。コーディングに特化したモデルアップデートであるMuse Spark 1.2を搭載しています。pic.twitter.com/ xqavk41w6v
— マーク・ザッカーバーグ (@finkd) 2026年8月5日
/plan、/grill、そしてメタのコストへの賭け
Muse Codeにはいくつかの組み込みコマンドがあります。/planはリクエストを承認が必要な計画に変換し、/grillはその計画が確実に機能するまでストレステストを行い、/goalは指定された目標の達成に向けて推進します。.
開発者は、単一のcurlコマンドでmacOSまたはLinuxにエージェントをインストールできます。Muse Spark 1.2は、 メタモデルAPI。
モデルとエージェントはペアで動作します。Muse Codeツールセットは、両者の互換性を維持します。.
トレーニングデータの一部は、旧バージョンの Muse Spark 1.1、ハードコーディングされた問題と候補となる解答の採点を行っていました。Meta氏によると、このループ処理によって、新しいモデルが指示に忠実に従うことができたとのことです。
Meta社は投資家に対し、今年、半導体、データセンター、その他のインフラ整備に1250億ドルから1450億ドルを投じる見込みだと伝えている。.
Opus 5はベンチマークテストで上位に食い込めないため、同社は価格競争に転じている。より大規模なMeta AIモデル(コードネーム:Watermelon)は現在も開発中である。.
最も賢い暗号通貨マインドを持つ人々はすでに私たちのニュースレターを読んでいます。参加してみませんか?ぜひ ご参加ください。









コメント (0)
$ボタンをクリックし、シンボルを入力して、株式、ETF、またはその他のティッカーシンボルをリンクします。