tradingkey.logo
tradingkey.logo
検索

xAIのGrok 4.7は、より少ない費用で法律代理人業務においてAnthropicおよびOpenAIモデルを上回る

CryptopolitanSep 22, 2026 11:50 AM
facebooktwitterlinkedin
すべてのコメントを見る(0)

xAIは月曜日にGrok 4.7をリリースした。 法律代理人ベンチマークにおいて、AnthropicのFable 5.1とOpenAIのGPT-5.6 Solを上回り、入力トークンあたりの価格はFableの5分の1に抑えられている。

出力は100万トークンあたり6ドルで、Anthropicの50ドルと比較して大幅に低い。

xAIの発表によると、Grok 4.7はHarvey Legal Agent Benchmarkで19.6%のスコアを獲得した。同じテストでFable 5.1は6.7%、GPT-5.6 Solは2.5%だった。.

これにより、Grok 4.7のスコアはAnthropicの約3倍、Solの約8倍となる。Cryptopolitan Cryptopolitan先月、Grok 4.6が既に15.8%でこの2銘柄をリードしていると報じた。

法律業務は、Grok 4.7が競合製品2社を完全に凌駕する数少ない分野の一つです。また、EEBenchの電気工学分野ではFable 5.1を上回り、DeepSWEのコーディングテストでもわずかに上回っています。.

Grok 4.7の価格は、入力トークン100万個あたり2ドル、出力トークン100万個あたり6ドルで、Grok 4.6と同じです。この入力レートは、GPT-5.6 Solの4ドルの半分、Fable 5.1の10ドルの5分の1です。.

出力はSolの20ドルに対し6ドル、Fableの50ドルで、Anthropicの約8分の1となっている。.

xAIはCursorBench 4.0のスコアをタスク完了あたりの平均コストに対してプロットし、このモデルが価格性能比で最高水準にあると主張している。Grok 4.7はタスクあたり約6ドルで約46%のスコアを獲得しているのに対し、Claude Opus 5は同様の結果を得るためにほぼ2倍の費用が必要となる。.

Fable 5.1は予算が多いほどパフォーマンスが向上し、タスクあたり約17ドルで51.8%まで向上しました。マスク氏はXで、今回のリリースは「インテリジェンス、スピード、低コストのtronな組み合わせ」だと述べました。.

Grok 4.7は、Harveyの法律代理人テストにおいて、Fable 5.1とGPT-5.6 Solを上回り、Fableの入力コストの5分の1でそれを達成した。.
SpaceXAIのGrok 4.7ローンチに関する 投稿(2026年9月21日公開)からのトークン価格とベンチマークスコア。

Terminal-Bench 4.0により、Anthropicが57.9%対38.0%でリード

Grok 4.7は、GDPvalとAA Briefcaseオフィスワークテストにおいて、Fable 5.1に次ぐ2位となった。しかし、より長時間のコーディングや端末ベンチマークでは、Anthropicのモデルが明確なリードを保っている。.

最も大きな差が見られたのはTerminal-Bench 4.0で、Fable 5.1が57.9%だったのに対し、Grok 4.7は38.0%で、約20ポイントの差があった。.

FableはCursorBenchとHealthBench Professionalの臨床推論においても優位に立っており、GPT-5.6 SolもGrokを上回っている。.

Grok 4.7は、弁護士、看護師、金融アナリストなどの職業におけるモデルの能力を評価するGDPvalで1,695 Eloを獲得し、Grok 4.6の1,605から上昇した。これはFable 5.1の1,735には及ばないものの、同じチャートでOpenAIの最新モデルであるGPT-6 Astraが獲得した1,542を上回っている。.

Grok 4.7は、7つのベンチマークのうち5つでGPT-5.6 Solを上回っています。DeepSWEと臨床試験のみがGrok 4.7に劣っています。.

Grok 4.7は2.1兆個のパラメータで動作し、Grok 4.6の1.5兆個よりも40%増加しています。xAIは、Starlink衛星のテレメトリデータや製造記録など、SpaceXの補足的なトレーニングデータを追加しました。.

同社によれば、このモデルはGrok 4.6よりも、難しい問題に時間をかけたり、自身の解答を二重チェックしたりする傾向が強いという。.

この モデルは 、Grokアプリ、Cursor、Grok Build、およびxAI API上で、待機リストなしでリリースされました。

ここに掲載されている数値はすべてxAI独自のテスト結果です。xAIが最初に用いたテストであるCursorBenchは、SpaceXが先月買収を完了したCursor社によって開発されました。.

xAIはGPT-5.6 Solをベンチマーク対象としており、OpenAIのより新しいGPT-6 AstraはGDPval、AA Briefcase、EEBenchのチャートにのみ登場する。.

仮想通貨ニュースを読むだけでなく、理解を深めましょう。ニュースレターにご登録ください。 無料です。

免責事項:本サイトで提供する情報は教育・情報提供を目的としたものであり、金融・投資アドバイスとして解釈されるべきではありません。

コメント (0)

$ボタンをクリックし、シンボルを入力して、株式、ETF、またはその他のティッカーシンボルをリンクします。

0/500
コメントガイドライン
読み込み中...

おすすめ記事

tradingkey.logo
リスク告知:当社ウェブサイト及びモバイルアプリは特定の投資商品に関する一般的な情報のみを提供しており、Finsightsは金融アドバイスや投資商品の推奨を行うものではありません。本情報の提供をもってFinsightsが投資助言を行っていると解釈されることはありません。
投資商品には元本割れを含む重大なリスクが伴い、全ての投資家に適するものではありません。なお、過去の運用実績は将来の成果を保証するものではありません。
Finsightsは、第三者広告主または提携先が当社ウェブサイト・モバイルアプリ上に広告を掲載することを許可する場合があり、これら広告主から広告への反応に基づく報酬を受けることがあります。
© 著作権: FINSIGHTS MEDIA PTE. LTD. 無断複写・転載を禁じます。