tradingkey.logo

tradingkey.logo
怜玢


SpaceX AI、Grok 4.7を発衚コヌディングおよびナレッゞワヌク向けフラッグシップ䞖代、Grok 4.6ず同䟡栌

TradingKey
著者Andy Chen
Sep 21, 2026 5:43 PM

AIポッドキャスト

facebooktwitterlinkedin
すべおのコメントを芋る0


SpaceXAIがリリヌスした「Grok 4.7」は、前䞖代ず同等の䟡栌ず掚論速床を維持し぀぀、長時間コヌディングや専門文曞䜜成などの胜力を倧幅に向䞊させた。匷化された匷化孊習により、CursorBenchやTerminal-Benchなどの䞻芁ベンチマヌクで優れた成果を収め、特に䜎コストか぀高コストパフォヌマンスを実珟しおいる。さらに、新セヌフティスタックの採甚により、バむオセキュリティやサむバヌセキュリティにおける安党性を高め぀぀、実甚的な移行コストの抑制ず業務効率化を䞡立するモデルずなっおいる。

AI生成芁玄

TradingKey - SpaceXAISPXCのAI郚門、旧xAIは9月21日にGrok 4.7をリリヌスし、コヌディングおよびナレッゞワヌク向けずしお同瀟史䞊最も優秀なモデル䞖代であるず公匏に䜍眮付けたした。䟡栌蚭定はGrok 4.6ず倉わらず、入力トヌクン100䞇個あたり2ドル、出力トヌクン100䞇個あたり6ドルずなっおいたす。長時間コヌディングタスクを専門に評䟡するCursorBench 4.0においお、Grok 4.7は46.3%を蚘録し、Grok 4.6を5.9ポむント䞊回りたした。公匏発衚によるず、このベンチマヌクにおいお同䟡栌垯の䞭で最も高いコストパフォヌマンスを実珟しおいるずされおいたす。

過去2幎間、フラッグシップモデルの機胜匷化は通垞、トヌクン単䟡の䞊昇をもたらしおきたした。䞖代亀代や倀䞊げを経お、業界が掚論コストを埐々に吞収するのを埅぀ずいうプロセスです。Grok 4.7は異なるアプロヌチをずっおいたす。機胜を向䞊させ぀぀も、䟡栌蚭定ず掚論速床はGrok 4.6の氎準を維持し、さらに出力速床を2倍にした高速バヌゞョンも提䟛しおいたす。

公匏に開瀺された詳现情報は4぀の偎面に焊点を圓おおいたす。ベヌスモデルおよび匷化孊習トレヌニングの倉曎点、7぀のベンチマヌクにおける暪断的・瞊断的比范、長時間タスクにおけるコスト構造、そしお党面的に再構築されたセヌフティガヌドレヌルスタックです。さらに、同モデルはCursor、Grok Build、Grok API、ならびにサヌドパヌティのコヌディングフレヌムワヌクやモデルルヌティングプラットフォヌムにおいお即座に同時利甚可胜ずなっおいたす。

Grok 4.7の栞ずなる䟡倀提案は、長時間タスクのコヌディング、専門的なドキュメント䜜成、およびセヌフティガヌドレヌルの3぀の胜力を䞭心に構成されおいたす。これら3぀はすべお前䞖代ず同じ䟡栌ず速床ずいう同䞀の䟡栌構造を共有しおおり、レむテンシに敏感なシナリオに察しおは高速バヌゞョンで察応しおいたす。

公匏ベンチマヌクによるず、この䞖代のモデルにおける進歩は継続的です。CursorBench 4.0は5.9ポむント向䞊し、Terminal-Bench 4.0はほが倍増、AA Briefcaseは111ポむント向䞊し、同瀟のバむオセキュリティベンチマヌクでは過去最高スコアを達成したした。䞀方で、法埋ベンチマヌクにおける19.6%ずいう絶察氎準や、4぀のベンチマヌクでFable 5.1がリヌドしおいるこずは、これが䞀方的な眮き換えではなく、双方に勝ち負けが存圚する競合関係であるこずを瀺しおいたす。

䟡栌ずスピヌドは倉曎なし

Grok 4.7の利甚料金は、Grok 4.6ず同じく100䞇入力トヌクンあたり2ドル、100䞇出力トヌクンあたり6ドルからずなっおおり、同等の掚論速床を維持しおいたす。たた、䟡栌は2倍ずなりたすが、暙準版の2倍の出力速床を実珟する公匏の高速版も提䟛されおいたす。

この料金蚭定は、同等のモデルの䞭でも䜎い郚類に入りたす。比范するず、GPT-5.6 Solの最高ティアは入力4ドル・出力20ドル、Fable 5.1の最高ティアは入力10ドル・出力50ドルです。出力単䟡のみを比范した堎合、Grok 4.7は前者の玄3分の1、埌者の玄8分の1にずどたりたす。

䟡栌蚭定が据え眮かれたこずによる実甚䞊の利点は、移行コストを抑制できる点にありたす。すでにGrok 4.6を䜿甚しおいるチヌムは、CursorやGrok Build䞊で盎接モデルを切り替え、APIや呌び出し方法を倉曎するこずなく、既存のタスクスむヌトで比范怜蚌を実行できたす。

モデルの改善

Grok 4.7の匷化孊習フェヌズでは孊習時間も長期化し、蚓緎タスク党䜓の難易床バランスが䞊方シフトしたほか、完了たでに数時間を芁する問題ぞず重点が眮かれたした。その公匏な盎接的結果ずしお、同モデルは自身の出力をより正確に怜蚌し、長文のコンテキストを管理する胜力が向䞊しおいたす。

たた、孊習目暙にも倉曎が加えられたした。Grok 4.7はGrok Botハヌネスをネむティブに理解するようトレヌニングされ、察話タスクや䞀般的な知識䜜業においお優れたパフォヌマンスを発揮したす。SpaceXAIは8月11日にGrok Botをロヌンチし、それぞれが専甚のコンピュヌタを備え、ツヌルやアプリケヌション内で䜜業可胜な継続皌働型゚ヌゞェントの集たりであるず説明したした。

文曞およびプレれンテヌションの生成胜力に぀いおも別途匷調されたした。公匏発衚によるず、Grok 4.7は䞡方の出力カテゎリヌにおいおGrok 4.6から顕著な改善を瀺しおおり、他のフロンティアモデルず同等の性胜を実珟しおいたす。

7぀のベンチマヌクのスコアカヌド

Grok 4.7は、ドキュメントやプレれンテヌションの䜜成においお優れたパフォヌマンスを発揮したす。GDPvalおよびAA Briefcaseテストでは、AIが匁護士、看護垫、金融アナリストなどの専門職の業務を遂行するこずが求められたす。Grok 4.7は䞡ベンチマヌクテストでGrok 4.6を䞊回り、他のフロンティアモデルず同氎準の性胜を達成したした。

4-f85d422bc90543a498f2bd733762b144

[コヌディング、タヌミナル操䜜、電気工孊、法埋、臚床掚論、オフィス業務を網矅した公匏比范衚。出兞x.ai]

法埋ずタヌミナル操䜜の分野で最も倧きな改善が芋られたした。Harvey Legal Agent Benchmarkにおいお、Grok 4.7は同グルヌプ内で最高ずなる19.6%を蚘録したのに察し、GPT-5.6 Solはわずか2.5%にずどたりたした。Terminal-Bench 4.0では、Grok 4.7はGrok 4.6の20.3%から38.0%ぞず急䞊昇し、ほが倍増したした。臚床掚論は8.2パヌセンテヌゞポむント改善し、オフィス業務のスコアは111ポむント増加したした。

ロングタスクにおけるコスト曲線

CursorBench 4.0の公匏ペヌゞには、タスクあたりの平均コスト、平均出力トヌクン数、平均ステップ数の3぀のチャヌトが䞊んで掲茉されおおり、瞊軞は同じスコア䜓系に暙準化されおいたす。チャヌト内の参照点はSonnet 5high defaultプリセットの䜍眮に瀺されおおり、スコア30.8%、タスクあたり3.48ドル、玄61,000出力トヌクン、85ステップずなっおおり、費甚察効果の比范におけるベヌスラむンずなっおいたす。

5-7db9b361e8984e1f905267db471081e0

[出兞X.ai]

コスト曲線を芋るず、Fable 5.1はタスクあたり18ドル近いコストで最高スコアを達成しおいるのに察し、GPT-5.6 Solは䜎コスト偎に䜍眮し、コストが䞋がるに぀れおスコアがより急激に䜎䞋したす。Grok 4.7はその䞭間に䜍眮しおおり、公匏の䞻匵によれば、このベンチマヌクにおいお費甚察効果のフロンティアにあるずされおいたす。出力トヌクン数およびステップ数のチャヌトの圢状はコストチャヌトず䞀臎しおおり、コストの差異は単䟡そのものではなく、䞻にタスク完了に必芁な掚論の長さに起因するこずを瀺しおいたす。

6人のバック゚ンドチヌムが40䞇行のサヌビスを叀いフレヌムワヌクから新しいフレヌムワヌクぞ移行するケヌスを考えおみたしょう。この皮のタスクを単䞀ステップのコミットに分解するこずは意味をなしたせん。モデルは䜕時間も連続しお皌働し、その過皋で前のステップの結果をセルフチェックする必芁がありたす。これこそが、CursorBench 4.0およびTerminal-Bench 4.0が枬定を目指しおいる具䜓的なシナリオです。タスクあたりのコストが10ドル超から数ドルに䞋がっお初めお、チヌムは週末にたずめおバッチ凊理するのを埅぀のではなく、日垞の䜜業スケゞュヌルに組み蟌むようになるでしょう。

セキュリティずサむバヌセキュリティ

Grok 4.7は、党く新しいセヌフティスタックを採甚しおいたす。公匏には、拒絶率ずゞェむルブレむク耐性の䞡面においお、同瀟がこれたでテストした䞭で最も匷力なモデルであるず説明されおいたす。

サむバヌセキュリティやバむオセキュリティなどのデュアルナヌス分野においお、公匏デヌタは危険なリク゚ストを拒吊し぀぀、正圓なタスクの有甚性を維持するずいう䞡偎面を察象ずしおいたす。バむオセキュリティでは、Grok 4.7はLatchBioバむオセキュリティ・ベンチマヌクで最高スコアずなる62.4%を蚘録したした。サむバヌセキュリティでは、瀟内ベンチマヌク「HackerBench v0.3」においお、高リスクなデュアルナヌス・プロンプトの蚱可率をわずか3.3%にずどめ、正圓なセキュリティ研究をブロックするこずはほずんどありたせんでした。

SpaceXAIはたた、防埡目的の研究を行う䞀郚のサむバヌセキュリティパヌトナヌに察し、Grok 4.7のレッドチヌム機胜ぞの招埅制アクセスの提䟛を開始したず発衚したした。

このコンテンツはAIを䜿甚しお翻蚳され、明確さを確認したした。情報提䟛のみを目的ずしおいたす。

原文を読む
免責事項本蚘事の内容は執筆者の個人的芋解に基づくものであり、Tradingkeyの公匏芋解を反映するものではありたせん。投資助蚀ずしお解釈されるべきではなく、あくたで参考情報ずしおご利甚ください。読者は本蚘事の内容のみに基づいお投資刀断を行うべきではありたせん。本蚘事に䟝拠した取匕結果に぀いお、Tradingkeyは䞀切の責任を負いたせん。たた、Tradingkeyは蚘事内容の正確性を保蚌するものではありたせん。投資刀断に際しおは、関連するリスクを十分に理解するため、独立した金融アドバむザヌに盞談されるこずを掚奚したす。

コメント (0)

$ボタンをクリックし、シンボルを入力しお、株匏、ETF、たたはその他のティッカヌシンボルをリンクしたす。

0/500
コメントガむドラむン
読み蟌み䞭...

おすすめ蚘事

tradingkey.logo
リスク告知圓瀟りェブサむト及びモバむルアプリは特定の投資商品に関する䞀般的な情報のみを提䟛しおおり、Finsightsは金融アドバむスや投資商品の掚奚を行うものではありたせん。本情報の提䟛をもっおFinsightsが投資助蚀を行っおいるず解釈されるこずはありたせん。
投資商品には元本割れを含む重倧なリスクが䌎い、党おの投資家に適するものではありたせん。なお、過去の運甚実瞟は将来の成果を保蚌するものではありたせん。
Finsightsは、第䞉者広告䞻たたは提携先が圓瀟りェブサむト・モバむルアプリ䞊に広告を掲茉するこずを蚱可する堎合があり、これら広告䞻から広告ぞの反応に基づく報酬を受けるこずがありたす。
© 著䜜暩: FINSIGHTS MEDIA PTE. LTD. 無断耇写・転茉を犁じたす。