xAIは2026年8月12日、新フラグシップモデル「Grok 4.6」(モデルID:grok-4.6)を発表した。公式リリースノートでは「SpaceXAI's frontier model for coding, agentic tasks, and knowledge work」と説明されており、長時間にわたるエージェント作業やコーディング、ナレッジワークに重点を置いたモデルと位置づけられている。
なお、xAIは公式資料の中で自社を「SpaceXAI」とも表記している。過去にはSpaceXがAI開発ツール企業Cursorを買収しxAIとの統合を進めているとの報道もあり、両社の関係強化を示唆しているとも受け取れるが、出資比率など具体的な資本関係は公式に明言されていない点には注意したい。
提供チャネルは、xAI API(grok-4.6)に加え、xAIのコーディングツール「Grok Build」のデフォルトモデル、開発ツール「Cursor」の全プランへの搭載、OpenRouter・Vercel・Cloudflare経由でのルーティング利用など幅広い。
| 項目 | 内容 |
|---|---|
| 発表日 | 2026年8月12日 |
| 発表元 | xAI(公式リリースノートでは「SpaceXAI」と表記) |
| モデルID | grok-4.6 |
| コンテキストウィンドウ | 500,000トークン |
| 入力対応 | テキスト・画像 |
| 出力対応 | テキストのみ(出力トークン数の上限なし) |
| Reasoning Effort設定 | low/medium/high(デフォルト)/xhigh |
| 提供チャネル | xAI API・Grok Build(デフォルト)・Cursor全プラン・OpenRouter・Vercel・Cloudflare |
xAIは性能指標としてArtificial Analysis Intelligence Indexのスコアを公表している。Grok 4.6はここで61を記録し、Grok 4.5の56から5ポイント上昇した。この数値はOpenAIのGPT-5.6 Sol Maxと並ぶ水準だ。
一方で、個別のベンチマークでは得意・不得意の差が大きい。ソフトウェア工学タスクを測るDeepSWE v1.1では、Grok 4.6が65.9%を記録したのに対し、GPT-5.6 Sol Maxは73%と上回っている。またターミナル操作能力を測るTerminal-Bench v3.0では、Grok 4.6は26%にとどまった。総合指標では並んでも、コーディング関連の個別タスクではGPT-5.6勢に一日の長があるとみられる。
なお海外メディアの報道では、xAI公表の10項目評価表においてClaude Fable 5 Maxが最多の項目で首位を獲得しており、Grok 4.6が首位となったのはナレッジワークと法律関連の項目だったと伝えられている。これはxAI自身が公表した比較データに基づく報道であり、独立した第三者評価ではない点には留意したい。
| 指標 | Grok 4.6 | 比較対象 |
|---|---|---|
| Artificial Analysis Intelligence Index | 61 | Grok 4.5:56/GPT-5.6 Sol Max:61(同率) |
| DeepSWE v1.1 | 65.9% | GPT-5.6 Sol Max:73% |
| Terminal-Bench v3.0 | 26% | xAI公表値のみ確認 |
価格面での最大のポイントは、性能が上がったにもかかわらず単価はGrok 4.5から据え置かれたことだ。200,000トークン未満のプロンプトでは、百万トークンあたり入力$2・キャッシュ入力$0.50・出力$6。200,000トークンを超える部分は入力$4・キャッシュ入力$1・出力$12と、長いプロンプトほど単価が上がる2段階制になっている。
コンテキストウィンドウは500,000トークンで、テキストに加えて画像入力にも対応する。出力側はテキストのみだが、出力トークン数に上限を設けていない点も特徴だ。Reasoning Effort(推論にかける計算量)はlow・medium・high・xhighの4段階から選択でき、デフォルトはhighに設定されている。
主要3モデルの料金を比較する。入力単価だけを見ると、Grok 4.6(200K以下で$2)はGPT-5.6 Sol($5)より安く、Gemini 3.6 Flashの導入価格($0.75〜)よりは高い中間の水準にある。出力単価もGrok 4.6は$6で、GPT-5.6 Solの$30と比べるとかなり抑えられている。ただしコンテキストウィンドウで見るとGemini 3.6 Flashが約104万トークンと突出しており、モデルごとの得意分野が異なる点には注意したい。
| モデル | 入力 | 出力 | コンテキスト | 備考 |
|---|---|---|---|---|
| Grok 4.6 | $2(200K以下) $4(超過分) |
$6(200K以下) $12(超過分) |
500,000トークン | Grok 4.5と同一価格 |
| GPT-5.6 Sol | $5 | $30 | ― | OpenAIの最上位モデル |
| Gemini 3.6 Flash | $0.75〜$1.50 | $3.75〜$7.50 | 1,048,576トークン | 導入価格は2026年12月末まで |
※ 各社の料金は変動が頻繁です。実際の利用にあたっては各社公式の最新価格ページをご確認ください。
Grok 4.6は、総合的なベンチマークスコアではGPT-5.6 Sol Maxに並び、価格は据え置きというコストパフォーマンス重視の値付けが特徴のモデルといえる。一方で、コーディング系の個別タスクでは差が残っており、「万能」ではなく用途に応じた使い分けが引き続き重要になりそうだ。xAIとSpaceXの関係強化が今後どう進むのかも、あわせて注目しておきたい。
参考リンク(公式・主要メディア): xAI公式:Grok 4.6リリースノート / MarkTechPost:Grok 4.6解説記事 / OpenRouter:Grok 4.6 価格・ベンチマーク