Gemini 4 Argonは、Google DeepMindが発表した次世代フロンティアモデルで、複雑で長期的なワークフローに対応する設計とされている。発表はGoogle DeepMindのSVPであるKoray Kavukcuogluが確認した。
最大の変更点は出力トークン上限が64Kから1Mへ拡大されたことだ(入力側のコンテキスト長が1Mになったわけではない点に注意)。これにより、非常に長い推論・コード生成・エージェント実行を、1回の出力の中で途中で区切らずに継続しやすくなる。Googleはコーディング・知識作業に加え、サイバーセキュリティ防御と創作執筆での能力強化を重点として挙げている。
| 項目 | 内容 |
|---|---|
| 発表日 | 2026年9月30日 |
| 発表元 | Google DeepMind(Koray Kavukcuoglu, SVP) |
| 出力トークン上限 | 1M(従来の64Kから拡大) |
| 重点分野 | コーディング・サイバーセキュリティ防御・知識作業・創作執筆 |
| 初期提供先 | Fairwind Program経由の信頼できるサイバー防衛担当者 |
※ 9to5Google、VentureBeatの報道に基づく。
Googleが自社公表した18ベンチマークの比較では、Argonが12項目で首位・1項目で同率首位となり、GPT-6 Astraは3項目、Claude Opus 5.5は2項目で首位だったという。ビジネス実務系のタスクで差が大きく、研究寄りのベンチマークでは逆転される項目もある。
| ベンチマーク | Gemini 4 Argon | GPT-6 Astra | Claude Opus 5.5 |
|---|---|---|---|
| AutomationBench(業務自動化) | 51.3% | 41.4% | 42.5% |
| GraphWalks(長文脈推論) | 84.2% | 71.8% | 66.8% |
| LVBench(長時間動画理解) | 91.7% | 87.5% | 83.7% |
| Harvey's Legal Agent(法律) | 19.6% | 5.4% | 3.8% |
| DeepSWE v1.1(コーディング) | 77.9% | 74.1% | 74.2% |
| CWE-bench v1(脆弱性修正) | 68%(同率1位) | 68%(同率1位) | 67% |
| FrontierSWE v2 | 55.0% | 65.5% | 62.3% |
| Terminal-bench 4.0 | 57.4% | 58.2% | 66.4% |
※ Google公表値。9to5Googleの集計をもとに作成。Googleの比較表は18種類のベンチマークを扱う一方、GraphWalksを2つのコンテキスト長(〜128K/256K〜1M)で掲載しているため表示上は19行になる。全ての結果が同一条件で第三者により独立再検証されたものではない。
Argonは発表直後から誰でも使えるわけではない。Googleによれば、まず「Fairwind Program」を通じて信頼できるサイバー防衛担当者への提供から始まり、その後米国政府の任意事前アクセスプロセスへの参加者に広げ、最終的に有料API利用者とGoogle AI Ultraサブスクライバーに向けて「近日中」に展開するという段階的な計画になっている。
Googleは悪用防止や安全性検証を理由に、段階的な提供を進めているとみられる。本稿執筆時点では、一般ユーザーが使える具体的な解禁日は公表されていない。
| 段階 | 対象 | 状況 |
|---|---|---|
| 第1段階 | Fairwind Program経由の信頼できるサイバー防衛担当者 | 提供開始 |
| 第2段階 | 米国政府の任意事前アクセスプロセス参加者 | 準備中 |
| 第3段階 | 有料API利用者・Google AI Ultraサブスクライバー | 近日中 |
※ 9to5Google、VentureBeatの報道に基づく。提供開始日は変更される可能性がある。
有料API向けの料金は、導入期間として入力100万トークンあたり2ドル、出力100万トークンあたり10ドルが設定されている。この導入価格が終了すると、入力4ドル・出力20ドルへと2倍になる予定だ。キャッシュされた入力トークンは、いずれの期間でも通常入力の95%割引(導入期間0.10ドル、通常期間0.20ドル)になるという。
| 区分 | 導入期間 | 通常期間 |
|---|---|---|
| 入力 | $2 | $4 |
| 出力 | $10 | $20 |
| キャッシュ入力 | $0.10(95%割引) | $0.20(同率の割引が続くと仮定した場合の参考値) |
※ 9to5Googleの報道に基づく。95%割引は導入期間の価格として公式に明記されたもの。通常期間のキャッシュ価格は未確定のため上表は参考値。価格は変更される可能性がある。
今回のベンチマーク結果を見る限り、Gemini 4 Argonは業務自動化・長文脈処理・サイバー防衛関連のタスクで明確な強みを示した一方、コーディングの一部領域(FrontierSWE v2)や長期タスク実行(Terminal-bench 4.0)ではGPT-6 Astra・Claude Opus 5.5の両方が上回っている。かつてのように1モデルが全分野で独走する構図ではなく、用途ごとに最適なモデルを選ぶ時代に近づいていることがうかがえる。
また、Argonがサイバー防衛担当者から段階的に提供される設計は、フロンティアモデルの能力が上がるほど悪用リスクへの配慮も同時に求められるという、2026年のAI業界に共通する課題を象徴しているとも言える。
Gemini 4 Argonは、Googleが公表したベンチマークの多くで競合を上回る結果を示したが、全項目での独走ではなく、業務自動化・長文脈・サイバー防衛という得意分野が際立つモデルだという見方が実態に近い。提供開始も一般公開ではなく、信頼できるサイバー防衛担当者からの限定ロールアウトという慎重な設計になっている。
料金は導入期間限定で通常の半額になっており、実際に一般ユーザーがGoogle AI Ultraや有料APIで使えるようになる時期と、そのときの実際の使い勝手が、Argonが日常的な選択肢になるかどうかの分かれ目になりそうだ。
参考リンク: 9to5Google / VentureBeat / The Rundown AI