2026年9月2日、Googleは公式ブログで「Gemini 3.8 Flash」と「Gemini 3.8 Flash Cyber」を発表した。前者はソフトウェアエンジニアリング・自律型エージェント・企業向けの複雑なワークフローを、Flashシリーズならではの速度とコスト効率で処理することを狙った汎用モデル。後者はそこから派生した、脆弱性検出と自動パッチ生成に特化したモデルだ。
Googleは「3.7 Flashから大きく進化した」としており、ソフトウェアエンジニアリング・エージェントタスク・専門領域での多段階推論で性能向上をアピールしている。
| 項目 | 内容 |
|---|---|
| 発表日 | 2026年9月2日 |
| モデルID | gemini-3.8-flash |
| コンテキストウィンドウ | 100万トークン |
| 最大出力トークン | 64,000トークン |
| 思考レベル | low/medium/high の3段階で調整可能 |
| 価格(導入価格・〜2026年12月31日) | 入力$0.75/出力$3.75(100万トークンあたり) |
| 価格(標準・2027年1月1日〜) | 入力$1.50/出力$7.50(100万トークンあたり) |
Flash Cyberは「最も高性能なサイバーセキュリティモデル」と位置づけられており、脆弱性検出の業界標準ベンチマーク「CyberGym」でフロンティア級の性能を達成したとされる。内部ベンチマーク(20言語対象)では成功率が70%を超え、前世代の3.5 Flash Cyberを大幅に上回った。
ソフトウェアの長期タスクを扱う「DeepSWE v1.1」ベンチマークでは、より大規模で高コストなフロンティアモデルの多くを、はるかに低いコストで上回るパフォーマンスを示している。専門領域評価の「HLE-Verified」では54.9%を記録し、金融エージェント評価の「Vals Finance Agent V2」や法務エージェント評価の「Harvey's Legal Agent Benchmark」でも上位の成績だという。
| 評価項目 | 結果 | 補足 |
|---|---|---|
| CyberGym(脆弱性検出) | フロンティア級 | 業界標準の脆弱性検出ベンチマーク |
| 内部ベンチ(20言語) | 成功率70%超 | 3.5 Flash Cyberを大幅に上回る |
| CWE-Bench(自動パッチ Pass@1) | 47.2% | 大型フロンティアモデル(47.8%)とほぼ同水準・低コスト |
| Chromeセキュリティチーム実測 | 2.6倍 | 商用大型モデル比で正確なパッチ生成数 |
| Wiz 内部ペネトレーションテスト | リコール+7.5〜9.7pt | コストは2.3〜5.2倍安いという結果 |
| HLE-Verified | 54.9% | 専門領域の推論評価 |
※ ベンチマーク数値はGoogle公式発表時点のもの。測定条件は情報源により異なる場合があります。
Gemini 3.8 Flashは、Google Antigravity・Google AI Studio・Android Studio・Stitch・Gemini Enterprise・Google Sheets、そしてAI Pro/Ultra契約者向けのGemini app、Google検索のAI Modeなど幅広いプラットフォームで順次利用可能だ。
一方でFlash Cyberは、脆弱性検出・自動パッチという強力な能力を持つがゆえに、「Fairwind Program」という優先アクセスの枠組みを通じてのみ提供される。対象は信頼できる政府機関、重要インフラ事業者、ソフトウェア保守業者などに限られる。
また、耐プロンプトインジェクション性を測る「Gray Swan」の評価でも、大きく改善したとGoogleは説明している。
2026年9月時点での主要モデルの料金を並べると、Gemini 3.8 Flashはミドルレンジの価格帯に位置する。GPT-5.6の廉価モデル「Luna」よりは高いが、バランス型の「Terra」よりは安く、100万トークンのコンテキストウィンドウを備える点が特徴だ。
| モデル | 入力価格 | 出力価格 | 位置づけ |
|---|---|---|---|
| Gemini 3.8 Flash | $0.75 | $3.75 | 導入価格(〜2026年12月) |
| GPT-5.6 Luna | $0.20 | $1.20 | OpenAIの廉価モデル |
| GPT-5.6 Terra | $2.00 | $12.00 | OpenAIのバランス型モデル |
| GPT-5.6 Sol | $5.00 | $30.00 | OpenAIの最上位モデル |
| Claude Sonnet 5 | $2.00 | $10.00 | Anthropicのバランス型モデル |
| Claude Fable 5.1 | $10.00 | $50.00 | Anthropicの最上位モデル |
※ 各社の料金は2026年9月時点の公表値。改定される可能性があります。GPT-5.6は2026年7月30日の価格改定後の水準。
サイバー攻撃の自動化が進む一方で、防御側もAIによる脆弱性発見・パッチ自動化を急速に取り入れつつある。Flash Cyberのような専用モデルが今後どこまで一般開発者に開放されるのか、Fairwind Programの拡大にも注目したい。
参考リンク(公式・主要メディア): Google公式ブログ / Gemini API 公式ドキュメント / Thurrott