【2026年9月最新】Google「Gemini 3.8 Flash Cyber」登場|Chrome脆弱性パッチ精度が大手モデルの2.6倍に|料金・性能・GPT-5.6/Claude徹底比較

Googleが2026年9月2日、高性能Flashモデル「Gemini 3.8 Flash」と、サイバーセキュリティに特化した「Gemini 3.8 Flash Cyber」を発表した。
Chromeセキュリティチームの実測では、大型の商用モデルと比べて2.6倍多く正確な脆弱性パッチを生成したという。

この記事では、2つのモデルの性能・価格・提供範囲に加え、GPT-5.6やClaude Fable 5.1との料金比較までまとめる。
Gemini 3.8 Flash Cyber 最新ニュース

① まず概要:2つの新モデルが同時発表

2026年9月2日、Googleは公式ブログで「Gemini 3.8 Flash」と「Gemini 3.8 Flash Cyber」を発表した。前者はソフトウェアエンジニアリング・自律型エージェント・企業向けの複雑なワークフローを、Flashシリーズならではの速度とコスト効率で処理することを狙った汎用モデル。後者はそこから派生した、脆弱性検出と自動パッチ生成に特化したモデルだ。

Googleは「3.7 Flashから大きく進化した」としており、ソフトウェアエンジニアリング・エージェントタスク・専門領域での多段階推論で性能向上をアピールしている。

▼ Gemini 3.8 Flash 基本スペック・価格
項目内容
発表日2026年9月2日
モデルIDgemini-3.8-flash
コンテキストウィンドウ100万トークン
最大出力トークン64,000トークン
思考レベルlow/medium/high の3段階で調整可能
価格(導入価格・〜2026年12月31日)入力$0.75/出力$3.75(100万トークンあたり)
価格(標準・2027年1月1日〜)入力$1.50/出力$7.50(100万トークンあたり)

② Gemini 3.8 Flash Cyberの実力:CyberGymでフロンティア級

Flash Cyberは「最も高性能なサイバーセキュリティモデル」と位置づけられており、脆弱性検出の業界標準ベンチマーク「CyberGym」でフロンティア級の性能を達成したとされる。内部ベンチマーク(20言語対象)では成功率が70%を超え、前世代の3.5 Flash Cyberを大幅に上回った。

Gemini 3.8 Flash Cyberの実力3つの数字

ソフトウェアの長期タスクを扱う「DeepSWE v1.1」ベンチマークでは、より大規模で高コストなフロンティアモデルの多くを、はるかに低いコストで上回るパフォーマンスを示している。専門領域評価の「HLE-Verified」では54.9%を記録し、金融エージェント評価の「Vals Finance Agent V2」や法務エージェント評価の「Harvey's Legal Agent Benchmark」でも上位の成績だという。

💡 Google Cloud VRPでの実例
Google Cloud脆弱性報奨金プログラム(VRP)の調査では、通常なら数ヶ月かかる脆弱性発見作業を2時間以内で完了できたケースがあったと紹介されている。
▼ 主なベンチマーク・実証結果
評価項目結果補足
CyberGym(脆弱性検出)フロンティア級業界標準の脆弱性検出ベンチマーク
内部ベンチ(20言語)成功率70%超3.5 Flash Cyberを大幅に上回る
CWE-Bench(自動パッチ Pass@1)47.2%大型フロンティアモデル(47.8%)とほぼ同水準・低コスト
Chromeセキュリティチーム実測2.6倍商用大型モデル比で正確なパッチ生成数
Wiz 内部ペネトレーションテストリコール+7.5〜9.7ptコストは2.3〜5.2倍安いという結果
HLE-Verified54.9%専門領域の推論評価

※ ベンチマーク数値はGoogle公式発表時点のもの。測定条件は情報源により異なる場合があります。

③ 誰が使える?提供範囲とFairwind Program

Gemini 3.8 Flashは、Google Antigravity・Google AI Studio・Android Studio・Stitch・Gemini Enterprise・Google Sheets、そしてAI Pro/Ultra契約者向けのGemini app、Google検索のAI Modeなど幅広いプラットフォームで順次利用可能だ。

Gemini 3.8 Flashの提供範囲まとめ

一方でFlash Cyberは、脆弱性検出・自動パッチという強力な能力を持つがゆえに、「Fairwind Program」という優先アクセスの枠組みを通じてのみ提供される。対象は信頼できる政府機関、重要インフラ事業者、ソフトウェア保守業者などに限られる。

また、耐プロンプトインジェクション性を測る「Gray Swan」の評価でも、大きく改善したとGoogleは説明している。

④ 他社AIとの料金比較:GPT-5.6・Claude Fable 5.1

2026年9月時点での主要モデルの料金を並べると、Gemini 3.8 Flashはミドルレンジの価格帯に位置する。GPT-5.6の廉価モデル「Luna」よりは高いが、バランス型の「Terra」よりは安く、100万トークンのコンテキストウィンドウを備える点が特徴だ。

▼ 主要AIモデルの料金比較(100万トークンあたり)
モデル入力価格出力価格位置づけ
Gemini 3.8 Flash$0.75$3.75導入価格(〜2026年12月)
GPT-5.6 Luna$0.20$1.20OpenAIの廉価モデル
GPT-5.6 Terra$2.00$12.00OpenAIのバランス型モデル
GPT-5.6 Sol$5.00$30.00OpenAIの最上位モデル
Claude Sonnet 5$2.00$10.00Anthropicのバランス型モデル
Claude Fable 5.1$10.00$50.00Anthropicの最上位モデル

※ 各社の料金は2026年9月時点の公表値。改定される可能性があります。GPT-5.6は2026年7月30日の価格改定後の水準。

⑤ まとめ:AIによる「発見と防御の自動化」が一段進んだ

この記事のまとめ

サイバー攻撃の自動化が進む一方で、防御側もAIによる脆弱性発見・パッチ自動化を急速に取り入れつつある。Flash Cyberのような専用モデルが今後どこまで一般開発者に開放されるのか、Fairwind Programの拡大にも注目したい。

おすすめAIツール

参考リンク(公式・主要メディア): Google公式ブログ / Gemini API 公式ドキュメント / Thurrott

#AI #生成AI #Gemini #サイバーセキュリティ #2026
← 記事一覧に戻る