Gemini 3.6 Flash / Flash-Lite / Flash Cyber 徹底解説 — 安くて速いエージェント向けTierと「檻に入れた」セキュリティ特化AI
はじめに
2026年7月21日、Google が Gemini の Flash 系ラインナップを一気に3つ更新した。汎用ワークホースの Gemini 3.6 Flash、最速・最安の 3.5 Flash-Lite、そしてセキュリティ用途に特化した 3.5 Flash Cyber だ。Hacker News では投稿直後に412ポイントを集め、最上位クラスの注目を浴びている。
一見すると「毎度の小刻みなモデル更新」に見えるが、今回のリリースには2つの明確なメッセージがある。ひとつは「エージェント運用のトークンコストを本気で削りにきた」こと、もうひとつは「危険な能力を持つモデルは、あえて配布を絞る」という方針を製品ラインで明示したことだ。本記事では3モデルの中身を整理したうえで、特に異色の Flash Cyber が何を意味するのかをエンジニア視点で掘り下げる。
3つのモデルは何が違うのか
まず全体像を数字で押さえておく。3モデルはいずれも「エージェントワークフロー向けに、効率・レイテンシ・信頼性を最適化した」と位置づけられている。
| モデル | 入力価格 | 出力価格 | 特徴 |
|---|---|---|---|
| 3.6 Flash | $1.50 / 1M | $7.50 / 1M | 新しい既定のワークホース。トークン効率17%改善 |
| 3.5 Flash-Lite | $0.30 / 1M | $2.50 / 1M | 最速350 tok/s・最安。検索や文書処理向け |
| 3.5 Flash Cyber | 非公開(限定配布) | 非公開 | 脆弱性の検出・検証・修正に特化 |
Gemini 3.6 Flash は 3.5 Flash の後継となる新しい既定モデル。Artificial Analysis Index 上で 3.5 Flash 比 出力トークンを17%削減し、Datacurve の DeepSWE ベンチマークでは最大65%のトークン削減を報告している。ベンチマーク面でもコーディング(DeepSWE 49% vs 37%)、ML研究タスク(MLE Bench 63.9% vs 49.7%)、コンピュータ操作(OSWorld 83.0% vs 78.4%)と着実に上積みしている。
3.5 Flash-Lite は3つの中で最速・最安。入力$0.30/出力$2.50という価格帯で、実測350トークン/秒という速度を叩き出す。検索結果の生成やドキュメント処理など、大量のリクエストを低遅延でさばく用途に向く。SWE-Bench Pro でも54.2%と、上位の 3 Flash(49.6%)を上回る。
つまり Flash Tier の狙いは明快で、**「同じ仕事をより少ないトークンで終わらせる」**ことにある。エージェントは1タスクで何十回とモデルを呼ぶため、出力トークンの削減はそのまま運用コストに効く。派手な最上位モデル競争とは別の、地に足のついた勝負どころだ。
Flash Cyber と CodeMender — 「檻に入れた」セキュリティAIの仕組み
今回もっとも異色なのが Gemini 3.5 Flash Cyber だ。3.5 Flash をベースに、ソフトウェアの脆弱性を「発見し、検証し、パッチを当てる」ことへ特化してファインチューニングされている。実世界の脆弱性で評価する CyberGym ベンチマークで、はるかに大きなモデルに対して「フロンティア級の競争力」を示したという。
技術的に興味深いのは、Flash Cyber が単体で使うモデルではなく、DeepMind の CodeMender エージェントの部品として設計されている点だ。CodeMender は静的解析・動的解析・差分テスト・ファジング・SMTソルバといった従来のプログラム解析ツールを束ね、脆弱性の根本原因を突き止めて修正パッチまで生成する自律エージェントである。すでにオープンソースへ72件のセキュリティ修正をアップストリームした実績を持つ。
ここで効いてくるのが Flash Cyber の「安さ」だ。CodeMender は1つの最終レポートを出すために Flash Cyber を最大5回呼び出す構成を取り、この反復によって大型モデル単発を上回る精度を引き出している。安価で高速なモデルを何度も回して精度を積み上げる——Flash Tier のコスト効率が、そのままセキュリティエージェントの設計思想に組み込まれているわけだ。
そして最大の特徴が配布ポリシーである。Flash Cyber は一般 API では提供されず、CodeMender 経由に限定されたうえ、政府機関と審査済みパートナーのみを対象とした限定パイロットとして提供される。脆弱性の発見・修正能力は、そのまま攻撃側にも転用できるデュアルユース技術だ。SiliconANGLE が「檻に入れたバグハンター(a bug-hunter it keeps on a leash)」と表現したように、Google は能力の高いモデルをあえて open に出さない選択をした。
エンジニアへの影響
実務への影響は、立場によって分かれる。
アプリ開発者・エージェント運用者にとっては、3.6 Flash と 3.5 Flash-Lite がすぐに使える現実的な選択肢になる。既定モデルが 3.6 Flash に切り替わることで、既存のプロンプトを変えずとも出力トークンが減り、月々のAPI請求が下がる可能性がある。特にツール呼び出しを多数繰り返すエージェント構成では、17%のトークン削減は無視できない。Flash-Lite は RAG の候補生成や大量分類など「速さと安さがすべて」のレイヤーに刺さる。
一方で注意点もある。Google は GitHub Copilot での Gemini 2.5 Pro / 3 Flash を 2026-07-31 に廃止予定としており、3.1 Pro / 3.5 Flash への移行が必要だ。モデルの世代交代が速いため、バージョン固定とマイグレーション計画をルーチンに組み込んでおきたい。
セキュリティ・プラットフォーム側にとっては、Flash Cyber は「今すぐ触れる道具」ではなく「AIによる脆弱性修正が実運用フェーズに入った」というシグナルとして読むべきだ。CodeMender のようにモデルを既存の解析ツール群のオーケストレーションに組み込む設計は、自前でセキュリティ自動化を組む際の参考になる。汎用LLM単発ではなく、専用チューニング+反復呼び出し+従来ツール連携という構成が、実用精度の鍵になっている。
まとめ
- Gemini Flash 系の新3モデルは「エージェント運用のトークンコスト削減」が共通テーマ。
- 3.6 Flash は既定ワークホースで出力トークン17%減、3.5 Flash-Lite は350 tok/sの最速・最安。
- 3.5 Flash Cyber は脆弱性検出・修正に特化し、CodeMender 経由・政府/審査済みパートナー限定という異例の制限配布。
- 安価なモデルを最大5回反復呼び出しして精度を稼ぐ設計は、コスト効率とセキュリティエージェントの思想が直結した好例。
派手な最上位モデル競争の裏で、Google は「安く・速く・そして危険なものは檻に入れて」という現実的な運用戦略を製品ラインで示した。今後は能力そのものより「どう配るか」がAIベンダーの差別化軸になっていくだろう。