概要
Googleは2026年7月21日、Gemini公式ブログにて新モデル「Gemini 3.6 Flash」「Gemini 3.5 Flash-Lite」、そしてセキュリティ特化の「Gemini 3.5 Flash Cyber」を発表しました。いずれもAIエージェント(自律的にタスクをこなすAI)を大規模に運用するための効率性・低遅延・信頼性を高めることを目的としたモデルです。
何が発表・更新されたのか
発表されたのは以下の3モデルです。
- Gemini 3.6 Flash:コーディングや知識作業、マルチモーダル(文章・画像など複数形式を扱う)性能を高めた主力モデルです。Artificial Analysis Indexによると、出力トークン消費量は3.5 Flashに比べて17%削減され、DeepSWEなど一部ベンチマークでは最大65%の削減が確認されたとしています。価格は入力100万トークンあたり1.50ドル、出力100万トークンあたり7.50ドルです。
- Gemini 3.5 Flash-Lite:3.5系列で最速・最も費用対効果が高いモデルとされ、Artificial Analysis Indexの計測で秒間350出力トークンを実現しています。価格は入力100万トークンあたり0.3ドル、出力100万トークンあたり2.5ドルです。
- Gemini 3.5 Flash Cyber:サイバーセキュリティ用途に特化したモデルで、コード脆弱性の検出・修正を行うエージェント「CodeMender」と組み合わせて使われます。
なお、公式ブログでは「Gemini 3.5 Pro」が現在パートナーとテスト中であること、次世代モデル「Gemini 4」の事前学習を開始したことにも触れられています。
なぜ重要なのか
AIエージェントを実際の業務で使うには、応答速度(低遅延)とコスト効率、そして安定した精度が欠かせません。今回の発表は、これらのバランスを改善した点が特徴です。特に3.6 Flashは、性能を上げながらトークン消費量とコストを下げるという、通常はトレードオフになりやすい要素を両立させたとされています。また3.5 Flash-Liteは、旧世代のFlash-Liteだけでなく、上位モデルである「3 Flash」を一部ベンチマークで上回ったとされており、コストを抑えつつ高い処理能力を求める用途に適した位置づけです。
誰に関係があるのか
- 自社サービスにAIエージェントや自動化機能を組み込みたい開発者・企業の担当者
- 大量の文書処理や高頻度のAPI呼び出しを行うシステムを運用している企業
- コード開発やセキュリティ診断を効率化したいエンジニアリング部門
仕事や業務でどう使えるのか
公式ブログの事例では、財務データや議事録の解析、コードの移行作業、レポート作成、eコマースの商品情報抽出、画像を使ったテクスチャ生成など、幅広い業務での活用例が紹介されています。また、3.5 Flash-Liteは低遅延・低コスト設定と高精度なマルチステップ処理設定を用途に応じて切り替えられる点も紹介されており、コールセンターの自動応答や大量データの一次処理といった高頻度タスクへの応用が想定されます。3.5 Flash Cyberは、CodeMenderと組み合わせることで、コードの脆弱性を検出・検証・修正する作業の効率化に使われています。
注意点
公式情報上では、日本での提供状況や対象プランの詳細は確認できませんでした。料金は米ドル建てで示されており、日本円換算や請求方法についても公式情報からは確認できません。また、3.6 Flashにはジェイルブレイク(安全対策の回避)耐性を高めるための安全機構が組み込まれている一方、有用な用途での過剰な拒否は抑えるよう調整されているとのことです。実際の導入にあたっては、公式のモデルカードや最新の利用規約を必ず確認することをおすすめします。
公式情報
Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber(Google Gemini Blog)
関連キーワード
- Gemini 3.6 Flash
- Gemini 3.5 Flash-Lite
- Gemini 3.5 Flash Cyber
- CodeMender
- AIエージェント
- Gemini API





