# グーグルの新Flashモデル、狙いは一つ——AIエージェントをもっと安く、速く

> Gemini 3.6 Flash、3.5 Flash-Lite、そしてセキュリティ専用の3.5 Flash Cyber。いずれもAIエージェントを大規模に、より安く、無駄なトークンを使わずに動かすことを狙う。

_Source: Google (first-party announcement) · 2026-07-21 · 5 min read · Verified against primary sources_

Canonical: https://iyu.app/ja/e/gemini-3-6-flash-family

## 60秒でわかる

グーグルが新しいGemini Flashを3モデル発表——3.6 Flash、3.5 Flash-Lite、そしてセキュリティ専用の3.5 Flash Cyber。いずれもAIエージェントを大規模・低コストで動かすために調整され、売りは効率（1タスクあたりのトークンを減らすこと）。

**要点**

- 3.6 Flash：主力——出力トークンが3.5 Flashより約17%少ないとグーグルは主張し、価格も100万トークン1.5/7.5ドルに引き下げ。
- 3.5 Flash-Lite：最速で最安（入力30セント）、毎秒350トークン。一部のエージェント検証では古く大きい「3 Flash」に勝つという。
- 3.5 Flash Cyber：デュアルユースの脆弱性発見・修正ツール。CodeMenderパイロットで政府と信頼パートナーに限定。
- 3.5 Proは間もなく登場。Gemini 4の事前学習も開始済み。

**結論.** エージェント時代は純粋な体量より安い効率を評価する、という明確な賭けだ——ただし数字はほぼグーグル自身のもの。証明済みの結果ではなく、有望な主張として受け止めたい。

## 本文

> **⚑ Caveat:** 以下のほぼすべての数字——トークン削減、ベンチマーク、速度——は**グーグル自身**のもの、またはグーグルが選んで引用した指数によるものです。独立した検証で確認されるまでは、ベンダーの主張として扱ってください。


### 何が出たか — 3つのモデル、一つの執念——効率

グーグルが「安くて速い」**Gemini Flash**シリーズを刷新し、新モデルを3つ一挙に投入した。狙いはすべて同じ——AI**エージェント**、つまりツールを呼び自分の作業を確認しながら多段のタスクをこなすシステムを、大規模かつ低コストで動かすこと。共通点は脳の大きさではなく、同じ仕事をより少ないトークンでこなすこと。トークンこそエージェントが実際に金を払う対象だ。

顔ぶれは——**3.6 Flash**、より強力な日常の主力。**3.5 Flash-Lite**、超低価格の速度重視型。そして**3.5 Flash Cyber**、パイロット計画の中に封じられたセキュリティ専用版。


### 主力馬 — 3.6 Flash：同じ仕事を、より少ない言葉で

3.6 Flashの見出しはベンチマークではなく倹約だ。第三者のArtificial Analysis指数で、同じ仕事を3.5 Flashより約**17%少ない出力トークン**でこなし（一部のコーディング検証では最大65%少ない）、必要な推論ステップやツール呼び出しも減ったとグーグルは言う。価格も下げた。エージェントはトークン単位で払うので、1タスクあたりのトークンが減れば実質的な節約になる。

- **17%** — 3.5 Flashより少ない出力トークン（Artificial Analysis指数）
- **$1.50** — 100万入力トークンあたり
- **$7.50** — 100万出力トークンあたり

品質面でも、グーグルは3.5 Flash比で全面的な向上を報告——コーディングの精度、機械学習研究タスクの大幅な伸び、そして**コンピュータ操作**（人のように画面を操作する能力）の改善。これはいまGemini APIの組み込みツールだ。

- **ベンチマーク（3.6 対 3.5 Flash）:** スコア
- **DeepSWE（コーディング）:** 49% 対 37%
- **MLE Bench（ML研究）:** 63.9% 対 49.7%
- **OSWorld-Verified（コンピュータ操作）:** 83.0% 対 78.4%
- **GDPval-AA v2（知識労働）:** 1421 対 1349

*Figure: グーグルが示した3.6 Flashの品質ベンチマーク図。*


### 格安の俊足 — 3.5 Flash-Lite：安い、速い、そして意外と強い

Flash-Liteは3.5ファミリー最速——グーグルの計測で毎秒**350出力トークン**——かつ最安、100万入力トークンで30セント、出力で2.5ドル。役目は高スループット・低遅延の仕事：エージェント検索、文書処理、大きなパイプライン。開発者は「思考」レベルを上下させ、速度と深さを天秤にかけられる。

目を引く主張：いくつかのエージェントやコーディング検証で、Flash-Liteはより古く大きい**「3 Flash」に勝つ**とグーグルは言う——例えばSWE-Bench Pro（54.2% 対 49.6%）、OSWorld-Verified（74.0% 対 65.1%）。小さく安くても、弱いとは限らない。


### 施錠された扉 — 3.5 Flash Cyber：安全の専門家、あえて封印

3つ目は種類が違う。**3.5 Flash Cyber**は、ソフトウェアの脆弱性を見つけて直すことだけに微調整されたFlashで、**CodeMender**というシステムの中で動く。設計の妙は、CodeMenderが複数のFlash Cyberエージェントを協働させ、一つの統合報告書にまとめる点だ。CyberGymベンチマークで競争力ある最前線の性能に達したとグーグルは言う。

> **🔒** グーグルはこれが**デュアルユース**だと明言する——バグを直す力は、悪用のためにバグを見つける力でもある。だからFlash Cyberは広く公開されない：CodeMenderのパイロットを通じ**政府と信頼できるパートナー**に限定し、守り手に先手を与えつつ悪用を抑える。


### なぜ重要か — 業界は「最大」から「実用最安」へ舵を切る

引いて見ると、この発表はより大きな物語を語る——競争は*一つの巨大モデルがどれだけ賢くなれるか*から、*そこそこ良いモデルで数百万のエージェントタスクをいかに安く回すか*へと移っている。純粋な規模ではなく効率が新しい戦場だ。エージェントは1トークンを数千ステップ分に掛け算するからだ。

> AIエージェントにとって勝つモデルは、最も賢いものではなく、最も少ないトークンで答えにたどり着くものだ。

グーグルはさらに、**Gemini 3.5 Pro**がパートナーとテスト中で間もなく登場すると述べ、そして最も眉が上がる一言——**Gemini 4**の事前学習がすでに始まった、と。

> **⚡** 3.6 Flashと3.5 Flash-Liteは本日提供開始：Gemini API（Google AI Studio、Android Studio）、Gemini Enterprise、Geminiアプリ経由。Flash-Liteはグーグル検索にも順次展開。


## Primary sources

- [Google — 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/)

---
_Published by iyu (https://iyu.app) — the day's AI news, checked against primary sources and rewritten in plain language. Free to quote with attribution and a link to the canonical URL._
