Gemini 3.6 Flashとは?料金・性能・3.5との違い・API移行【2026年7月】
Googleは2026年7月21日、Gemini 3.6 Flashを正式発表し、同日から一般提供(GA)を始めました。発表直後のため「Gemini 3.5 Flashの誤記ではないか」「Gemini 3.6シリーズが出たのか」と混同しやすい状況ですが、正式なモデル名はGemini 3.6 Flash、モデルIDはgemini-3.6-flashです。
結論:「Gemini 3.6」として正式公開されているモデルはGemini 3.6 Flashです。Gemini 3.5 Flashを基盤に、コーディング、知識労働、マルチモーダル理解、複数ステップのAIエージェント処理を強化しています。約100万トークンのコンテキストを持ち、標準料金は入力100万トークンあたり1.50ドル、出力7.50ドルです。
本記事のポイント
- Gemini 3.6 Flashは2026年7月21日にGA提供が始まったGemini 3シリーズの主力Flashモデルで、モデルIDはgemini-3.6-flashです。
- 3.5 Flashと入力単価は同じですが、標準の出力単価は100万トークンあたり9.00ドルから7.50ドルへ下がり、Googleは出力トークン量も17%減ったと説明しています。
- Gemini 3.6 Proは未発表です。GoogleはGemini 4の事前学習開始を公表しましたが、発売日、仕様、価格は明らかにしていません。
Gemini 3.6 Flashとは?正式名称・仕様・提供範囲
Gemini 3.6 Flashは、Googleが「workhorse model」と位置付ける、高い品質と処理効率の両立を狙ったモデルです。名称に3.6とありますが、別の「Gemini 3.6ファミリー」が一式発表されたわけではありません。Google DeepMindのモデルカードでは、Gemini 3シリーズに追加されたモデルで、Gemini 3.5 Flashを基盤にすると説明されています。
Googleの発表では、Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、限定提供のGemini 3.5 Flash Cyberが同時に紹介されました。数字が前後して見えますが、3.6 Flashは品質と効率を両立する主力モデル、3.5 Flash-Liteは大量処理向けの最速・低価格モデルです。両者は役割が異なります。
2026年7月22日時点のGemini API公式モデルページで確認できる主な仕様は次のとおりです。
| 項目 | Gemini 3.6 Flashの公式仕様 | 実務での読み方 |
|---|---|---|
| モデルID | gemini-3.6-flash | Stable / GAとして本番評価に使える。可変aliasではなく明示IDで検証する。 |
| 入力 | テキスト、画像、動画、音声、PDF | 文書・画面・録音・動画を含むマルチモーダル処理に使える。 |
| 出力 | テキスト | 画像生成や音声生成のモデルではない。 |
| コンテキスト | 1,048,576トークン | 長い資料やコードを扱えるが、投入量と精度・費用は別に評価する。 |
| 最大出力 | 65,536トークン | 長い成果物を生成できる一方、不要な長文化を抑える設計が必要。 |
| 知識カットオフ | 2026年3月 | それ以降の情報はSearch groundingや最新資料で補う。 |
| 標準thinking level | medium | 単純処理でも一定の思考コストが乗るため、処理別に評価する。 |
| 主な対応機能 | Thinking、構造化出力、キャッシュ、コード実行、関数呼び出し、File Search、Google Search / Maps grounding、URL context | 単発チャットより、ツールを使う業務フローで価値が出やすい。 |
| 非対応 | 画像生成、音声生成、Live API | 生成やリアルタイム音声対話は専用モデルへ分ける。 |
提供先も分けて見る必要があります。公式発表とモデルカードでは、Gemini API、Google AI Studio、Geminiアプリ、Gemini Enterprise App、Gemini Enterprise Agent Platform、Google Antigravity、Android Studioでの提供が案内されています。一方、Gmail、Docs、SheetsなどGoogle Workspace内蔵Geminiの基盤モデルが一律に3.6 Flashへ切り替わったという発表は確認できません。アプリ版、API版、Enterprise版を同じ利用条件だと考えないことが重要です。
前世代の発表内容や企業での検討軸を確認したい場合は、Gemini 3.5 Flashと企業利用の整理もあわせて読むと、今回変わった点を把握しやすくなります。
Gemini 3.6とGemini 4の関係|3.6はFlash、4は事前学習中
2026年7月22日時点で、正式公開されている「3.6」モデルはGemini 3.6 Flashです。Gemini 3.6という単独モデルやGemini 3.6 Proは発表されていません。Googleがパートナーとテスト中だと説明しているProモデルはGemini 3.5 Proです。
| 検索される名称 | 公式状況 | 正確な理解 |
|---|---|---|
| Gemini 3.6 Flash | GA・提供中 | 2026年7月21日公開。モデルIDはgemini-3.6-flash。 |
| Gemini 3.6 | 単独モデルは未確認 | 3.6 Flashの略称として使われるが、公式な製品名ではない。 |
| Gemini 3.6 Pro | 未発表 | 存在、発売日、仕様は確認されていない。 |
| Gemini 3.5 Pro | パートナーテスト中 | Googleが広い提供を予告しているProモデル。 |
| Gemini 4 | 事前学習開始 | 開発は公式確認済みだが、発売日、モデル構成、性能、価格は未発表。 |
Googleは7月21日の発表で、Gemini 4について過去最も野心的な事前学習を開始したと明らかにしました。これは製品発表や提供開始ではありません。確定している事実、未発表項目、Gemma 4やImagen 4との違いは、Gemini 4はいつ出るのかを整理した最新情報で詳しく解説しています。
料金と3.5 Flashとの性能差をどう読むか
Gemini Developer APIの公式料金表では、Gemini 3.6 Flashの有料Standard料金は入力100万トークンあたり1.50ドル、出力100万トークンあたり7.50ドルです。出力料金にはthinking tokenも含まれます。Gemini 3.5 Flashは入力1.50ドル、出力9.00ドルなので、入力単価は据え置き、出力単価は約16.7%下がりました。
| 利用方式 | 入力 / 100万トークン | 出力 / 100万トークン | 向いている処理 |
|---|---|---|---|
| Standard | 1.50ドル | 7.50ドル | 通常の同期処理、本番アプリ、対話型エージェント |
| Batch | 0.75ドル | 3.75ドル | 24時間以内でよい大量処理、評価、集計 |
| Flex | 0.75ドル | 3.75ドル | 遅延やスロットリングを許容できる非緊急処理 |
| Priority | 2.70ドル | 13.50ドル | 応答性能を優先する重要処理 |
Standardのキャッシュ入力は100万トークンあたり0.15ドルで、明示的キャッシュの保存料金は100万トークン・1時間あたり1.00ドルです。Google Search / Maps groundingはGemini 3モデルで共有する無料枠の後、検索クエリ単位の料金がかかります。1回のユーザー依頼から複数検索が実行されることもあるため、モデルの入出力単価だけで総額を見積もらない方が安全です。
無料枠も公式料金表にありますが、有料枠とは利用上限とデータの扱いが異なります。料金表では、無料枠の送信内容はGoogle製品の改善に利用され、有料枠では利用されないと説明されています。顧客情報や機密資料を扱う業務では、無料かどうかより、契約、認証、ログ、データ保護、利用規約とデータ利用条件を先に確認してください。
Googleは、Artificial Analysis IndexでGemini 3.6 Flashの出力トークン量が3.5 Flashより17%少なく、長いワークフローでthinking stepやtool callも減ると説明しています。ここでいう17%は速度が17%上がったという意味ではなく、出力トークンの削減です。業務では、単価とトークン量の両方が下がれば、1タスクあたりの総コストを抑えられる可能性があります。
| Google公表ベンチマーク | Gemini 3.6 Flash | Gemini 3.5 Flash | 見るべき能力 |
|---|---|---|---|
| SWE-Bench Pro | 58.7% | 55.1% | 多様なコーディング課題 |
| DeepSWE v1.1 | 49% | 37% | 長時間のソフトウェア開発 |
| MLE-Bench | 63.9% | 49.7% | 機械学習エンジニアリング |
| OSWorld-Verified | 83.0% | 78.4% | 画面を使うエージェント操作 |
| GDPVal-AA v2 | 1421 Elo | 1349 Elo | 知識労働 |
| GDM-MRCR v2・1M | 54.0% | 26.6% | 100万トークンの長文脈理解 |
この表はGoogle DeepMindの公表値です。公式の評価方法によると、多くはGoogleによる自己計測で、DeepSWEでは3.6 Flashがhigh reasoning、3.5 Flashがmedium reasoningと、条件が完全に同一ではありません。「すべての競合モデルより優れている」とは言えず、ベンダー公表値は自社評価を始めるための仮説として扱うのが妥当です。
大量の分類、翻訳、文書抽出などでは、3.6 Flashより低価格なFlash-Liteが合うことがあります。軽量モデルとの役割分担は、Gemini 3.1 Flash-Liteの料金と使い方で整理しています。2026年7月21日には後継の3.5 Flash-Liteも発表されているため、新規評価では3.5 Flash-Liteを比較対象にしてください。
APIでの使い方と移行時の破壊的変更
Googleは最新機能へアクセスする入口として、GAになったInteractions APIを推奨しています。Pythonではgoogle-genaiを使い、モデルIDを明示して呼び出します。APIキーはコードに直書きせず、環境変数やシークレット管理に置いてください。
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="次の顧客要望を、要約・優先度・次の対応を持つJSONに整理してください:請求書の承認を自動化したい",
store=False,
)
print(interaction.output_text)
Interactions APIはデフォルトでstore=trueとなり、InteractionオブジェクトはPaid Tierで55日、Free Tierで1日保持されます。機密情報を扱い、サーバー側の会話継続やバックグラウンド実行が不要なら、上の例のようにstore=Falseを明示します。store=Falseではprevious_interaction_idによる会話継続とbackground=trueを利用できないため、保持要件と機能要件を先に決めてください。
既存の3.5 FlashやGemini 3系previewから移行するときは、モデルIDの置換だけでは不十分です。Googleの最新モデル移行ガイドでは、Gemini 3.6 Flashと今後のモデルに適用されるAPI変更が案内されています。
| 見直す項目 | Gemini 3.6 Flashでの扱い | 移行方法 |
|---|---|---|
temperature / top_p / top_k | 非推奨で現在は無視され、将来世代では指定時にエラー予定 | リクエストから外し、system instructionと評価例で出力を制御する。 |
frequency_penalty / presence_penalty | Enterprise仕様ではカスタム値を指定するとエラー | 旧設定を削除し、実際の提供面で回帰テストする。 |
thinking_budget | 旧形式 | thinking_levelのmediumまたはhighへ変更する。 |
candidate_count | Gemini 3.xでは非対応 | 1回の応答を評価し、必要ならアプリ側で再実行を制御する。 |
| model turnのprefill | 最後の入力がmodel roleだとHTTP 400 | system instruction、構造化出力、server-sideの会話継続へ移す。 |
| FunctionResponse | generateContentではcall_idとnameが重要 | tool callの対応関係とthought signatureを含めて検証する。 |
特に、temperatureを下げて決定性を出していたアプリは注意が必要です。3.6 Flashではその値に依存できないため、出力スキーマ、禁止事項、根拠欄、失敗時の形式をsystem instructionで明示し、同じ評価セットを複数回流してぶれを測ります。
またGoogleは、3.6 Flashが診断タスクで先にコードを使って調べる傾向を持ち、複雑な作業の精度向上につながる一方、簡単なフロントエンド作業では探索が増える場合があると説明しています。機能コードは改善しても、UIの見た目では以前のモデルを好む人手評価もあったため、デザインシステム、余白、配色、禁止表現を明示することが重要です。
企業でのモデル選定と安全な導入方法
Gemini 3.6 Flashを「最も新しいから全処理へ入れる」と考えると、費用もリスクも増えます。選定の軸はモデル名ではなく、タスクの複雑さ、処理件数、失敗コスト、必要なツール、応答時間です。複数ベンダーを含む全体像は、AIモデル選定ガイド2026を基準にすると整理しやすくなります。
| 処理の性質 | 起点にする候補 | 実務例 | 評価項目 |
|---|---|---|---|
| 複雑で複数ステップ | Gemini 3.6 Flash | コード移行、長い調査、複数資料の分析、ツールを使う業務エージェント | 完了率、不要な変更、tool call数、レビュー工数 |
| 大量・低遅延・定型 | Gemini 3.5 Flash-Lite | 分類、翻訳、文書抽出、JSON整形、サブエージェント | 1件単価、処理速度、再実行率、抽出精度 |
| 高難度の深い推論 | Pro系を含めて比較 | 重要な設計、科学・技術調査、例外の多い意思決定支援 | 根拠、再現性、専門家レビュー、失敗時の損失 |
| 画像・音声の生成 | 専用のImage / Live / TTSモデル | 画像制作、リアルタイム音声対話、音声出力 | 生成品質、遅延、権利、専用料金 |
利用形態と提供先も分けて考えてください。個人がGeminiアプリで試す場合、開発者がGemini APIやAI Studioで組み込む場合、企業がGemini Enterprise Agent PlatformでIAM、監査、セキュリティ制御を使う場合では、同じモデル名でも契約と管理方法が違います。APIの約100万トークンという仕様を、Geminiアプリの全プランでそのまま使えると解釈することもできません。
AIエージェント用途では、最初から更新・送信権限を渡さず、閲覧、下書き、更新、社外送信を分けます。Google AntigravityやManaged Agentsとの関係は、AntigravityとManaged Agentsの企業利用で確認できます。
- 既存モデルで失敗や手戻りが多い実務タスクを20件以上集める。
- 3.5 Flash、3.6 Flash、3.5 Flash-Liteを同じ入力・同じ採点基準で比較する。
- 正答率だけでなく、出力トークン、会話ターン、tool call、処理時間、レビュー時間を記録する。
- 読み取り専用、下書き、更新、送信の権限を分け、停止条件を決める。
- 無料枠のデータ利用条件と、Paid / Enterpriseの契約・ログ・保存先を確認する。
- 小さなトラフィックから切り替え、旧モデルへ戻せるルーティングを残す。
限界・安全性・導入前に検証すべき注意点
新しいGAモデルでも、正確性が保証されるわけではありません。モデルカードは、一般的な基盤モデルと同様にハルシネーションが起こり得ること、時折遅延やタイムアウトが発生すること、知識カットオフが2026年3月であることを既知の制約として挙げています。検索や社内データでgroundingしても、引用先と結論が一致するかは確認が必要です。
安全性では、GoogleはCBRNと攻撃的サイバー利用へのFrontier Safety safeguardsを強化し、jailbreak耐性を高めつつ、正当な利用への過剰拒否を抑えたと説明しています。ただし、公表された安全性の一部は自動評価であり、人間による個別業務のリスク評価を置き換えるものではありません。顧客送信、契約判断、採用、財務、法務、セキュリティ変更などは、人間の承認を残してください。
Computer Useは提供先による差にも注意が必要です。Gemini Developer APIのモデルページはPreview対応と記載する一方、2026年7月22日時点のGemini Enterprise Agent Platformのモデル仕様では非対応と表示されています。発表記事との記載差もあるため、「Gemini 3.6 Flashなら全環境で画面操作できる」とは考えず、使うAPI、リージョン、アカウントで実際の対応状況を確認してください。
モデルの能力が上がるほど、評価とガバナンスは重要になります。ログ、権限、承認、評価セット、ロールバックの設計は、AIエージェントのガバナンス設計とセットで進めると、本番導入後の事故を減らしやすくなります。
よくある質問
Gemini 3.6とGemini 3.6 Flashは同じですか?
検索や会話では3.6 Flashを「Gemini 3.6」と略すことがありますが、公式なモデル名はGemini 3.6 Flashです。Gemini 3.6という単独モデルや、3.6世代のモデル一式が発表されたわけではありません。
Gemini 3.6 ProやGemini 4は発表されていますか?
Gemini 3.6 Proは発表されていません。Googleがパートナーとテスト中なのはGemini 3.5 Proです。Gemini 4は事前学習開始だけが公式確認されており、発売日、モデルID、仕様、価格は未発表です。
Gemini 3.6 Flashは無料で使えますか?
Gemini Developer APIの料金表には無料枠と有料枠があります。有料Standardは入力100万トークンあたり1.50ドル、出力7.50ドルです。無料枠は利用上限があり、送信内容の扱いも有料枠と異なります。本番業務では無料かどうかだけでなく、データ利用条件、認証、ログ、レート制限を確認してください。
Gemini 3.6 FlashはGeminiアプリで使えますか?
Googleは2026年7月21日の発表で、Geminiアプリを提供先に挙げています。ただし、画面上のモデル表示、段階展開、プラン別のコンテキスト上限はAPIと同一とは限りません。モデルピッカーと公式ヘルプで、自分のアカウントに表示される選択肢を確認してください。
GmailやGoogle DocsのGeminiも3.6 Flashになりましたか?
Gmail、Docs、SheetsなどGoogle Workspace内蔵Geminiの基盤モデルが一律に3.6 Flashへ切り替わったという公式発表は、2026年7月22日時点では確認できません。Geminiアプリ、Workspaceアカウントで使うAI Studio、Workspace内蔵Geminiは別の提供面として確認する必要があります。
Gemini 3.6 Flashで画像や音声を生成できますか?
画像、動画、音声を入力して理解できますが、出力はテキストです。画像生成、音声生成、Live APIには対応していません。画像生成はGemini Image系、リアルタイム音声対話はLive対応モデルなど、目的に合う専用モデルを選びます。
Gemini 3.6 Flashと3.5 Flash-Liteはどちらが速くて安いですか?
Googleは3.5 Flash-Liteを3.5シリーズで最速・最安のモデルと位置付けています。3.6 Flashは、複雑なコーディング、知識労働、マルチモーダル理解、長いエージェント処理で品質と効率を両立する主力モデルです。大量の定型処理はFlash-Lite、複雑な処理は3.6 Flashを起点に比較します。
3.5 FlashからモデルIDを変えるだけで移行できますか?
モデルIDの変更だけでは不十分です。temperature、top_p、top_k、frequency / presence penalty、thinking_budget、candidate_count、model turnのprefill、function callingの形式を確認してください。自社評価セットで出力品質、tool call、総トークン、手戻り、タイムアウトを比較してから段階的に切り替えます。