本文へスキップ
AI AIエージェント

Gemini 3.7 Flashとは?料金・性能・3.6との違い・使い方を徹底検証

Gemini 3.6 Flashから3.7 Flashへの移行を性能・速度・料金・安全性で比較検証するイメージ

「Gemini 3.7が出た」という情報は事実です。ただし、Googleが2026年8月13日に正式発表した名称はGemini 3.7 Flashで、3.7 Proではありません。Gemini APIではgemini-3.7-flashとして一般提供(GA)され、本番利用可能です。

3.7 Flashは、3週間前に登場した3.6 Flashを土台に、コア推論へアルゴリズム上の改善を加えたモデルです。Google公表値ではコーディング、Web UI、PDF処理、コンピュータ操作、長文推論で大きく伸びました。独立評価のArtificial Analysisも高い出力速度を測定していますが、総合首位でも全指標改善でもありません。導入判断には、公式の宣伝値、第三者測定、自社の代表タスクを分けて見る必要があります。

Gemini 3.7 Flashは、1Mトークンの入力、65,536トークンの出力、多数のツール連携を備えたGAモデルです。 3.6からコード・UI・PDF・エージェント用途が強化された一方、初動待ち、ハルシネーション、期間限定価格、APIの非互換変更があるため、3.6から無検証で置き換えずA/Bテストして移行します。

Gemini 3.6 Flashと3.7 Flashを代表タスク、正確性、速度、料金、安全性でA/B評価してから業務へ展開する流れ
3.7への移行はモデル名の置換だけでなく、代表タスクの完了率、引用精度、初動時間、総コスト、停止条件を3.6と同じ条件で比較します。

本記事のポイント

  1. Gemini 3.7 Flashは2026年8月13日にGAとなった正式モデルで、3.7 Proの発表ではありません。
  2. Google公表値ではコード・UI・PDF・エージェント処理が3.6から伸びましたが、全指標で首位ではありません。
  3. 移行時はAPI互換性、正答率、引用精度、初動時間、思考トークン込みの総コストを自社タスクで比較します。

Gemini 3.7 Flashは正式リリース済み|まず確認すべき事実

Googleの公式発表DeepMindモデルカードによると、発表日は2026年8月13日です。Gemini APIのモデル仕様ではStable、モデル解説ではGA・production-readyと明記されています。「リーク」「プレビュー」「近日公開」ではなく、API利用者は正式モデルIDを指定できます。

項目確認できた公式仕様判断上の注意
正式名称Gemini 3.7 Flash3.7 Proは今回発表されていない
APIモデルIDgemini-3.7-flashgemini-flash-latestが3.7を指すとは確認できない
提供状態Stable / GA / production-ready機能ごとのPreview状態は別に確認する
入力上限1,048,576トークン長文を入れられることと正確に使えることは別
最大出力65,536トークン思考トークンも出力課金へ含まれる
入出力テキスト・画像・動画・音声・PDF入力、テキスト出力画像生成・音声生成・Live APIは非対応
思考レベルlow / medium / high既定はmedium、minimalは非対応
知識カットオフ原則2026年3月一部領域は2025年1月相当の場合がある

対応機能は、Function Calling、Code Execution、Context Caching、File Search、Structured Output、URL Context、Google Search・Mapsグラウンディング、Computer Use(Preview)などです。Batch、Flex、Priorityの推論方式にも対応します。一方、画像生成、音声生成、Live API、モデルチューニングはサポートされません。マルチモーダルRAGの設計は、Gemini API File Searchのマルチモーダル対応でも具体的に整理しています。

どこで使えるのか

公式に明示された提供先は、Google AI Studio、Gemini API、Antigravity、Android Studio、Gemini Enterprise Agent Platform / App、個人向けGeminiアプリ内のGemini Sparkです。通常のGeminiチャットに「3.7 Flash」というモデル選択肢が全ユーザーへ一斉追加された、という発表ではありません。

日本でSparkを使う場合は、Gemini Sparkの公式ヘルプで、18歳以上、個人Googleアカウント、対象サブスクリプション、アクティビティ保存などの条件を確認してください。米国外では現時点でUltraが条件と案内されているため、「日本のPro会員なら必ず使える」「無料ユーザーも通常チャットで使える」とは判断できません。AI StudioとAPIは別の利用経路です。また、今回の公式ローンチ経路にVertex AIは明示されていないため、他のGoogle Cloud製品名から対応を推定しない方が安全です。

3.6 Flashから何が変わったか|公式ベンチと独立評価

Googleは3.7を新しい基盤アーキテクチャとは説明しておらず、「3.6 Flashをベースに、コア推論基盤をアルゴリズム改善したモデル」と位置づけています。パラメータ数、学習データの詳細、Proモデルからの蒸留といった情報は非公開です。

まず、DeepMindモデルカードに載る3.6比較を見ます。下表はGoogle公表値であり、すべてが独立機関による同条件測定ではありません。

評価3.7 Flash3.6 Flash差分
AA Intelligence Index5652+4
FrontierCode 1.143.6%34.4%+9.2pt
DeepSWE 1.165.3%48.6%+16.7pt
Code Arena / WebDev Elo15881538+50
AutomationBench30.4%17.0%+13.4pt
GDP.pdf34.0%22.0%+12.0pt
OSWorld 2.047.9%33.8%+14.1pt
GDM-MRCR 128K97.0%91.8%+5.2pt
CharXiv・ツールなし84.5%85.2%-0.7pt
CharXiv・ツールあり88.7%89.4%-0.7pt

伸びが大きいのは、コード生成だけでなく、実際のソフトウェア作業、Web UI、長いPDF、コンピュータ操作、長文コンテキストです。3.6の詳細を先に確認したい場合は、Gemini 3.6 Flashの料金・性能・移行ガイドと並べると差分が見えます。

「すべてのベンチで圧勝」ではない

Googleの評価方法を確認すると、DeepSWE、Terminal-bench、GDP.pdf、CharXiv、LVBench、GDM-MRCR、OSWorldなど多くの3.7スコアはGoogle自身の測定です。一部は公開リーダーボードやArtificial Analysis由来で、競合値にも各社自己申告が含まれます。動画の使用フレーム数、エージェントのscaffold、安全ポリシーなどの条件も完全にはそろっていません。

他社を含むGoogleの表でも、3.7は万能な首位ではありません。GDPVal-AA v2は1525で、Claude Sonnet 5の1598、GPT-5.6 Terraの1578、Muse Spark 1.2の1628を下回ります。DeepSWE、OSWorld、Agent’s Last Examでも上位の競合があります。さらにCharXivは3.6から小幅に低下しています。正確な読み方は「コード・UI・PDF・エージェントで3.6から強く伸びた有力モデル」であり、「全用途の最強モデル」ではありません。ベンチマーク設計そのものを確認する方法はAI第三者評価の確認ポイントも参考になります。

第三者実測では、出始めると非常に速い

第三者評価サービスのArtificial Analysisは、APIを使った独自測定でIntelligence Index v4.1.1を56.03、出力速度中央値を340.07トークン/秒、Time to First Token(TTFT)を9.83秒としています。同ページの比較群中央値は出力速度約68.7トークン/秒、TTFT約2.89秒です。

この結果は「最初から即応する」というより、high thinkingでは回答開始まで待つが、出力が始まると非常に速いことを示します。チャットの体感、ストリーミングAPI、バックグラウンドのエージェント処理では評価軸が異なります。短い問い合わせではTTFT、長いコードや文書では総完了時間を分けて測るべきです。リリースから1日未満の時点では、長期稼働率、日本語の業務品質、複数リポジトリでの再現性を示す第三者レビューはまだ十分ではありません。

料金とAPI仕様|安いのは2026年末までの導入価格

Gemini Developer APIの料金表では、Standard paidの導入価格が2026年12月31日まで設定されています。出力料金には通常の回答だけでなく、思考トークンも含まれます。

推論方式期間入力 / 100万トークン出力 / 100万トークン
Standard2026年12月31日まで$0.75$3.75
Standard2027年1月1日以降$1.50$7.50
Batch / Flex2026年12月31日まで$0.375$1.875
Batch / Flex2027年1月1日以降$0.75$3.75
Priority2026年12月31日まで$1.35$6.75
Priority2027年1月1日以降$2.70$13.50

注意したいのは、同じ導入価格が3.6 Flashにも適用されている点です。「3.7だけが3.6の半額になった」という理解は誤りです。コスト比較では入力・出力単価だけでなく、thinking level、再試行回数、長いコンテキスト、ツール呼び出し、検証作業まで含めます。Google SearchグラウンディングはGemini 3.x全体で月5,000検索クエリまで無料、超過後は1,000検索クエリ当たり14ドルです。1プロンプトから複数検索が走れば、その回数が課金対象になります。

無料枠では送信内容がGoogleの製品改善に使われる場合があり、有料枠では使われないと料金表に明記されています。企業データを扱う場合は「APIを使っているから同じ」ではなく、課金ティア、契約、保存、アクセス制御を確認してください。

本番採用の判断軸はベンチマーク順位ではなく、自社の代表タスクを正しく完了できた割合と、検証を含む総コストです。

導入・移行で失敗しない確認手順

3.6からの移行はモデルIDの文字列だけを置き換えて終わりではありません。Googleの移行ガイドは、Gemini 3.xのAPI挙動に合わせて複数の変更を求めています。

確認箇所3.7移行時の対応失敗すると起きること
モデルIDgemini-3.7-flashを明示するエイリアスが別版を指し、再現性を失う
sampling設定temperaturetop_ptop_kの独自指定を外す非対応・無視・品質変化を見落とす
思考設定thinking_budgetthinking_levelへ置換するエラー、待ち時間、コストが想定とずれる
候補数candidate_countを削除するGemini 3.xで非対応エラーになる
会話状態事前入力したmodel turnをやめ、previous_interaction_idを検討する複数ターンの前提が崩れる
Function CallFunction Responseへcall_idnameを正しく返すツール結果を誤って対応付ける
思考の継続thought signatureを保持して返す多段階タスクの推論連続性を損なう

A/Bテストは「同じ入力、同じ道具、同じ停止条件」で行う

  1. 代表タスクを固定する:短い質問だけでなく、実際のコード修正、UI再現、PDF根拠抽出、複数ツール操作、日本語の顧客文書を含めます。
  2. 成功条件を先に決める:テスト通過、引用一致、必須項目充足、禁止操作ゼロ、担当者の修正時間を数値化します。
  3. 速度を二つに分ける:TTFTと総完了時間を別々に測り、low・medium・highで比較します。
  4. 総コストを測る:入力、出力、思考、検索、再試行、人の検証時間を一つのタスク単位へ集約します。
  5. 段階導入する:読み取り・下書きから始め、少量の本番トラフィック、監査ログ、停止条件、3.6へのロールバックを用意します。

すぐ試す価値が高いのは、コード・Web UI・長いPDF・複数ツールのエージェント処理を3.6で運用し、品質または完了時間に課題があるケースです。反対に、リアルタイム音声、画像生成、極端に短い初動、第三者検証が蓄積した安定性が必須なら、3.7だけで要件は満たせません。現行モデル全体から用途別に絞る場合はAIモデル選定ガイド2026も併せて確認してください。

安全性と限界は全面改善ではない

DeepMindのモデルカードは、3.7にもハルシネーション、まれな応答遅延・タイムアウト、継続中の脱獄耐性改善があると明記しています。安全性評価もすべてが3.6より改善したわけではなく、Multilingual Safetyは改善した一方、Text Safety、拒否時のトーン、不当な拒否の自動指標は一部悪化しました。Googleは手動確認で多くが誤検知または深刻でないと説明していますが、「新モデルだから安全性も全面向上」とは言えません。

Computer UseはPreviewです。ツール実行、ファイル更新、外部送信、購入、削除などを扱う場合は、最小権限、確認ステップ、監査ログ、回数・金額・対象ドメインの制限、緊急停止をモデル性能とは別に設計します。

よくある質問

Gemini 3.7 Flashは正式にリリースされましたか?

はい。Googleは2026年8月13日にGemini 3.7 FlashをGAとして公開しました。Gemini APIの正式モデルIDはgemini-3.7-flashです。今回発表されたのは3.7 Flashであり、3.7 Proではありません。

Gemini 3.7 Flashと3.6 Flashの違いは何ですか?

Googleは3.6 Flashをベースにコア推論をアルゴリズム改善したと説明しています。公表値ではコーディング、Web UI、PDF、コンピュータ操作、長文推論が伸びました。ただしCharXivなど3.6を下回る指標もあり、全タスクで上位互換とは限りません。

Gemini 3.7 Flashの料金はいくらですか?

Gemini Developer APIのStandard paidは、2026年12月31日まで100万トークン当たり入力0.75ドル、出力3.75ドルです。2027年1月1日から入力1.50ドル、出力7.50ドルになります。出力料金には思考トークンが含まれます。

Gemini 3.7 FlashへAPIを移行するときの注意点は何ですか?

gemini-3.7-flashを明示し、samplingの独自指定、candidate_count、事前入力したmodel turnを見直します。thinking_budgetthinking_levelへ移し、thought signatureとFunction Callのcall_idを保持してから、3.6と同じ条件でA/Bテストします。

日本のGeminiアプリで誰でも3.7 Flashを使えますか?

いいえ。公式に明示されている個人向け経路はGemini Sparkで、通常チャットの独立したモデル選択肢として全ユーザーへ開放されたとは確認できません。日本では対象地域、年齢、個人アカウント、対象プランなどの条件を公式ヘルプで確認します。AI StudioとGemini APIは別の経路です。

Gemini 3.7 Flashは画像や音声も生成できますか?

画像、動画、音声、PDFは入力できますが、3.7 Flashの出力はテキストのみです。画像生成、音声生成、Live APIには対応していません。

関連ページと関連記事

自社業務に合うAIモデルの検証・開発を相談する

一次情報と独立評価を確認する

Gemini 3.7 Flashは、3.6の速度と実務性を維持しながら、コード、UI、PDF、ツール実行を引き上げた有力なワークホースです。ただし、Googleの公表値と独立測定、自社の実務試験は役割が違います。正式モデルIDを固定し、代表タスクの完了率、根拠、初動、総時間、総コスト、安全な停止を3.6と比較できたとき、初めて移行判断ができます。

メディア一覧へ戻る