Googleが2026年8月13日(現地時間)に公開した「Gemini 3.7 Flash」は、コーディングとエージェント用途を前面に出したFlash系列の新モデルです。日本語圏では翌14日にITmediaなどが速報し、X上でも「3週間ぶりのFlash更新」「半額」という見出しが同時に流れました。
ただ、実際に請求書を見る側からすると、半額という言葉は少し注意が必要です。いまの単価は2026年12月31日までの導入価格であり、3.6 Flashも同じ日に同じ数字へ下げられています。つまり「3.7へ乗り換えた瞬間に請求が半分になる」わけではありません。
この記事では、公式発表と料金ページを突き合わせたうえで、フリーランスや小さなチームが年末までに何を試すべきかを整理します。
いま起きていること:3週間でFlashがもう一段上がった
Googleの公式ブログによると、Gemini 3.7 FlashはGemini 3.6 Flashからわずか3週間での投入です。位置づけは「これまでで最も知的な主力(workhorse)モデル」で、ソフトウェアエンジニアリング、ナレッジワーク、ウェブ開発を対象にしています。モデルIDは gemini-3.7-flash で、Gemini API、Google AI Studio、Android Studio、エージェント開発環境のGoogle Antigravity、法人向けのGemini Enterpriseから利用できます。
個人向けでは、160か国以上のGoogle AI Pro / Ultra向けエージェント「Gemini Spark」が、同日から3.7 Flashを使うと発表されています。チャット画面でモデル名を意識しなくても、メール下書きやファイル整理、Workspace連携の裏側が入れ替わる、という形です。
X(旧Twitter)側では、価格の数字とベンチマークの数字がスクリーンショットで回っていました。
価格の正しい読み方:「半額」は何と比べた半額か
公式の導入価格は次のとおりです。
- 2026年12月31日まで:入力 100万トークンあたり 0.75ドル、出力 3.75ドル
- 2027年1月1日から:入力 1.50ドル、出力 7.50ドル
出力にはthinking(内部推論)トークンも含まれます。ここを見落とすと、「回答は短いのに請求が大きい」と感じやすいです。
日本語公式ブログの注釈では、この初回特別価格はGemini 3.6 Flashにも適用されると明記されています。GoogleのGemini API料金ページでも、3.6 Flashと3.7 Flashは同じ導入単価・同じ標準単価です。TokenCostなどの解説が指摘しているとおり、「3.7はいまの3.6より安い」ではなく、「8月13日より前のFlash主力帯(入力1.50 / 出力7.50)と比べて半額」が正確です。
実務で使うと、次の3点が効きます。
- 3.6から3.7へ移しても、トークン単価そのものは当面同じ。
- 単価が同じなら、比較軸はリトライ回数とthinkingの量になる。
- 年末までの約4か月は、標準価格の半分で本番寄りのエージェントを試せる期間。
Batch APIを使うと、導入期間中の入力は0.375ドル、出力は1.875ドルです。夜間バッチの要約や一括分類なら、リアルタイムよりさらに半分です。コンテキストキャッシュは入力の10分の1(導入期間中は100万トークンあたり0.075ドル)で、同じ社内マニュアルを何度も渡す用途では効きます。
為替は日々動くので円換算の固定値は書きません。試算するときは、料金ページのドル単価をそのままスプレッドシートに置き、月末のレートで円に直す方が安全です。
性能はどこが上がったのか
以下は、いずれも3.6 Flash対比です。
- FrontierCode 1.1 Main:34.4% → 43.6%
- DeepSWE v1.1:49.0% → 65.3%
- WebDev Arena(Arena.ai)Elo:1538 → 1588
- GDP.pdf(複雑な文書処理):22.0% → 34.0%
- AutomationBench(実務ワークフロー完了):17.0% → 30.4%
コーディングの初回精度と、PDF・業務フローの完了率が同時に上がっているのが、今回のFlashの性格です。WebDev ArenaのElo差は50ポイントで、派手な世代交代というより「同じ系統が一段使いやすくなった」イメージに近いです。
OfficeChaiなどの英語圏レビューでは、Artificial Analysisの総合指数ではGPT-5.6 TerraやMuse Spark 1.2がまだ上、という整理も出ています。Flashは最上位モデルではなく、速度と単価でエージェントを回す層です。比較するならClaude Sonnet帯や他社の高速モデルであり、Pro級の一発勝負ではありません。
thinkingレベルはlow / medium(既定) / highです。ITmediaの報道でも、lowは遅延を抑えたいとき、highは推論を厚くするとき、と整理されています。highにすると出力トークン(thinking込み)が増え、単価以上に請求が伸びます。日常のメール下書きや議事録整形はmediumかlow、仕様の穴探しや長いPDFの突合せだけhigh、が現実的です。
日常業務での使い分け:チャット、API、Spark
GeminiアプリとSparkで使う人
Pro / Ultraなら、Sparkが3.7 Flash側に寄ります。公式が挙げる例は、ファイルの取りまとめ、メール下書き、ステータス文書の更新、Workspaceアプリのツール利用です。日本のProユーザー向けにSparkが広がったあとの延長線上で、裏側のモデルが入れ替わった、と捉えるとわかりやすいです。
向きやすい作業は次のようなものです。
- 会議メモを「決定事項 / 未決 / 次のアクション」に分ける
- Drive上の関連資料を束ねて、上司向けの短い進捗に落とす
- 既存のデザインやスクリーンショットを渡して、ランディングページのたたきを出す
- 年次レポートや契約PDFを、章立てつきの要約にする(GDP.pdfが上がっている領域)
向かないのは、社外秘を無料枠のまま投げ続けることと、thinkingをhighにしたまま雑なプロンプトを量産することです。無料枠は製品改善に使われる前提、有料枠は使われない、というのが料金ページの区分です。仕事の本文は有料側に置く方が安全です。
APIとAI Studioで組む人
モデル名を gemini-3.7-flash に切り替え、同じプロンプトで3.6と比較するのが最初の一歩です。単価が同じなので、見るべきは次の指標です。
- 一発で通る割合(修正プロンプトの回数)
- ツール呼び出しの無駄打ち
- thinkingトークンの比率
- バッチに落とせる仕事か、対話が必要か
公式も「途中の障害への適応」「意図の確認」「指示追従」「多段の計画とツール呼び出し」を改善点に挙げています。エージェントでリトライしていた処理ほど、3.7の方が総トークンが減る可能性があります。逆に、単純な分類や短い翻訳なら3.5 Flash-Liteや3.1 Flash-Liteの方が安いので、全部3.7に寄せない方が請求は安定します。
Antigravityはエージェント前提の開発面です。個人のブログ運営や小さなSaaSなら、AI Studioで十分試せます。本番のレート制限とキャッシュが必要になったタイミングで有料プロジェクトへ移せばよいです。
小規模チームが年末までにやること
導入価格はカレンダー付きです。2027年1月1日に入力も出力もちょうど2倍になります。年末までにやっておくと効くのは次です。
- 主力フローを3.7で固定し、失敗ケースを記録する
- thinkingをhighにしたジョブだけ、トークン内訳を見る
- バッチ化できる夜間処理を洗い出す
- キャッシュ可能な固定コンテキスト(社内FAQ、トーンガイド)を切り出す
- 1月以降の予算を「いまの2倍」で一度試算する
半額のうちに使い倒す、というより、半額のうちに計測しておく、が正しい使い方です。単価が戻ったあとでも、リトライが減って総コストが下がるなら乗り換えは成立します。逆に、thinkingばかり増えて請求だけ膨らむなら、3.6やLiteに戻す判断材料になります。
仕事の現場で気をつけたい4つの落とし穴
第一に、出力単価は入力の5倍です(0.75対3.75)。長い回答、冗長なコード、high thinkingは、入力を節約しても効きません。プロンプトは短くせず、出力形式を先に縛る方が安いです。「箇条書き5行」「差分だけ」「JSONのみ」と書くだけで請求は安定します。
第二に、Google Search接地は別課金です。Gemini 3.xで月5,000回まで無料、その後は1,000リクエストあたり14ドル、と料金ページにあります。調べ物エージェントを無制限に回すと、モデル代より検索代が先に来ます。
第三に、提供地域です。日本語の二次解説では、EEA・英国・スイス・ナイジェリアが対象外と案内されているものがあります。日本からの利用は公式の日本語ブログでも前提になっていますが、海外拠点があるチームは料金ページとリージョン設定を毎回確認してください。数値は変わり得ます。
第四に、「半額」のスクリーンショットを社内Slackに貼るだけでは足りません。3.6も同じ導入価格です。経営層向けには「Flash帯の標準価格が一時的に半額で、3.7はその半額期間に乗ってきた新モデル」と説明した方が誤解が残りません。
まとめ:乗り換えは単価ではなく、やり直しの回数で決める
Gemini 3.7 Flashは、2026年8月13日に出たFlash系列の最新主力です。導入価格は入力0.75ドル / 出力3.75ドル(100万トークンあたり)で、2026年12月31日まで。2027年1月1日からその2倍。同じ数字は3.6 Flashにも載っています。
公式ベンチマークでは、コード、Web UI、PDF、業務自動化の完了率がいずれも3.6を上回ります。Spark経由ならチャットユーザーにも届き、APIなら gemini-3.7-flash で差し替えできます。
やることはシンプルです。同じ仕事を3.6と3.7で10本ずつ流し、失敗とthinking量をメモする。バッチとキャッシュが使える仕事は先に切り出す。1月の2倍単価でも回るかだけ、先に計算しておく。半額の見出しより、その3つを年末までに終わらせたチームが得をします。
料金と仕様は更新されます。実装前に公式の料金ページと発表ブログを開いて、日付付きの数字を確認してください。
出典
- Google公式(英語):Gemini 3.7 Flash: our most intelligent workhorse model
- Google公式(日本語):Gemini 3.7 Flash を発表
- Gemini API料金:Gemini Developer API pricing
- ITmedia AI+:Google、「Gemini 3.7 Flash」公開 年内は半額の導入価格
- ITmedia PC USER(Infoseek転載):Googleがコーディング性能が向上した新AIモデル「Gemini 3.7 Flash」を公開
- TokenCost:Gemini 3.7 Flash Pricing: $0.75/$3.75 Until Dec 31
- OfficeChai:Google Releases Gemini 3.7 Flash, Competes With GPT 5.6 Terra & Muse Spark 1.2 On Benchmarks



コメント