Googleは2026年8月13日、Gemini 3.7 Flashを発表した。Gemini 3.6 Flashの登場から約3週間後の新モデルで、公式には「最も知的なワークホースモデル」と説明されている。焦点は単なる高速応答ではなく、ソフトウェア開発、知識業務、AIエージェントだ。
今回の強化は、速度だけではない
Gemini 3.7 Flashの中心的な変化は、Flashシリーズを「素早く答えるモデル」から「仕事を継続して実行するモデル」へ押し進めることだ。Googleは、デバッグ、issue resolution、長期のソフトウェア開発、デザインからのWeb生成を改善し、エージェントの寄り道や再試行を減らすことを目指す。
モデルはlow、medium、highの3段階のthinking levelに対応し、遅延、コスト、推論の深さをタスクごとに調整できる。最大1Mトークンのコンテキストウィンドウと、最大64Kトークンの出力も備える。
価格と利用方法
Gemini 3.7 FlashのAPI model IDは gemini-3.7-flash。Google AI Studio、Gemini API、Google Antigravity、Android Studio、Gemini Enterprise Agent Platformで提供されている。公式の開発者ドキュメントではGAとされ、本番利用に対応する。
導入価格は2026年12月31日までで、入力100万トークン0.75ドル、出力100万トークン3.75ドル。2027年1月1日からは1.50ドルと7.50ドルになる。Googleは3.6 Flashにも同じ導入価格を適用すると説明している。
Googleが公開したスコア
Googleの比較では、3.7 Flashから3.6 Flashへの改善は、コーディング、長期エージェントタスク、Web開発、企業ワークフローに集中している。
- FrontierCode 1.1:43.6%(前モデル34.4%)。
- DeepSWE v1.1:65.3%(前モデル49.0%)。
- WebDev Arena:Elo 1588(前モデル1538)。AutomationBench:30.4%(前モデル17.0%)。
これらはGoogleが公開したテスト結果であり、製品の位置づけを理解する材料だ。すべてのプロジェクトやプロンプトで同じ改善幅が出ることを意味しない。実際の選定では、手戻りや人による確認を減らせるかを見るべきだ。
どんな人に効果が大きいか
コードを何度も読み、バグを直し、ツールを呼び出し、長い文書を整理し、スクリーンショットやデザインシステムに沿ってUIを作る仕事なら、3.7 Flashの方向性は明確だ。1行を補完するチャットボットではなく、複数ターンで実行する仕事のパートナーを目指している。
プロダクトチームにとっては、導入価格の低さにより「大半の手順を高速モデルに任せ、少数の難題だけを大きなモデルへ回す」ルーティングも実装しやすくなる。ただし安価でも、権限管理、テスト、人的レビューは省けない。
利用前に知っておきたい制限
Google DeepMindのmodel cardには、基盤モデルに共通する制限として、ハルシネーション、速度低下、タイムアウトの可能性が記載されている。知識カットオフは2026年3月で、一部の領域は2025年1月までの可能性があるため、最新ニュース、価格、政策は別途確認すべきだ。
3.7 Flashが「エージェント向け」であることは製品設計の方向性であり、監督なしですべての長い処理を完了できるという意味ではない。実際に注目すべきなのは、実コードベースでミスや再試行が減るか、不確実なときに止まって質問できるかだ。
発表の概要はGoogleの公式発表、詳細な仕様は Google AI for DevelopersのGemini 3.7 FlashドキュメントとGoogle DeepMindのmodel cardで確認できる。
Gemini 3.7 Flashのポイントは、Googleがまた一つバージョン番号を増やしたことではない。Flashシリーズが、毎日大量に実行されるAIワークフローの主役をより直接的に狙い始めたことだ。コーディング、エージェントのツール呼び出し、コストが重要なら実際に試す価値がある。ただし、無料のGeminiチャットでの更新を待つ人は、地域とプランを先に確認したい。

