
Gemini 3.7 Flash が公開:半額、100万コンテキスト、そして実際に確認された内容
- grokNEWSpaceXAI: Grok 4.62026-08-1261知能77コーディング
- metaNEWMeta: Muse Spark 1.22026-08-0557知能72コーディング
- qwenNEWQwen: Qwen3.8 Max2026-08-0358知能72コーディング
- deepseekNEWDeepSeek: DeepSeek V4 Flash 07312026-07-3152知能69コーディング
- minimaxNEWMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり · 2190 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2152知能69コーディング
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137知能49コーディング
- metaMeta: Muse Spark 1.12026-07-1653知能71コーディング
- kimiMoonshotAI: Kimi K32026-07-1560知能76コーディング
- openaiOpenAI: GPT-5.6 Luna2026-07-0952知能71コーディング
- openaiOpenAI: GPT-5.6 Terra2026-07-0957知能77コーディング
- openaiOpenAI: GPT-5.6 Sol2026-07-0961知能77コーディング
- grokxAI: Grok 4.52026-07-0856知能72コーディング
- tencentTencent: Hy32026-07-0642知能59コーディング
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232知能42コーディング
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226知能39コーディング
- anthropicAnthropic: Claude Sonnet 52026-06-3055知能72コーディング
Gemini 3.7 Flash が公開されました。Google は2026年8月13日に、Flash ティアの次期モデルをリリースしました。これは Gemini 3.6 Flash のわずか3週間後です。そして、入力トークン100万あたり0.75ドル、出力トークン100万あたり3.75ドルという価格を発表しました。これは Gemini 3.6 Flash の1.50ドル/7.50ドルのちょうど半額です。このブログが1週間前に追跡したリーク情報は、重要点すべてにおいて正確であることが判明しました。モデルは実在し、「3.7」という名称は公式モデルIDにそのまま採用され、噂されていた半額価格が正式発表価格だったのです。
Gemini 3.7 Flashは、Googleのモデルカードが最新かつ最も高性能なFlashモデルとして説明するマルチモーダルモデルであり、複雑なコーディング、エージェント型ワークフロー、信頼性の高いマルチステップ実行のために構築されています。Googleの発表時の枠組みでは、コーディング、ナレッジワーク、ウェブ開発における向上が前面に打ち出されています(以下で検証するベンダー主張)。一方、スペックはすでに公表済みです。Flashティアで標準化されているのと同じ100万トークンのコンテキストウィンドウ、64Kトークンの出力、そしてGemini API(Google AI Studioを含む)、Google Antigravity、Gemini Enterprise、AI ProおよびUltraサブスクライバー向けのGemini Sparkを通じての利用が可能です。このモデルが何であるか、コストがいくらか、どこで動作するかは、今や確定事項です。未解決の問いは、それが実際に何をもたらすかということです。
リーク報道から得た規律の1つがそのまま発売記事に引き継がれています。Googleの性能主張は、独立した測定で確認されるまではベンダー報告にすぎません。最初の独立した数値は1日以内に得られました。Artificial Analysisは、Gemini 3.7 Flashの高推論でのIntelligence Indexを56点と評価しています。これは、Gemini 3.6 Flashが発売時に記録した52点より4点高く、AAによると、知能と速度のパレートフロンティア上にあります。コーディング、ナレッジワーク、ウェブ開発に関するGoogle自身のベンチマーク数値は、依然としてベンダーの言い分のままです。価格、コンテキストウィンドウ、利用可能性は事実として扱ってください。性能の差分は、検証中の約束として扱ってください。
リークからローンチへ:裏付けの取れたシグナル
このモデルは当初、未確認のリークとしてここで追跡されていたため、そのリークがどのように推移したかを記録する価値がある――それは、噂と、Flashティアが今や繰り返し実証しているパターンとの違いである。
• 8月7日の@chetasluaによるXの投稿では、Gemini 3.7 Flashの下準備は「彼らの側では整っている」と述べられており、日付はなかった。その6日後、モデルがリリースされた。「なるべく早く」という読みは正しかった。
• 8月7日〜8日のGitHub上のGoogle自身のPython GenAI SDK内にあるgemini-3.7-flashへの参照は、実在するモデルIDを指していた——現在Gemini APIに存在するのと同じIDである。
8月13日、Gemini 3.7 FlashがGemini Enterpriseに非表示状態でステージングされ、同日リリースの可能性があるという報道があったが、この報道は日付に関して正確であり、噂されていた$0.75/$3.75という価格も正確だった。
それらのどれも、リーク報道を冗長にするものではない——同じシグナルが「延期」や「改名」という結果に落ち着くこともあり得たのだ。しかし、これほど速く、これほど静かに、そしてこれほど安価にリリースされるティアがあるからこそ、Googleが最も興味深い仕事をFlashで続けている理由なのだ。
確認済みのことと、まだ主張にすぎないこと
モデルが公開された今、リーク記事の台帳は反転する。「報じられていた」内容の大半は確認済みの欄に移り、残る不確実性は性能に関するものであり、存在に関するものではない。
• 確認済み — Google は Gemini 3.7 Flash のモデルカードを公開しました。モデルは Gemini API、Google AI Studio、Google Antigravity、Gemini Enterprise、Gemini Spark で利用可能です。発表された価格は、2026年12月31日まで100万トークンあたり$0.75/$3.75です。コンテキストウィンドウは1Mトークン、出力は64Kトークンです。
• 独立に測定された — Artificial Analysisは、Gemini 3.7 Flashをリリースから1日以内にIntelligence Indexに掲載した:高推論で56(中推論53、低推論51)。これは、Gemini 3.6 Flashがリリース時に記録した52より4ポイント高く、その向上はAAが主にエージェンティックな評価によるものとしている。
• ベンダー報告 — Google自身の主要ユースケースにおける評価数値:FrontierCode 1.1で43.6%(34.4%から上昇)、DeepSWE v1.1で65.3%、ウェブ開発アリーナでElo 1588(Googleは1位としている)、GDP.pdfで34.0%、AutomationBenchで30.4%。これらは外部機関が再現するまでのGoogleの数値である。
• まだ不明な点 — Googleが2026年12月31日を過ぎても導入割引レートを延長するかどうか(2027年1月1日には$1.50/$7.50に倍増)、その成果がGemini 3.5 Proを未発表のままにしてきた計算を変えるかどうか、そしてベンダーが宣伝しなかったワークロードでモデルがどのように機能するか。
「Gemini 3.6 Flash に対する改善」という主張の背景として、これは Google が評価される際の基準となる独立したベースラインです。

「Gemini 3.7 Flash」が打ち破らなければならない数字は、「Gemini 3.6 Flash」の独立測定によるArtificial Analysis Intelligence Indexの52(発表時点で185モデル中26位)と、$1.50/1Mのインプット価格だ。そして3.7の価格帯は、性能比較が始まる前からすでに3.6のインプット価格を半額で下回っている。
なぜ価格が見出しになるのか
「半額」が今回のローンチで最も重要な部分であり、計算は単純だ。1Mトークン入力/1Mトークン出力のワークロードでは、Gemini 3.6 Flashは$1.50+$7.50で$9.00となる。発表された料金でのGemini 3.7 Flashは$0.75+$3.75で$4.50——同じボリュームで50%の削減であり、Googleが主張する効率性の改善が実現すれば、タスク完了あたりの実効コストはさらに下がる。
書き留めておくべき注意点が2つあります。第一に、$0.75/$3.75という料金は導入期間限定です。Googleは、この料金が2026年12月31日まで適用され、2027年1月1日から$1.50/$7.50に倍増することを確認しています。第二に、一部のプラットフォームでは現在、発表された料金を下回るプロモーション価格を実施しています。そのため、実際に支払う金額については、通話時点のライブ価格を確認してください。発表された料金は確実な下限ですが、それは有効期限付きの下限です。
Gemini 3.5 Pro の背景は依然として重要だ
Googleの旗艦モデルGemini 3.5 Proは、2026年8月14日時点でもまだ出荷されていない。I/Oから数ヶ月が経過してもなおだ。ブルームバーグは7月中旬に、コーディング能力をめぐってスケジュールが遅れていると報じ、その後も社内の期限がずれ込んでいるとの報道があった。Flash層は提供され続けている一方で、Pro層は停滞している。だからこそ、半額でより高速なFlashは、通常のポイントリリースよりも大きな出来事なのだ。それは、Googleの主力ラインこそが同社が実際に競争している場所であることの証明だからである。
Qwen 3.7 Flashと混同しないでください
「3.7 Flash」の両モデルは、出荷モデルとして現在存在しており、両者はこれ以上ないほど異なっています。
• Gemini 3.7 Flash — Googleの新しいFlashグレードのモデル。100万トークンあたり$0.75/$3.75、1Mコンテキスト、マルチモーダル対応、2026年8月13日発表。
• Qwen 3.7 Flash — 2026年7月下旬にひっそりとリリースされたAlibabaの視覚言語モデル。100万トークンのコンテキストウィンドウを持ち、100万トークンあたり約0.03ドル/0.13ドルで利用でき、マルチモーダルエージェントやコンピューター操作タスクを対象としている。
価格差だけでも——入力トークンで約25倍——両者は区別される。ベンダーもまた同様だ。誰かが「3.7 Flashを実行している」と言ったとき、最初の質問は依然としてどちらかだ。
Gemini 3.6 Flash から移行すべきでしょうか?
正直な答えは二つに分かれます。コスト面では、発表された半額は確かなてこです。Gemini 3.6 Flashでまとまった量を利用しているなら、同じワークロードをGemini 3.7 Flashで実行すれば、うたわれる効率向上を差し引く前の時点で、トークン費用は半分になります。これは、自社の呼び出しパターンに当てはめて試算する価値のある切り替えです。信頼性の面では、発表から1日以内に状況は改善しました。独立系のArtificial Analysis Indexはすでに56で、3.6 Flashの52を上回っています。ただし、Googleが売り込んでいるコーディング、ナレッジワーク、Web開発における具体的な差分は依然としてベンダー報告によるものであり、Gemini 3.6 Flashは安定した文書化されたデフォルトであり続けます。定石は、実績のあるモデルをデフォルトに据え、新しいモデルにトラフィックの一部を振り向け、自社のタスクで品質を比較することです。
どちらの移行も、ルーティングレイヤー上であればプロジェクトは必要ありません。Gemini 3.6 Flash と Gemini 3.5 Flash はどちらも、本日より OrcaRouter 上の単一の OpenAI 互換エンドポイントを通じて、プロバイダー価格表のままマークアップなしで利用できます。そのため、ティア内のどこかで Google が値下げすれば、同じ日に当社側にも反映されます。また、後日ある Flash モデルから別の Flash モデルへ切り替える場合も、統合ではなくモデル名の変更で済みます。自動フェイルオーバーは、出荷されたばかりのモデルを、どのような提供形態であっても評価するためのパターンです。実際のトラフィックの一部をそのモデルに向け、エラー、レート制限、明らかな品質低下が発生した場合はルーターが実績のあるモデルにフォールバックし、新しいモデルがトラフィックを獲得するまで旧モデルをセーフティネットとして維持します。ルーティング DSL とモデルフュージョンを使用すると、新しいモデルを他のモデルと単一の呼び出しで構成できるため、自社のワークロードに対するテストは設定変更だけで済みます。
次に見るもの
• 次の独立した検証 — Artificial AnalysisはすでにIntelligence Index(高推論で56)を公表しているため、未解決の疑問は「その向上は本物か」から、Googleのコーディングおよびウェブ開発ベンチマークの主張が外部での再現に耐え、自分のワークロードでも通用するかどうか、へと移っている。
{{1}}価格——0.75ドル/3.75ドルの料金は、今や期限付きの事実となった:{{/1}}{{2}}2026年12月31日まで有効で、その後は2倍になる。Googleがそれを延長するかどうか、そしてサードパーティのプロモーション価格がそれに合わせて正常化されるかどうかを注視すべきだ。{{/2}}
• Gemini 3.5 Pro — Googleのフラッグシップがついにリリースされるなら、ここ1か月の「FlashこそGoogleが本領を発揮する場所」という捉え方は変わるかもしれない。
よくある質問
Gemini 3.7 Flash はリリースされましたか?
はい — 2026年8月13日です。GoogleはGemini 3.7 Flashのモデルカードを公開し、これを最新かつ最も高性能なFlashモデルと説明しています。gemini-3.7-flashというIDはGemini API経由で提供され、Google AI Studio、Google Antigravity、Gemini Enterprise、Gemini Sparkにも掲載されています。これは、8月7日にリークとして当サイトで報じられた準備中のモデルです。
Gemini 3.7 Flashの料金はいくらですか?
発表された導入価格は、入力トークン100万個あたり0.75ドル、出力トークン100万個あたり3.75ドルで、Googleの発表によると、Gemini 3.6 Flashの1.50ドル/7.50ドルの半分です。この料金は2026年12月31日まで確定しており、2027年1月1日には1.50ドル/7.50ドルに倍増します。一部のプラットフォームでは現在、発表された料金より低いプロモーション価格を実施しているため、実際に支払うのは呼び出し時点のライブレートです。
Gemini 3.6 Flash から Gemini 3.7 Flash にアップグレードすべきでしょうか?
価格は半分で、最初の独立したスコアも出ています — 高い推論でArtificial Analysis Index 56、3.6 Flashの52から上昇 — しかし、Googleの主要なコーディング、知識業務、Web開発の改善幅は依然としてベンダー報告によるものです。標準的な運用として、Gemini 3.6 Flashをデフォルトに維持し、フェイルオーバーを備えた自社ワークロードでGemini 3.7 Flashを評価し、トラフィックを獲得するようになったら切り替えてください。
「Gemini 3.7 Flash は、Flash ティアがやるべきことをまさに実行している。高速かつ低コストでのリリース、そして今回は前モデルを上回る独立スコアを携えて登場した。リークは名前・日付・価格については正確だったが、性能の主張は依然として検証中だ。タスクあたりのコストを重視するなら、半額になった Gemini 3.7 Flash は今日ベンチマークする価値がある。安定性を優先するなら、Gemini 3.6 Flash は引き続き実証済みの選択肢だ。移行が後になっても、それはプロジェクトではなくモデル名の変更に過ぎない。」
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
