
Gemini 3.7 Flash 已上线:价格减半、1M 上下文,以及哪些内容确已得到证实
- grok新SpaceXAI: Grok 4.62026-08-1261智能77代码
- meta新Meta: Muse Spark 1.22026-08-0557智能72代码
- qwen新Qwen: Qwen3.8 Max2026-08-0358智能72代码
- deepseek新DeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69代码
- minimax新MiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens · 2190 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69代码
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49代码
- metaMeta: Muse Spark 1.12026-07-1653智能71代码
- kimiMoonshotAI: Kimi K32026-07-1560智能76代码
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71代码
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77代码
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77代码
- grokxAI: Grok 4.52026-07-0856智能72代码
- tencentTencent: Hy32026-07-0642智能59代码
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42代码
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39代码
- anthropicAnthropic: Claude Sonnet 52026-06-3055智能72代码
Gemini 3.7 Flash 已上线。Google 于 2026 年 8 月 13 日发布了其 Flash 系列的下一个模型——距 Gemini 3.6 Flash 发布仅三周——并宣布其定价为每百万输入 token 0.75 美元、每百万输出 token 3.75 美元,恰好是 Gemini 3.6 Flash 定价(1.50 美元/7.50 美元)的一半。本博客一周前追踪到的泄露信号在每一个关键点上都被证明是准确的:该模型真实存在,“3.7”这一名称保留到了官方模型 ID 中,传闻中的半价也正是公布的定价。
Gemini 3.7 Flash 是一个多模态模型,Google 的模型卡将其描述为最新、功能最强大的 Flash 模型,专为复杂编码、智能体工作流和可靠的多步骤执行而构建。Google 的发布框架首先强调编码、知识工作与 Web 开发方面的进步——这些是供应商的说法,下文将予以审视——而规格已经明确:与 Flash 层级标准化的相同 100 万 token 上下文窗口、64K token 输出,并通过 Gemini API(包括 Google AI Studio)、Google Antigravity、Gemini Enterprise 以及面向 AI Pro 和 Ultra 订阅者的 Gemini Spark 提供。该模型是什么、成本多少、在哪里运行,现在都已成定局;悬而未决的问题是它实际能带来什么。
泄漏报道中的一条纪律直接延续到发布报道:Google 的性能声明在独立测量确认之前都是供应商的说法。第一个独立数字在一天之内就出现了——Artificial Analysis 将 Gemini 3.7 Flash 在高度推理下的智能指数评为 56 分,比 Gemini 3.6 Flash 发布时的 52 分高出 4 分,而且根据 AA 的说法,处于智能与速度的帕累托前沿。Google 自己在编码、知识工作和网页开发方面的基准数字仍然是供应商的一家之言。将价格、上下文窗口和可用性视为事实。将性能差异视为待验证的承诺。
从泄密到发布:经得起检验的信号
由于该模型最初是作为未经证实的泄露在此处被追踪的,因此值得记录该泄露的后续演变——这正是谣言与Flash层级现已反复展现的模式之间的区别。
• @chetaslua 在8月7日的X帖子中称,Gemini 3.7 Flash的基础工作"已在他们那边准备就绪",但未说明具体日期。六天后,该模型正式发布。"宜早不宜迟"的判断是正确的。
• 8月7日至8日,Google自己的Python GenAI SDK在GitHub上对gemini-3.7-flash的引用指向了一个真实的模型ID——正是当前Gemini API中存在的同一个ID。
• 8月13日关于 Gemini 3.7 Flash 以隐藏状态在 Gemini Enterprise 上暂存并可能同日发布的报道,日期准确,且传闻中的 $0.75/$3.75 价格也准确。
这些都不会让泄露报道变得多余——同样的信号本可能被解读为“延迟”或“更名”。但一个发布得如此之快、如此低调、如此廉价的层级,正是Google持续在Flash中做其最有趣工作的原因。
已确认的内容与仍属声称的内容
既然模型已经上线,泄密帖中的账目随之翻转:大多数被“爆料”的内容已转入“已确认”一栏,剩余的不确定性在于性能,而非存在与否。
• 已确认 — Google 发布了 Gemini 3.7 Flash 模型卡;该模型可通过 Gemini API、Google AI Studio、Google Antigravity、Gemini Enterprise 和 Gemini Spark 获取;公布价格为每百万 token $0.75/$3.75,有效期至 2026 年 12 月 31 日;上下文窗口为 1M token,输出为 64K token。
• 独立测评数据显示——Artificial Analysis 在发布当天即将Gemini 3.7 Flash纳入其智力指数评估:高推理模式下得分56(中推理53,低推理51),比Gemini 3.6 Flash发布时的52分高出4分,其中AA认为主要提升来源于智能体评测表现。
{{1}}厂商自报{{/1}}——{{2}}Google{{/2}} 针对重点用例给出自己的评估数据:在 FrontierCode 1.1 上为 43.6%(高于此前的 34.4%),在 DeepSWE v1.1 上为 65.3%,在 Web 开发竞技场上 Elo 为 1588,{{3}}Google{{/3}} 称其排名第一,在 GDP.pdf 上为 34.0%,在 AutomationBench 上为 30.4%。在外部机构复现之前,这些仍是 {{4}}Google{{/4}} 的数字。
• 尚不清楚——Google 是否会将首发价格延续到 2026 年 12 月 31 日之后(2027 年 1 月 1 日将翻倍至 $1.50/$7.50),这些提升是否会改变让 Gemini 3.5 Pro 一直未发布的决策考量,以及该模型在供应商未宣传的工作负载上表现如何。
关于“相比Gemini 3.6 Flash的提升”这一说法的背景:这就是衡量Google时所使用的独立基线:

Gemini 3.6 Flash 的独立测量的 Artificial Analysis Intelligence Index 为 52(在发布时排名第 26 位,共 185 个模型),以及其 $1.50/1M 输入价格,是 Gemini 3.7 Flash 需要超越的数字——而且 3.7 的价格点已经比 3.6 的输入价格低一半,在开始任何性能比较之前。
为什么价格是头条
半价是此次发布中最关键的部分,计算很简单。在100万token输入/100万token输出的工作负载下,Gemini 3.6 Flash费用为1.50美元加7.50美元,即9.00美元。按公布的价格,Gemini 3.7 Flash费用为0.75美元加3.75美元,即4.50美元——同等用量下削减了50%;如果Google宣称的效率提升能够兑现,每个已完成任务的等效成本还会进一步下降。
有两个值得记下的注意事项。首先,$0.75/$3.75 的费率是限时优惠:Google 已确认该费率持续到 2026 年 12 月 31 日,并于 2027 年 1 月 1 日翻倍至 $1.50/$7.50。其次,一些平台目前提供低于公布费率的促销价格,所以请在调用时查看实时价格,以确定你实际需要支付的费用——公布费率是可靠的底线,但这是一个有期限的底线。
Gemini 3.5 Pro 的背景仍然重要
Google 的旗舰产品 Gemini 3.5 Pro 截至 2026 年 8 月 14 日仍未发布——距 I/O 大会已过去数月,彭博社在 7 月中旬报道称其因编码能力问题而进度落后,后来的报道又描述了内部截止日期一再推迟的情况。Flash 系列持续推陈出新,Pro 系列却停滞不前,这正是半价、更快的 Flash 比普通小版本更新更具意义的原因:它证明了 Google 的工作主力产品线才是公司真正投入竞争的地方。
别把它和 Qwen 3.7 Flash 混淆。
两款“3.7 Flash”模型现在都已作为正式发布的模型存在,而它们之间的差异简直不能再大了。
• Gemini 3.7 Flash —— Google 的新型 Flash 层级模型,每百万 token 定价 0.75/3.75 美元,支持 100 万上下文,多模态,于 2026 年 8 月 13 日发布。
• Qwen 3.7 Flash —— 阿里巴巴的视觉语言模型,于2026年7月下旬悄然发布,定价约为每百万token 0.03美元/0.13美元,拥有100万上下文窗口,面向多模态智能体与计算机操作任务。
仅价格差距本身——输入令牌约25倍——就将它们区分开,供应商也是如此。当有人说“我在运行3.7 Flash”时,第一个问题仍然是哪一个。
你是否应该从 Gemini 3.6 Flash 迁移?
诚实的答案分为两个方面。就成本而言,公布的一半价格是一个真正的杠杆:如果你在 Gemini 3.6 Flash 上有可观的用量,同样的工作负载在 Gemini 3.7 Flash 上的 token 成本只有一半,这还没算上任何声称的效率提升。这是一个值得根据你自己的调用模式来建模的切换。就信任而言,发布一天之内情况已有改善——独立的 Artificial Analysis 指数已经达到 56,而 3.6 Flash 为 52——但 Google 所宣传的编码、知识工作和 Web 开发方面的具体改进仍然是供应商自报的,Gemini 3.6 Flash 依然是稳定、有据可查的默认选择。标准的做法是保留一个经过验证的模型作为默认,并将一部分流量路由到新模型,在自己任务上比较质量。
如果你在路由层上,这两项操作都不需要项目。Gemini 3.6 Flash 和 Gemini 3.5 Flash 目前都可以通过 OrcaRouter 上的单个 OpenAI 兼容端点获得,价格与提供商列表价一致,无加价——因此,Google 在该层级的任何降价都会在当天反映在我们这边,日后从一个 Flash 模型切换到另一个也只是模型名称的变更,而非集成工作。自动故障转移是评估刚发布模型(无论其以何种方式提供服务)的模式:将一部分真实流量指向它,让路由在出现错误、限流或明显质量回退时回退到经过验证的模型,并保留旧模型作为安全网,直到新模型赢得流量。路由 DSL 和模型融合让你可以在单次调用中将新模型与其他模型组合,因此,针对你自己的工作负载进行测试只是一次配置变更。
接下来看什么
• 下一个独立的检验——Artificial Analysis 已经发布了其 Intelligence Index(高推理模式下为 56),因此公开的问题已经从“增益是否真实”转变为:Google 在编码和 Web 开发基准测试上的主张能否经受外部复现,并在你自己的工作量上站得住脚。
• 价格——0.75美元/3.75美元的费率如今是带有明确日期的事实:该费率持续至2026年12月31日,然后翻倍。请关注Google是否会延长该费率,以及第三方促销定价是否会向其看齐。
• Gemini 3.5 Pro —— 如果 Google 的旗舰最终发布,过去一个月中“Flash 是 Google 发力之处”的说法可能会发生转变。
常见问题
Gemini 3.7 Flash 发布了吗?
是的——2026年8月13日。Google 已发布 Gemini 3.7 Flash 模型卡,将其描述为其最新、功能最强大的 Flash 模型;gemini-3.7-flash ID 通过 Gemini API 提供服务,Google 还将其列入 Google AI Studio、Google Antigravity、Gemini Enterprise 和 Gemini Spark。这正是 8 月 7 日在此被报道为泄露消息的模型。
Gemini 3.7 Flash 的费用是多少?
按公布的首发价,每百万输入 token 收费 $0.75,每百万输出 token 收费 $3.75——据 Google 公告,这是 Gemini 3.6 Flash 的 $1.50/$7.50 的一半。该费率确认持续至 2026 年 12 月 31 日,并于 2027 年 1 月 1 日翻倍至 $1.50/$7.50。部分平台目前提供的促销价格低于公布费率,因此您实际支付的是调用时的实时费率。
我应该从 Gemini 3.6 Flash 升级到 Gemini 3.7 Flash 吗?
价格减半,首个独立评分也已出炉——{{1}}高推理模式下 Artificial Analysis Index 为 56{{/1}},{{2}}高于 3.6 Flash 的 52{{/2}}——{{3}}但 Google 对外宣称的编码、知识工作和 Web 开发方面的性能提升仍是供应商自报数据{{/3}}。标准做法:继续以 Gemini 3.6 Flash 为默认,在自有工作负载上评估 Gemini 3.7 Flash 并配置故障转移,等它真正赢得流量时再切换。
Gemini 3.7 Flash is the Flash tier doing exactly what the Flash tier does — shipping fast, shipping cheaper, and this time arriving with an independent score that beats its predecessor. The leak was right about the name, the date, and the price; the performance claims are still under test. If cost-per-task is your lever, the half-price makes Gemini 3.7 Flash worth benchmarking today. If stability is your priority, Gemini 3.6 Flash remains the proven choice — and moving later is a model-name change, not a project.
本文中的对比1
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
