Gemini 3.6 Flash

google/gemini-3.6-flash
精选
视觉音频工具JSON推理
来自 Google · 2026-07-21

Gemini 3.6 Flash 是谷歌在 Gemini 3 系列中最新推出的快速、经济高效的模型——一款原生多模态模型,能够读取文本、图像、视频、音频和文件,并以文本形式响应,拥有 100 万个 token 的上下文窗口,最多可支持 64K 输出 token。它专为需要以 Flash 级别的速度和价格获得接近前沿质量的团队而设计,是编码代理、文档与媒体理解、检索增强生成以及高吞吐量自动化任务中的强力默认选择。 与之前的 3.5 Flash 相比,它在 token 效率上显著提升,输出更加简洁——在达到相同或更高质量的同时,减少了输出 token 的数量,从而直接降低了长时间代理运行的成本和延迟。它支持可配置的推理力度(调用者可以根据每次请求在深度与速度之间进行调节)、原生工具调用和结构化输出,并且在长上下文和代理编码评估中表现出色,在其级别中包括 128K 平均多针检索的 91.8% 以及在 SWE-Bench Pro、Terminal-Bench 和 OSWorld 上的竞争力得分。 Gemini 3.6 Flash 同时支持 OpenAI 聊天补全格式和 Gemini 的原生 generateContent API,使其成为现有 Gemini 和兼容 OpenAI 集成的即插即用升级。当您希望以非前沿的价格获得前沿模型的大部分智能时,可将其作为日常主力模型使用。

上下文1.05M tokens
最大输出65.5K
输入模态text + image + video + file + audio
输出模态text
p50 首字节1.67 s
输入$1.50/ 百万 tokens
输出$7.50/ 百万 tokens
p50 首字节1.67 s7 天
p95 首字节5.38 s7 天
流量7.6Ktokens / 7 天

Google Gemini 3.6 Flash 是Google开发的大型多模态模型,通过OrcaRouter的API提供透明定价(无加价)。该模型支持文本、图像、视频、文件和音频输入,上下文窗口最高可达1,048,576个token,最大输出为65,536个token。该模型专为需要处理长文档、跨多种模态进行推理并保持成本可预测的开发者和企业设计。其Flash变体兼顾了性能与效率,适用于对延迟和预…

什么是 Google Gemini 3.6 Flash?它适用于谁?

Flash变体与其他Gemini模型有何不同?

Gemini 3.6 Flash 支持哪些输入模式?

代码示例

用任意 SDK 调用

兼容 OpenAI——沿用你现有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-3.6-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支持的参数

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

价格

输入 / 1M tokens$1.50
输出 / 1M tokens$7.50
缓存读取 / 1M$0.150
货币USD

费用计算器

每月 token 数10MM
输入占比70%%
预计每月 $33.00 · 启用提示缓存后 $28.28

基于标价的估算

Token 与费用估算器

输入 Token: 6每次请求费用: $0.003759

仅为估算——实际 Token 数取决于提供商的分词器。

性能

p50 首字节
1.67 s
输出速度
712 tok/s
p95 首字节
5.38 s
错误率
25.0%

公共基准测试

69.2
AA Coding
优于所参与对比模型中的 87%
第 16 / 共 122
50.1
AA Intelligence
优于所参与对比模型中的 82%
第 22 / 共 124
CharXiv Reasoning (no tools)
85.2
CharXiv Reasoning (with tools)
89.4
DeepSWE v1.1
49.0
GDM-MRCR v2 8-needle (128k avg)
91.8
GDM-MRCR v2 8-needle (1M pointwise)
54.0
GPQA Diamond
92.8
Humanity's Last Exam
38.3
Long-Context Recall
69.7
MLE-Bench
63.9
OSWorld-Verified
83.0
SciCode
52.7
SWE-Bench Pro (Public)
58.7
tau_banking
24.5
Terminal-bench 2.1 (Terminus-2)
78.0
terminalbench_v2_1
77.5
来源: artificialanalysis.ai, deepmind.google

对比一览

Gemini 3.6 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
输入 $/百万$1.50$2.00$4.00$0.50
输出 $/百万$7.50$12.00$18.00$3.00
上下文1.0M1.0M1.0M1.0M
质量8/1010/1010/109/10
并排对比并排对比并排对比并排对比

更多 Google 模型

常见问题

使用OrcaRouter调用Gemini 3.6 Flash的成本是多少?
价格为每100万输入代币1.50美元,每100万输出代币7.50美元。OrcaRouter按提供商费率计费,零加价。没有额外费用。
Gemini 3.6 Flash 的上下文窗口是多少?
上下文窗口为1,048,576个令牌(约100万个令牌)。最大输出为65,536个令牌。上下文包括所有输入模态(文本、图像、视频、文件、音频)。
这个模型的关键优势是什么?
Gemini 3.6 Flash 提供非常大的上下文窗口,支持五种输入模态(文本、图像、视频、文件、音频),在 GDM-MRCR v2 8-needle(平均 128k)上取得了 91.8 的强劲检索基准分数。作为 Flash 变体,它同样具有成本效益。
Gemini 3.6 Flash 与 GPT-4o 或 Claude 3.5 Sonnet 相比如何?
它具有更大的上下文窗口(1M vs 128K/200K)和更低的每token定价($1.50/$7.50 vs ~$2.50/$10 或 $3/$15)。基准分数不能直接比较,但Gemini Flash针对长上下文检索进行了优化。GPT-4o和Claude在某些任务中可能提供更高的推理准确性。
当我在使用这个模型时,OrcaRouter 会如何处理我的数据?
OrcaRouter 将您的请求转发至 Google 的推理服务器。OrcaRouter 不会使用您的数据进行训练,也不会存储超出处理和计费所必需的提示词。Google 的数据隐私政策适用。您可以在 OrcaRouter 的隐私政策中了解详情。
我能否使用OpenAI Python SDK调用Gemini 3.6 Flash?
是的。将基础URL设置为 https://api.orcarouter.ai/v1 ,模型ID设置为 "google/gemini-3.6-flash"。使用您的OrcaRouter API密钥和OpenAI Python库。示例:client = OpenAI(api_key="your_key", base_url="https://api.orcarouter.ai/v1") 然后 client.chat.completions.create(model="google/gemini-3.6-flash", messages=[...])。
该模型是否支持流式传输和函数调用?
通过OrcaRouter,是的。您可以设置stream=true并在请求中包含工具。该API将OpenAI格式转换为Google的API。请用您的使用案例进行测试,以确认完全兼容性。
GDM-MRCR v2 8-needle基准测试得分91.8的含义是什么?
它衡量模型从长上下文(平均128K tokens)中检索多个特定信息片段的准确性。91.8%的得分意味着模型在91.8%的测试检索场景中回答正确。这表明在长上下文任务中表现强劲。

嵌入此徽章

Google: Gemini 3.6 Flash$1.50/M in1666ms p50通过 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.6-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.6-flash.svg" alt="Google: Gemini 3.6 Flash 在 OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.6 Flash](https://www.orcarouter.ai/embed/google/gemini-3.6-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.6-flash)

以数据形式获取模型卡

GET /api/public/models/google/gemini-3.6-flash打开