Gemini 2.5 Flash

google/gemini-2.5-flash
视觉音频工具JSON推理
来自 Google · 2025-06-17

Gemini 2.5 Flash 是谷歌当前最先进的主力模型,专为高级推理、编程、数学和科学任务而设计。该模型内置“思考”能力,使其能够提供更具...

上下文1.05M tokens
最大输出65.5K
输入模态file + image + text + audio + video
输出模态text
p50 首字节10.00 s
输入$0.30/ 百万 tokens
输出$2.50/ 百万 tokens
p50 首字节10.00 s7 天
p95 首字节10.00 s7 天
流量433.8Ktokens / 7 天

Google Gemini 2.5 Flash 是谷歌开发的多模态语言模型,属于 Gemini 2.5 系列,专为高效处理文本、图像、音频和视频输入而设计。该模型支持 1,048,576 个 token 的上下文窗口,可处理超长文档或多文件对话,输出长度可达 65,536 个 token。谷歌将其定位为面向生产工作负载的快速、低成本选项。OrcaRouter 通过其兼容 OpenAI 的 API…

什么是Google Gemini 2.5 Flash?

谁应该使用 Gemini 2.5 Flash?

Gemini 2.5 Flash 的关键规格是什么?

Gemini 2.5 Flash 与其他 Gemini 模型有何不同?

代码示例

用任意 SDK 调用

兼容 OpenAI——沿用你现有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支持的参数

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

价格

输入 / 1M tokens$0.300
输出 / 1M tokens$2.50
缓存读取 / 1M$0.030
货币USD

费用计算器

每月 token 数10MM
输入占比70%%
预计每月 $9.60 · 启用提示缓存后 $8.66

基于标价的估算

Token 与费用估算器

输入 Token: 6每次请求费用: $0.001252

仅为估算——实际 Token 数取决于提供商的分词器。

性能

p50 首字节
10.00 s
输出速度
1247 tok/s
p95 首字节
10.00 s
错误率
2.3%

公共基准测试

17.8
AA Coding
优于所参与对比模型中的 15%
第 105 / 共 123
14.1
AA Intelligence
优于所参与对比模型中的 14%
第 107 / 共 125
60.3
AA Math
优于所参与对比模型中的 44%
第 45 / 共 81
AIME
50.0
AIME 2025
60.3
GPQA Diamond
68.3
Humanity's Last Exam
5.1
IFBench
39.0
LiveCodeBench
49.5
Long-Context Recall
45.9
MATH-500
93.2
MMLU-Pro
80.9
SciCode
29.1
TerminalBench Hard
12.1
τ²-Bench
14.9
来源: artificialanalysis.ai

对比一览

Gemini 2.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
输入 $/百万$0.30$2.00$4.00$0.50
输出 $/百万$2.50$12.00$18.00$3.00
上下文1.0M1.0M1.0M1.0M
质量3/1010/1010/109/10
并排对比并排对比并排对比并排对比

更多 Google 模型

常见问题

Gemini 2.5 Flash 每token的价格是多少?
输入价格为每100万token 0.30美元,输出价格为每100万token 2.50美元。这些是Google的提供商费率,通过OrcaRouter零加价。
Gemini 2.5 Flash 的上下文窗口大小是多少?
上下文窗口为 1,048,576 个令牌(1M 令牌)。最大输出为 65,536 个令牌。
Gemini 2.5 Flash 的主要优势是什么?
它在MATH-500基准测试中取得了93.2分,展现了强大的数学推理能力。同时支持多种输入模态(文件、图片、文本、音频、视频),并以有竞争力的价格提供了极大的上下文窗口。
Gemini 2.5 Flash 与 Gemini 2.0 Flash 相比如何?
Gemini 2.5 Flash 更昂贵,但提供了改进的数学性能(在MATH-500上得分为93.2,对比较低的分数)。两者都拥有1M的上下文窗口。2.0 Flash 每1M tokens 成本为$0.15/$0.60,而2.5 Flash 成本为$0.30/$2.50。
OrcaRouter 是否会在模型价格上添加任何加价?
不,OrcaRouter按提供商的确切费率计费,零加价。您为每100万输入令牌支付0.30美元,每100万输出令牌支付2.50美元。
我可以通过OpenAI兼容的API使用Gemini 2.5 Flash吗?
是的。使用基础URL https://api.orcarouter.ai/v1 和模型ID "google/gemini-2.5-flash"。所有OpenAI SDK和HTTP客户端都可以使用标准的聊天完成参数。
Gemini 2.5 Flash 支持哪些输入模态?
它支持文件、图像、文本、音频和视频输入。您可以在单个请求中混合使用这些输入。
通过OrcaRouter使用Gemini 2.5 Flash时,我的数据是如何处理的?
数据处理遵循 Google 的 API 隐私政策和 OrcaRouter 的条款。除非您通过 Google Cloud 账户选择退出,否则 Google 可能会处理数据以改进模型。请查看 Google 的数据处理文档了解详情。

嵌入此徽章

Google: Gemini 2.5 Flash$0.30/M in10000ms p50通过 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash.svg" alt="Google: Gemini 2.5 Flash 在 OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash](https://www.orcarouter.ai/embed/google/gemini-2.5-flash.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash)

以数据形式获取模型卡

GET /api/public/models/google/gemini-2.5-flash打开