Gemini 3.8 Flash

google/gemini-3.8-flash
精选
视觉音频工具JSON推理
来自 Google · 2026-09-02

Gemini 3.8 Flash 是谷歌最智能的 Flash 模型,在软件工程、智能体任务和多步推理方面相较于 3.7 Flash 均有显著提升。

上下文1M tokens
最大输出65K
输入模态text + image + video + file + audio
输出模态text
p50 首字节4.53 s
输入$0.75/ 百万 tokens
输出$3.75/ 百万 tokens
p50 首字节4.53 s7 天
p95 首字节10.00 s7 天
流量105.8Mtokens / 7 天

Gemini 3.8 Flash 面向需要具备广泛多模态输入、长上下文窗口、大输出限制以及 OpenAI 兼容 API 的 Google 模型的团队。它适用于长文件分析、转录或视频审查、文档提取,以及在标称输入限制内进行多轮内容生成等应用。由于输出限制为 65,536 个 token,它还能在不拆分答案的情况下生成长篇报告或结构化结果。已经使用 OpenAI 兼容客户端的开发者可以将它们指向…

谁应该使用 Gemini 3.8 Flash?

支持哪些输入和输出?

代码示例

用任意 SDK 调用

兼容 OpenAI——沿用你现有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支持的参数

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

价格

输入 / 1M tokens$0.750
输出 / 1M tokens$3.75
缓存读取 / 1M$0.075
货币USD

费用计算器

每月 token 数10MM
输入占比70%%
预计每月 $16.50 · 启用提示缓存后 $14.14

基于标价的估算

Token 与费用估算器

输入 Token: 6每次请求费用: $0.001879

仅为估算——实际 Token 数取决于提供商的分词器。

性能

p50 首字节
4.53 s
输出速度
282 tok/s
p95 首字节
10.00 s
错误率
0.54%

公共基准测试

76.3
AA Coding
优于所参与对比模型中的 95%
第 7 / 共 137
58.7
AA Intelligence
优于所参与对比模型中的 92%
第 11 / 共 139
GPQA Diamond
95.3
HLE-Verified
54.9
Humanity's Last Exam
47.8
Long-Context Recall
81.0
SciCode
53.6
tau_banking
44.9
terminalbench_v2_1
87.6
来源: artificialanalysis.ai, deepmind.google

社区热度

本周开发者的讨论

Hacker News13 次提及 · 近 7 天较上周增加 13

对比一览

Gemini 3.8 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
输入 $/百万$0.75$2.00$4.00$0.50
输出 $/百万$3.75$12.00$18.00$3.00
上下文1.0M1.0M1.0M1.0M
质量9/1010/1010/109/10
并排对比并排对比并排对比并排对比

更多 Google 模型

常见问题

通过OrcaRouter使用Gemini 3.8 Flash的费用是多少?
OrcaRouter 以提供商费率计费 Gemini 3.8 Flash,零加价:每 1M 输入 token 0.75 美元,每 1M 输出 token 3.75 美元。价目表中未列出会话费或平台费。由于输出价格是输入价格的五倍,长内容生成的成本将按比例高于长提示词。
上下文窗口和最大输出大小是什么?
Gemini 3.8 Flash 的上下文窗口为 1,048,576 个 token,最大输出为 65,536 个 token。该上下文窗口适用于文本、图像、视频、文件和音频输入。提供商在此列表中未单独给出每种媒体的 token 计算公式。
Gemini 3.8 Flash的主要优势是什么?
其列出的优势包括 1,048,576 token 的上下文长度、65,536 token 的最大输出、广泛的多模态输入支持,以及在 HLE-Verified 上 54.9 的得分。这些特性适合通过兼容 OpenAI 的 API 进行专家级问答、长文档处理和多模态理解。目录中未作出额外的质量声明。
Gemini 3.8 Flash 与其他模型相比如何?
目录记录不包含任何替代模型的基准分数或价格。应通过 OrcaRouter 运行相同的测试集,并测量准确性、成本和速度来进行比较。将模型 ID google/gemini-3.8-flash 与其他 ID 一起使用,并比较针对你的工作负载实际返回的字段。
哪些数据处理条款适用?
此目录页面未说明数据保留、训练或数据共享规则。如果您通过 OrcaRouter 向 Gemini 3.8 Flash 发送数据,请求内容将被处理以完成交易。有关数据处理的服务条款可在 Google 提供商条款和 OrcaRouter 条款中找到。在发送受监管或机密数据之前,请查阅这些文档。
如何使用兼容 OpenAI 的 API 调用 Gemini 3.8 Flash?
使用 OrcaRouter 基础 URL https://api.orcarouter.ai/v1,并将 model 字段设置为 google/gemini-3.8-flash。然后使用您的 OrcaRouter API 密钥发送标准的 OpenAI 风格聊天补全请求。支持 chat.completions.create 的现有客户端在更改基础 URL 和模型名称后即可正常工作。
OrcaRouter 是否会在提供商的费率上加价?
不。目录列表显示该模型按提供商费率计费,零加价。所显示的输入和输出令牌价格为每100万输入0.75美元和每100万输出3.75美元。这使得列出的每令牌成本即为提供商的直接费率。
此模型是否支持提示词缓存?
模型事实中未提及提示缓存、缓存命中定价或自动缓存行为。您不应依赖缓存的提示来降低成本。最安全的成本估算应基于按每100万输入令牌0.75美元全额计费的输入令牌计费方式。
支持哪些输入模式?
该模型支持文本、图像、视频、文件和音频输入。输出最多为 65,536 个 token,且未记录任何媒体输出模态。对于图像、视频、文件或音频提示,请测试客户端的内容格式,因为 API 媒体架构未在目录中描述。

嵌入此徽章

Google: Gemini 3.8 Flash$0.75/M in4529ms p50通过 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg" alt="Google: Gemini 3.8 Flash 在 OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.8 Flash](https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.8-flash)

以数据形式获取模型卡

GET /api/public/models/google/gemini-3.8-flash打开