Gemini 3.8 Flash

google/gemini-3.8-flash
精選
視覺音訊工具JSON推理
來自 Google · 2026-09-02

Gemini 3.8 Flash 是 Google 最智慧的 Flash 模型,在軟體工程、代理任務及多步驟推理方面,相較於 3.7 Flash 有顯著提升。

上下文1M tokens
最大輸出65K
輸入模態text + image + video + file + audio
輸出模態text
p50 首字節4.52 s
輸入$0.75/ 百萬 tokens
輸出$3.75/ 百萬 tokens
p50 首字節4.52 s7 天
p95 首字節10.00 s7 天
流量111.9Mtokens / 7 天

Gemini 3.8 Flash 旨在服務需要具備廣泛多模態輸入、長上下文視窗、大輸出限制,以及 OpenAI 相容 API 的 Google 模型的團隊。它適用於長檔分析、逐字稿或影片審閱、文件擷取,以及在廣告宣稱的輸入限制內進行多輪內容生成等應用情境。由於輸出限制為 65,536 個 tokens,它也能在無需拆分答案的情況下生成長篇報告或結構化結果。已經使用 OpenAI…

誰應該使用 Gemini 3.8 Flash?

支援哪些輸入和輸出?

程式碼範例

用任意 SDK 呼叫

相容 OpenAI——沿用你現有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支援的參數

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

價格

輸入 / 1M tokens$0.750
輸出 / 1M tokens$3.75
快取讀取 / 1M$0.075
貨幣USD

費用計算器

每月 token 數10MM
輸入占比70%%
預計每月 $16.50 · 啟用提示快取後 $14.14

基於標價的估算

Token 與費用估算器

輸入 Token: 6每次請求費用: $0.001879

僅為估算——實際 Token 數取決於供應商的分詞器。

效能

p50 首字節
4.52 s
輸出速度
280 tok/s
p95 首字節
10.00 s
錯誤率
0.52%

公開基準測試

76.3
AA Coding
優於所參與比較模型中的 95%
第 7 / 共 137
58.7
AA Intelligence
優於所參與比較模型中的 92%
第 11 / 共 139
GPQA Diamond
95.3
HLE-Verified
54.9
Humanity's Last Exam
47.8
Long-Context Recall
81.0
SciCode
53.6
tau_banking
44.9
terminalbench_v2_1
87.6
來源: artificialanalysis.ai, deepmind.google

社群熱度

本週開發者的討論

Hacker News13 次提及 · 近 7 天較上週增加 13

比較一覽

Gemini 3.8 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
輸入 $/百萬$0.75$2.00$4.00$0.50
輸出 $/百萬$3.75$12.00$18.00$3.00
上下文1.0M1.0M1.0M1.0M
品質9/1010/1010/109/10
並排比較並排比較並排比較並排比較

更多 Google 模型

常見問題

透過 OrcaRouter 使用 Gemini 3.8 Flash 的費用是多少?
OrcaRouter 以提供者費率計費 Gemini 3.8 Flash,且無任何加成:每 100 萬輸入 tokens 收費 $0.75,每 100 萬輸出 tokens 收費 $3.75。目錄中並未列出任何工作階段費用或平台費用。由於輸出價格是輸入的五倍,長篇生成內容的相對成本會高於長篇提示。
上下文視窗和最大輸出大小是什麼?
Gemini 3.8 Flash 的上下文窗口為 1,048,576 個 tokens,最大輸出為 65,536 個 tokens。此上下文窗口適用於文字、圖片、影片、檔案和音訊輸入。此清單中,提供者並未提供各媒體個別的 token 計算公式。
Gemini 3.8 Flash 的主要優勢是什麼?
其列出的優勢包括1,048,576個token的上下文、65,536個token的最大輸出、廣泛的多模態輸入,以及在HLE-Verified上54.9的得分。這些功能適合專家級問答任務、長文件處理,以及透過OpenAI相容API進行的多媒體理解。目錄中未提出其他品質聲明。
Gemini 3.8 Flash 與其他模型相比如何?
目錄記錄中不包含任何替代模型的基準測試分數或價格。比較應透過在 OrcaRouter 上執行相同的測試集來進行,並測量準確度、成本和速度。請將模型 ID google/gemini-3.8-flash 與其他 ID 並列使用,並比較針對您的工作負載實際傳回的欄位。
適用哪些資料處理條款?
此目錄頁面未說明資料保留、訓練或資料共享規則。如果您透過 OrcaRouter 傳送資料至 Gemini 3.8 Flash,請求內容將被處理以完成交易。資料處理的商業條款載明於 Google 提供者條款及 OrcaRouter 條款中。在傳送受監管或機密資料之前,請先查閱這些文件。
如何使用與 OpenAI 相容的 API 呼叫 Gemini 3.8 Flash?
使用 OrcaRouter 基礎 URL https://api.orcarouter.ai/v1,並將 model 欄位設定為 google/gemini-3.8-flash。然後使用您的 OrcaRouter API 金鑰傳送標準的 OpenAI 風格聊天完成請求。支援 chat.completions.create 的現有用戶端,在變更基礎 URL 與模型名稱後即可正常運作。
OrcaRouter 是否會對供應商費率加價?
不。目錄列表說明該模型按提供者費率計費,零加成。顯示的輸入和輸出 token 價格分別為每 1M 輸入 $0.75 和每 1M 輸出 $3.75。這使得所列出的每個 token 成本即為直接提供者費率。
此模型是否支援提示快取?
模型事實並未提及提示快取、快取命中定價或自動快取行為。您不應依賴快取的提示來降低成本。最安全的成本估算基於完整的輸入 token 計費,每 1M 輸入 token 為 $0.75。
支援哪些輸入模態?
模型接受文字、圖像、影片、檔案和音訊輸入。輸出上限為 65,536 個 token,且未記載任何媒體輸出模態。對於圖像、影片、檔案或音訊提示,請測試用戶端的內容格式,因為目錄中未描述 API 媒體結構。

嵌入此徽章

Google: Gemini 3.8 Flash$0.75/M in4522ms p50透過 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg" alt="Google: Gemini 3.8 Flash 於 OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.8 Flash](https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.8-flash)

以資料形式取得模型卡

GET /api/public/models/google/gemini-3.8-flash開啟