Gemini 3 Flash Preview

google/gemini-3-flash-preview
視覺音訊工具JSON推理
來自 Google · 2025-12-17

Gemini 3 Flash Preview 是一款高速、高價值的推理模型,專為代理工作流程、多輪對話和編碼輔助而設計。它提供接近 Pro 等級的推理與工具...

上下文1M tokens
最大輸出65K
輸入模態text + image + file + audio + video
輸出模態text
p50 首字節10.00 s
輸入$0.50/ 百萬 tokens
輸出$3.00/ 百萬 tokens
p50 首字節10.00 s7 天
p95 首字節10.00 s7 天
流量9.0Mtokens / 7 天

Google Gemini 3 Flash Preview 是由 Google 開發的多模態模型,專為高速與大上下文處理最佳化。該模型可接受文字、圖片、檔案、音訊及影片格式的輸入,並能生成多達 65,536 個 Token 的輸出。模型的上下文視窗為 1,048,576 個 Token,使其能夠對極長序列進行推理。其在 MMLU-Pro 基準測試中獲得 88.2…

什麼是 Google Gemini 3 Flash Preview?

這個模型的目標受眾是誰?

它支援哪些多模態輸入?

預覽狀態為何?以及其穩定度如何?

程式碼範例

用任意 SDK 呼叫

相容 OpenAI——沿用你現有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3-flash-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支援的參數

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

價格

輸入 / 1M tokens$0.500
輸出 / 1M tokens$3.00
快取讀取 / 1M$0.050
貨幣USD

費用計算器

每月 token 數10MM
輸入占比70%%
預計每月 $12.50 · 啟用提示快取後 $10.93

基於標價的估算

Token 與費用估算器

輸入 Token: 6每次請求費用: $0.001503

僅為估算——實際 Token 數取決於供應商的分詞器。

效能

p50 首字節
10.00 s
輸出速度
1195 tok/s
p95 首字節
10.00 s
錯誤率
0%

公開基準測試

37.8
AA Coding
優於所參與比較模型中的 37%
第 81 / 共 133
27.9
AA Intelligence
優於所參與比較模型中的 31%
第 93 / 共 135
55.7
AA Math
優於所參與比較模型中的 32%
第 56 / 共 82
AIME 2025
55.7
GPQA Diamond
81.2
Humanity's Last Exam
15.0
IFBench
55.1
LiveCodeBench
79.7
Long-Context Recall
53.0
MMLU-Pro
88.2
SciCode
49.9
TerminalBench Hard
31.8
τ²-Bench
43.3
來源: artificialanalysis.ai

社群熱度

本週開發者的討論

Hacker News0 次提及 · 近 7 天

比較一覽

Gemini 3 Flash PreviewGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3.5 Flash
輸入 $/百萬$0.50$2.00$4.00$1.50
輸出 $/百萬$3.00$12.00$18.00$9.00
上下文1.0M1.0M1.0M1.0M
品質9/1010/1010/109/10
並排比較並排比較並排比較並排比較

更多 Google 模型

常見問題

使用 Gemini 3 Flash Preview 的成本是多少?
定價為每百萬輸入令牌 0.50 美元,每百萬輸出令牌 3.00 美元,按提供商費率計費,OrcaRouter 不附加任何加價。
上下文窗口大小是多少?
上下文視窗為輸入提供1,048,576個token,模型最多可生成65,536個輸出token。
支援哪些輸入模態?
文字、圖片、檔案、音訊和影片均可作為輸入。輸出僅限文字。
它與 Gemini 2 Flash 相比如何?
Gemini 3 Flash Preview 擁有更大的上下文視窗(1M vs 最高1M但通常更小)、更高的 MMLU-Pro 分數(88.2),以及擴展的多模態支援,包含影片。它在處理複雜任務時更快、能力更強,但 Gemini 2 Flash 的每 token 成本更低。
OrcaRouter如何處理數據隱私?
OrcaRouter 會將您的請求傳送至 Google 的 API。資料處理遵循 Google 的隱私權政策。OrcaRouter 不會記錄或儲存超出處理請求所需範圍的您的內容。詳情請參閱兩個提供者的政策。
我可以使用與OpenAI相容的API來呼叫Gemini 3 Flash Preview嗎?
是的。使用OrcaRouter的API,網址為https://api.orcarouter.ai/v1,模型ID為"google/gemini-3-flash-preview"。驗證使用OrcaRouter API金鑰。請求和回應格式遵循OpenAI的Chat Completions架構。
該模型的主要優勢是什麼?
高推理速度、1M token 超大上下文、多模態輸入(文字、圖片、檔案、音訊、影片)、強大的 MMLU-Pro 基準表現(88.2),以及相對於更大模型更低的成本。
Gemini 3 Flash Preview 是否可用於生產?
這是一個預覽版本,意味著它可能會有變更、間歇性可用性或有限支援。它適用於測試和開發;對於關鍵的生產工作負載,請考慮在穩定版本可用時使用。
如何估算多模態輸入的token使用量?
每種模態都有其自己的分詞方式。圖像、音訊和影片會根據解析度和時長分割成令牌(tokens)。OrcaRouter 會在 API 回應中回報令牌使用量。您也可以查閱 Google 的文件,了解詳細的令牌計數規則。
若超出上下文視窗,模型將無法處理額外的輸入內容,導致回覆時忽略超出的部分、產生不連貫的回應,或直接出現錯誤提示。具體行為取決於模型的實作方式,部分系統會自動截斷輸入,而其他系統可能回傳錯誤訊息。
輸入超過 1,048,576 個 tokens 時,將從最舊的內容開始截斷。模型會忽略超出的 tokens。請透過監控請求中的總 tokens 數,確保您的訊息不超過限制。

嵌入此徽章

Google: Gemini 3 Flash Preview$0.50/M in10000ms p50透過 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3-flash-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3-flash-preview.svg" alt="Google: Gemini 3 Flash Preview 於 OrcaRouter" /> </a>
Markdown [![Google: Gemini 3 Flash Preview](https://www.orcarouter.ai/embed/google/gemini-3-flash-preview.svg)](https://www.orcarouter.ai/models/google/gemini-3-flash-preview)

以資料形式取得模型卡

GET /api/public/models/google/gemini-3-flash-preview開啟