Gemini 3.5 Flash

google/gemini-3.5-flash
視覺音訊工具JSON推理
來自 google · 2026-05-23

Google Gemini 3.5 Flash — Google 最強的 Flash 層級模型,在智慧表現上僅次於 3.1-pro-preview(AA Intel 55.3 對比 57.2),並具備 Flash 延遲水準。100 萬 Token 上下文視窗 (1,048,576),最大輸出 64K (65,536)。完整的多模態輸入:文字、圖像、音訊、視訊及檔案;僅輸出文字。AA Coding 45,GPQA Diamond 92.2%,IFBench 76.3%(頂級指令遵循),Long-Context Recall 69.3%,SciCode 53.1%,τ²-Bench 95.3%(代理工具使用),HLE 41%。支援推理(include_reasoning / reasoning)、結構化輸出、工具呼叫、response_format、seed、stop 與標準抽樣控制。端點:chat_completions、gemini_generate。最佳適用場景:大量代理循環、長文件分析,以及 Pro 層級延遲或成本過高的多模態萃取。

上下文1M tokens
最大輸出65K
輸入模態text + image + video + file + audio
輸出模態text
p50 首字節4.10 s
輸入$1.50/ 百萬 tokens
輸出$9.00/ 百萬 tokens
p50 首字節4.10 s7 天
p95 首字節10.00 s7 天
流量33.4Mtokens / 7 天

Gemini 3.5 Flash 是由 Google 開發的大型語言模型,針對速度與效率進行了微調。它屬於 Gemini 系列,設計用於處理多模態輸入——文字、圖片、影片、檔案和音訊——同時提供快速回應。該模型支援 1,048,576 個 tokens 的上下文視窗,使其能夠處理非常長的序列,例如整本書籍、長達一小時的影片或大型程式碼儲存庫。其最大輸出長度為 65,536 個…

什麼是Gemini 3.5 Flash?

誰應該使用 Gemini 3.5 Flash?

Gemini 3.5 Flash 支援哪些輸入模態?

如何使用OrcaRouter存取Gemini 3.5 Flash?

程式碼範例

用任意 SDK 呼叫

相容 OpenAI——沿用你現有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支援的參數

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

價格

輸入 / 1M tokens$1.50
輸出 / 1M tokens$9.00
快取讀取 / 1M$0.150
快取寫入 / 1M$0.083
貨幣USD

費用計算器

每月 token 數10MM
輸入占比70%%
預計每月 $37.50 · 啟用提示快取後 $32.78

基於標價的估算

Token 與費用估算器

輸入 Token: 6每次請求費用: $0.004509

僅為估算——實際 Token 數取決於供應商的分詞器。

效能

p50 首字節
4.10 s
輸出速度
362 tok/s
p95 首字節
10.00 s
錯誤率
0.08%

公開基準測試

70.1
AA Coding
優於所參與比較模型中的 84%
第 21 / 共 133
52.0
AA Intelligence
優於所參與比較模型中的 77%
第 29 / 共 135
51.0
AA Math
優於所參與比較模型中的 27%
第 60 / 共 82
GPQA Diamond
92.2
Humanity's Last Exam
42.7
IFBench
76.3
Long-Context Recall
81.0
MMLU-Pro
59.0 index
SciCode
53.1
tau_banking
32.2
TerminalBench Hard
40.9
terminalbench_v2_1
78.7
τ²-Bench
95.3
來源: artificialanalysis.ai

社群熱度

本週開發者的討論

Hacker News0 次提及 · 近 7 天

比較一覽

Gemini 3.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
輸入 $/百萬$1.50$2.00$4.00$0.50
輸出 $/百萬$9.00$12.00$18.00$3.00
上下文1.0M1.0M1.0M1.0M
品質9/1010/1010/109/10
並排比較並排比較並排比較並排比較

更多 google 模型

常見問題

Gemini 3.5 Flash 在 OrcaRouter 上的價格是多少?
輸入Token每100萬個1.50美元;輸出Token每100萬個9.00美元。OrcaRouter按供應商費率計費,零加成。無任何額外費用。
Gemini 3.5 Flash 的上下文窗口大小是多少?
它支援一個上下文視窗,大小為1,048,576個token(約100萬個token)。這包括輸入和輸出token的總和。
Gemini 3.5 Flash 的主要優勢是什麼?
此最佳化專注於低延遲、高吞吐量及成本效益。它支援多模態輸入(文字、圖片、影片、檔案、音訊)與大上下文視窗,非常適合即時應用與長文件處理。
Gemini 3.5 Flash 與 Gemini 3.5 Pro 相比如何?
Flash 更快且更便宜,但在複雜推理與數學任務上的基準測試表現較低。Pro 更精準,但速度較慢且成本更高。Flash 適合高流量、對延遲敏感的應用場景。
通過OrcaRouter使用Gemini 3.5 Flash時,數據如何被處理?
OrcaRouter 扮演代理角色,並不會儲存您的資料。然而,Google 的資料處理政策適用於底層模型。OrcaRouter 建議您查看 Google 關於資料保留與隱私的條款。
如何使用OpenAI-compatible API呼叫Gemini 3.5 Flash?
使用基礎 URL https://api.orcarouter.ai/v1,模型 ID "google/gemini-3.5-flash",並在 Authorization header 中傳遞 OrcaRouter API 金鑰。該 API 支援標準聊天完成和串流。
Gemini 3.5 Flash 可以生成多長的輸出?
它每次回應最多可生成65,536個標記。這遠大於許多模型,允許生成長篇內容、程式碼或擴展推理。
是否有針對重複或快取令牌的折扣?
根據所提供的事實,OrcaRouter 不提供快取或大量折扣。每個代碼都按標準費率計費,無論是否重複使用。

嵌入此徽章

Gemini 3.5 Flash$1.50/M in4102ms p50透過 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.5-flash.svg" alt="Gemini 3.5 Flash 於 OrcaRouter" /> </a>
Markdown [![Gemini 3.5 Flash](https://www.orcarouter.ai/embed/google/gemini-3.5-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.5-flash)

以資料形式取得模型卡

GET /api/public/models/google/gemini-3.5-flash開啟