Gemini 3.5 Flash-Lite

google/gemini-3.5-flash-lite
精選
視覺音訊工具JSON推理
來自 Google · 2026-07-21

Gemini 3.5 Flash-Lite 是 Google 最具成本效益的 Gemini 模型,專為大量高頻、延遲敏感的任務而設計,此類任務中以每次呼叫成本為主要考量。儘管價格低廉,它仍原生支援多模態——可處理文字、圖片、影片、音訊及檔案並輸出文字——並具備與較大 Flash 層級相同的 100 萬 Tokens 上下文視窗及最高 64K Tokens 輸出,因此長篇文件與混合媒體輸入仍在可處理範圍內。 價格約為 3.6 Flash 的五分之一,它非常適合分類、提取、路由、摘要、輕量級代理、合成資料生成,以及任何需要執行數百萬次的管線。它仍支援可設定的推理努力、原生工具呼叫與結構化輸出,並在代理與長上下文基準測試中以輕量級模型展現超水準表現——例如在 OSWorld-Verified 上達 74.0%,在 128k 多針檢索上達 72.2%,明顯優於先前的 3.1 Flash-Lite。 它同時支援 OpenAI 聊天完成格式與 Gemini 原生的 generateContent API,因此您可以將其與較重型模型整合在同一介面中——將簡單、高流量的任務路由至 Flash-Lite,並將困難任務升級至 3.6 Flash 或 Pro 模型。

上下文1.05M tokens
最大輸出65.5K
輸入模態text + image + video + file + audio
輸出模態text
p50 首字節1.30 s
輸入$0.30/ 百萬 tokens
輸出$2.50/ 百萬 tokens
p50 首字節1.30 s7 天
p95 首字節10.00 s7 天
流量5.9Mtokens / 7 天

Google Gemini 3.5 Flash-Lite 是一款由 Google 開發的多模態語言模型,透過 OrcaRouter 的 OpenAI 相容 API 提供。它接受文字、圖像、影片、檔案及音訊輸入,適合結合多種資料類型的任務。該模型的上下文窗口為 1,048,576 個 token,並支援最多 65,536 個輸出 token。計費方式以供應商費率為準,無任何加成:每百萬輸入…

什麼是 Google Gemini 3.5 Flash-Lite?

這個模型是為誰設計的?

此模型支援哪些模態?

上下文窗口和最大輸出的大小是多少?

程式碼範例

用任意 SDK 呼叫

相容 OpenAI——沿用你現有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-3.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支援的參數

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

價格

輸入 / 1M tokens$0.300
輸出 / 1M tokens$2.50
快取讀取 / 1M$0.030
貨幣USD

費用計算器

每月 token 數10MM
輸入占比70%%
預計每月 $9.60 · 啟用提示快取後 $8.66

基於標價的估算

Token 與費用估算器

輸入 Token: 6每次請求費用: $0.001252

僅為估算——實際 Token 數取決於供應商的分詞器。

效能

p50 首字節
1.30 s
輸出速度
829 tok/s
p95 首字節
10.00 s
錯誤率
5.0%

公開基準測試

49.3
AA Coding
優於所參與比較模型中的 60%
第 49 / 共 122
36.5
AA Intelligence
優於所參與比較模型中的 54%
第 57 / 共 124
CharXiv Reasoning (no tools)
74.5
CharXiv Reasoning (with tools)
76.5
GDM-MRCR v2 8-needle (128k avg)
72.2
GDM-MRCR v2 8-needle (1M pointwise)
21.3
GPQA Diamond
83.8
Humanity's Last Exam
17.5
Long-Context Recall
62.0
MLE-Bench
39.2
OSWorld-Verified
74.0
SciCode
40.9
SWE-Bench Pro (Public)
54.2
tau_banking
16.5
Terminal-bench 2.1 (Terminus-2)
54.0
terminalbench_v2_1
53.6
來源: artificialanalysis.ai, deepmind.google

比較一覽

Gemini 3.5 Flash-LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
輸入 $/百萬$0.30$2.00$4.00$0.50
輸出 $/百萬$2.50$12.00$18.00$3.00
上下文1.0M1.0M1.0M1.0M
品質6/1010/1010/109/10
並排比較並排比較並排比較並排比較

更多 Google 模型

常見問題

在 OrcaRouter 上,Gemini 3.5 Flash-Lite 每 token 的價格是多少?
價格為每百萬輸入代幣0.30美元,每百萬輸出代幣2.50美元。這些是供應商費率,無任何加價。輸入代幣包含所有模態(文字、圖片、影片、音訊、檔案)。輸出代幣為生成的文字。
上下文窗口大小是多少?
上下文視窗為 1,048,576 個 token(約 100 萬個)。最大輸出長度為 65,536 個 token。這使得可以在單一 API 請求中處理非常長的文件、影片或音訊記錄。
這個模型的主要優勢是什麼?
其主要的優勢在於:極低的每 token 成本、支援五種輸入模態(文字、圖片、影片、音頻、檔案)、龐大的 100 萬上下文窗口,以及工具使用能力(CharXiv 推理評分 76.5,搭配工具)。它專為高吞吐量、成本敏感的生產管道設計。
與更大的模型(如 Gemini 3.5 Pro)相比,表現如何?
沒有提供直接的基準比較。作為一個 flash‑lite 變體,此模型優先考慮效率和低成本而非原始性能。較大的模型如 Gemini 3.5 Pro 在複雜推理任務上可能達到更高的準確度,但每個 token 的成本顯著更高。在成本和吞吐量至關重要時使用此模型。
模型是否會快取提示以降低成本?
所提供的資訊並未提及任何快取機制或折扣快取令牌計價。您應假設所有令牌皆按標準輸入費率計費。若快取功能至關重要,請向OrcaRouter或Google查詢是否有任何可用的折扣。
如何通過兼容OpenAI的API訪問此模型?
使用 OrcaRouter 的 API,基礎 URL 為 https://api.orcarouter.ai/v1。將模型參數設為 "google/gemini-3.5-flash-lite"。此 API 與 OpenAI 聊天補全格式完全相容,包括多模態內容和工具定義。
我能預期怎樣的資料處理和隱私保護?
數據處理受Google的政策(服務提供者)和OrcaRouter的條款規範。模型會處理您的輸入,並將輸出返回給您。此模型未提供特定的隱私認證。對於敏感資料,請查閱服務提供者的資料處理協議。
我能將這個模型用於即時應用嗎?
延遲細節未指定。對於短輸入,模型可在數秒內返回回應,但處理極長提示(接近100萬個Token)可能需要數十秒。此模型適用於輸入規模適中的近乎即時應用。若需嚴格的即時性要求,請使用預期的輸入長度進行測試。
CharXiv Reasoning 基準分數是多少?
該模型在CharXiv Reasoning with tools上取得了76.5分。該基準測試評估圖表理解與推理能力。此分數顯示中等表現;模型能夠解讀圖表並回答問題,但尚未達到專門推理模型的水準。未提供其他基準測試分數。
使用 OrcaRouter 是否有最低費用或最低承諾?
OrcaRouter 不設最低每月消費金額。您僅需按所使用的 Token 支付費用,費率即為零加價的提供商價格。無需預付費用,也無長期合約。只需註冊獲取 API 金鑰,即可開始發送請求。

嵌入此徽章

Google: Gemini 3.5 Flash-Lite$0.30/M in1298ms p50透過 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.5-flash-lite.svg" alt="Google: Gemini 3.5 Flash-Lite 於 OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.5 Flash-Lite](https://www.orcarouter.ai/embed/google/gemini-3.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-3.5-flash-lite)

以資料形式取得模型卡

GET /api/public/models/google/gemini-3.5-flash-lite開啟