Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
視覺音訊工具JSON推理
來自 Google · 2025-07-22

Gemini 2.5 Flash-Lite 是 Gemini 2.5 系列中的輕量級推理模型,專為超低延遲和成本效益而優化。它提供更高的吞吐量、更快的 Token 生成速度以及更好的效能...

上下文1M tokens
最大輸出65K
輸入模態text + image + file + audio + video
輸出模態text
p50 首字節1.34 s
輸入$0.10/ 百萬 tokens
輸出$0.40/ 百萬 tokens
p50 首字節1.34 s7 天
p95 首字節8.52 s7 天
流量11.3Mtokens / 7 天

Google Gemini 2.5 Flash Lite 是 Google Gemini 2.5 Flash 模型的一個更小、更快、更實惠的版本。它專為處理多種多模態輸入(包括文字、圖片、文件、音訊和影片)而設計,同時維持 1,048,576 個 token 的大上下文視窗。憑藉最高 65,536 個 token 的輸出能力,它可以在單次互動中生成長篇內容或處理廣泛的指令。該模型可透過…

什麼是 Google Gemini 2.5 Flash Lite?

誰應該使用這個模型?

它支援哪些輸入模式?

與其他 Google 模型相比如何?

程式碼範例

用任意 SDK 呼叫

相容 OpenAI——沿用你現有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支援的參數

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

價格

輸入 / 1M tokens$0.100
輸出 / 1M tokens$0.400
快取讀取 / 1M$0.010
貨幣USD

費用計算器

每月 token 數10MM
輸入占比70%%
預計每月 $1.90 · 啟用提示快取後 $1.59

基於標價的估算

Token 與費用估算器

輸入 Token: 6每次請求費用: $0.000201

僅為估算——實際 Token 數取決於供應商的分詞器。

效能

p50 首字節
1.34 s
輸出速度
541 tok/s
p95 首字節
8.52 s
錯誤率
0.44%

公開基準測試

7.4
AA Coding
優於所參與比較模型中的 1%
第 125 / 共 126
6.7
AA Intelligence
優於所參與比較模型中的 3%
第 122 / 共 128
35.3
AA Math
優於所參與比較模型中的 12%
第 71 / 共 81
AIME
50.0
AIME 2025
35.3
GPQA Diamond
47.4
Humanity's Last Exam
3.7
IFBench
31.5
LiveCodeBench
40.0
Long-Context Recall
32.0
MATH-500
92.6
MMLU-Pro
72.4
SciCode
17.7
TerminalBench Hard
2.3
τ²-Bench
19.0
來源: artificialanalysis.ai

社群熱度

本週開發者的討論

Hacker News0 次提及 · 近 7 天較上週減少 1

比較一覽

Gemini 2.5 Flash LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
輸入 $/百萬$0.10$2.00$4.00$0.50
輸出 $/百萬$0.40$12.00$18.00$3.00
上下文1.0M1.0M1.0M1.0M
品質2/1010/1010/109/10
並排比較並排比較並排比較並排比較

更多 Google 模型

常見問題

OrcaRouter 上 Gemini 2.5 Flash Lite 的每 token 成本是多少?
輸入令牌每百萬個收費0.10美元,輸出令牌每百萬個收費0.40美元。OrcaRouter按供應商價格計費,無任何加成。
上下文窗口大小是多少?
上下文窗口為 1,048,576 個 token(100 萬個 token),最大輸出為 65,536 個 token。
該模型的主要優勢是什麼?
優點包括低成本、高速、強大的數學推理能力(MATH-500 得分 92.6)、極大的上下文窗口,以及支援文字、圖片、檔案、音訊和影片的多模態功能。
它與 Gemini 2.5 Flash 相比如何?
Gemini 2.5 Flash Lite 更便宜且更快,但在複雜推理、創意寫作和程式碼生成方面,效能可能略低於完整版 Flash 模型。
使用此模型時,OrcaRouter是否會儲存或分享我的資料?
提供的資訊並未說明 OrcaRouter 的資料處理政策。一般情況下,API 提供者可能僅處理資料以滿足請求。請參閱 OrcaRouter 的隱私政策以了解詳情。
我如何透過OpenAI相容的API呼叫此模型?
使用基礎 URL https://api.orcarouter.ai/v1 與模型 ID「google/gemini-2.5-flash-lite」於您的 OpenAI 用戶端函式庫中。請在 Authorization 標頭中包含您的 OrcaRouter API 金鑰。
我可以使用多模態輸入,例如圖像和音頻嗎?
是的,該模型接受文字、圖片、檔案、音訊和影片輸入。您可以使用標準的 OpenAI 多模態格式,將它們作為使用者訊息中的內容區塊包含進來。
預期的延遲是多少?
該模型設計用於低延遲,尤其是與較大型模型相比。確切時間取決於輸入/輸出長度及伺服器負載。未提供具體的延遲數據。
支援哪些程式語言和框架?
任何支援 HTTP 請求及 OpenAI API 格式的語言(如 Python、JavaScript、Go、Java 等)都可以使用。官方的 OpenAI Python 函式庫可以無縫運作。
OrcaRouter是否提供任何快取或大量使用的折扣?
沒有提供快取或批量折扣資訊。定價按提供商的每token費率計算,不加成。企業查詢請聯繫OrcaRouter。

嵌入此徽章

Google: Gemini 2.5 Flash Lite$0.10/M in1337ms p50透過 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg" alt="Google: Gemini 2.5 Flash Lite 於 OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash Lite](https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite)

以資料形式取得模型卡

GET /api/public/models/google/gemini-2.5-flash-lite開啟