Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
VisionLjudVerktygJSONResonemang
av Google · 2025-07-22

Gemini 2.5 Flash-Lite är en lättvikts resonemangsmodell i Gemini 2.5-familjen, optimerad för ultra-låg latens och kostnadseffektivitet. Den erbjuder förbättrad genomströmning, snabbare tokengenerering och bättre prestanda...

ctx1M tokens
Max output65K
Inmatningtext + image + file + audio + video
Utdatatext
p50 TTFT1.34 s
INMATNING$0.10/ 1M token
UTDATA$0.40/ 1M token
p50 TTFT1.34 s7d
p95 TTFT8.52 s7d
TRAFIK11.3Mtokens/7d

Google Gemini 2.5 Flash Lite är en mindre, snabbare och mer prisvärd variant av Gemini 2.5 Flash-modellen från Google. Den är utformad för att hantera ett brett spektrum av multimodala indata –…

Vad är Google Gemini 2.5 Flash Lite?

Vem bör använda den här modellen?

Vilka inmatningsmetoder stöder den?

Hur jämför den sig med andra Google-modeller?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Priser

Inmatning / 1M token$0.100
Utdata / 1M tokens$0.400
Cacheläsning / 1M$0.010
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $1.90 · Med promptcachning $1.59

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000202

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
1.34 s
Utdatahastighet
541 tok/s
p95 TTFT
8.52 s
Felfrekvens
0.44%

Offentliga benchmarks

7.4
AA Coding
Bättre än 1% av jämförda modeller
#125 av 126
6.7
AA Intelligence
Bättre än 3% av jämförda modeller
#122 av 128
35.3
AA Math
Bättre än 12% av jämförda modeller
#71 av 81
AIME
50.0
AIME 2025
35.3
GPQA Diamond
47.4
Humanity's Last Exam
3.7
IFBench
31.5
LiveCodeBench
40.0
Long-Context Recall
32.0
MATH-500
92.6
MMLU-Pro
72.4
SciCode
17.7
TerminalBench Hard
2.3
τ²-Bench
19.0
Källa: artificialanalysis.ai

Community-buzz

Vad utvecklare säger den här veckan

Hacker News0 omnämnanden · 7dner 1 jämfört med föregående vecka

Så jämför den sig

Gemini 2.5 Flash LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Input $/M$0.10$2.00$4.00$0.50
Output $/M$0.40$12.00$18.00$3.00
Kontext1.0M1.0M1.0M1.0M
Kvalitet2/1010/1010/109/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad är kostnaden per token för Gemini 2.5 Flash Lite på OrcaRouter?
Indata-tokens kostar $0,10 per 1 miljon tokens, utdata-tokens kostar $0,40 per 1 miljon tokens. OrcaRouter fakturerar till leverantörens pris utan påslag.
Vad är storleken på kontextfönstret?
Kontextfönstret är 1,048,576 tokens (1 miljon tokens), och den maximala utdatan är 65,536 tokens.
Vilka är modellens främsta styrkor?
Styrkor inkluderar låg kostnad, hög hastighet, stark matematisk resonemangsförmåga (92.6 på MATH-500), ett mycket stort kontextfönster, och multimodalt stöd för text, bilder, filer, ljud och video.
Hur jämför det sig med Gemini 2.5 Flash?
Gemini 2.5 Flash Lite är billigare och snabbare men har troligen något lägre prestanda inom komplext resonemang, kreativt skrivande och kodgenerering jämfört med den fulla Flash-modellen.
Lagrar eller delar OrcaRouter mina data när jag använder den här modellen?
De angivna fakta specificerar inte OrcaRouters datahanteringspolicy. Vanligtvis kan API-leverantörer endast behandla data för att uppfylla förfrågningar. Kontrollera OrcaRouters integritetspolicy för detaljer.
Hur anropar jag den här modellen via ett OpenAI-kompatibelt API?
Använd bas-URL https://api.orcarouter.ai/v1 med modell-ID "google/gemini-2.5-flash-lite" i ditt OpenAI-klientbibliotek. Inkludera din OrcaRouter API-nyckel i Authorization header.
Kan jag använda multimodala indata som bilder och ljud?
Ja, modellen accepterar text, bild, fil, ljud och video som indata. Du kan inkludera dem som innehållsdelar i användarmeddelandet med hjälp av standardformatet för OpenAI multimodal.
Vad är den förväntade latensen?
Modellen är utformad för låg latens, särskilt jämfört med större modeller. Exakta tider beror på inmatnings-/utmatningslängd och serverbelastning. Inga specifika latenssiffror anges.
Vilka programmeringsspråk och ramverk stöds?
Alla språk som stödjer HTTP-förfrågningar och OpenAI API-formatet (Python, JavaScript, Go, Java, etc.) kan användas. Det officiella OpenAI Python-biblioteket fungerar sömlöst.
Erbjuder OrcaRouter någon cachning eller rabatter för hög volym?
Ingen information om cachelagring eller volymrabatt angavs. Priset är per token enligt leverantörens priser utan påslag. Kontakta OrcaRouter för företagsförfrågningar.

Bädda in denna badge

Google: Gemini 2.5 Flash Lite$0.10/M in1337ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg" alt="Google: Gemini 2.5 Flash Lite på OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash Lite](https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite)

Modellkort som data

GET /api/public/models/google/gemini-2.5-flash-liteÖppna