Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
VisieAudioToolsJSONRedeneren
door Google · 2025-07-22

Gemini 2.5 Flash-Lite is een lichtgewicht redeneringsmodel in de Gemini 2.5-familie, geoptimaliseerd voor extreem lage latentie en kostenefficiëntie. Het biedt een verbeterde doorvoer, snellere tokengeneratie en betere prestaties...

ctx1M tokens
Max. uitvoer65K
Invoertext + image + file + audio + video
Uitvoertext
p50 TTFT1.34 s
INPUT$0.10/ 1M tokens
OUTPUT$0.40/ 1M tokens
p50 TTFT1.34 s7d
p95 TTFT8.52 s7d
VERKEER11.3Mtokens / 7d

Google Gemini 2.5 Flash Lite is een kleinere, snellere en voordeligere variant van het Gemini 2.5 Flash-model van Google. Het is ontworpen om een breed scala aan multimodale invoer te…

Wat is Google Gemini 2.5 Flash Lite?

Wie zou dit model moeten gebruiken?

Welke invoermodaliteiten ondersteunt het?

Hoe verhoudt het zich tot andere Google-modellen?

Codevoorbeelden

Aanroepen vanuit elke SDK

OpenAI-compatibel — behoud je huidige SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Ondersteunde parameters

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Prijzen

Invoer / 1M tokens$0.100
Uitvoer / 1M tokens$0.400
Cache lezen / 1M$0.010
ValutaUSD

Kostencalculator

Tokens / maand10MM
Invoeraandeel70%%
Geschat / maand $1.90 · Met prompt-caching $1.59

Schatting op basis van catalogusprijs

Token- en kostenschatter

Invoertokens: 20Kosten per verzoek: $0.000202

Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.

Prestaties

p50 TTFT
1.34 s
Outputsnelheid
541 tok/s
p95 TTFT
8.52 s
Foutpercentage
0.44%

Openbare benchmarks

7.4
AA Coding
Beter dan 1% van de vergeleken modellen
#125 van 126
6.7
AA Intelligence
Beter dan 3% van de vergeleken modellen
#122 van 128
35.3
AA Math
Beter dan 12% van de vergeleken modellen
#71 van 81
AIME
50.0
AIME 2025
35.3
GPQA Diamond
47.4
Humanity's Last Exam
3.7
IFBench
31.5
LiveCodeBench
40.0
Long-Context Recall
32.0
MATH-500
92.6
MMLU-Pro
72.4
SciCode
17.7
TerminalBench Hard
2.3
τ²-Bench
19.0
Bron: artificialanalysis.ai

Community-buzz

Waar ontwikkelaars het deze week over hebben

Hacker News0 vermeldingen · 7 d1 minder dan vorige week

Vergelijking

Gemini 2.5 Flash LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Invoer $/M$0.10$2.00$4.00$0.50
Uitvoer $/M$0.40$12.00$18.00$3.00
Context1.0M1.0M1.0M1.0M
Kwaliteit2/1010/1010/109/10
Naast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijken

FAQ

Wat zijn de kosten per token voor Gemini 2.5 Flash Lite op OrcaRouter?
Inputtokens kosten $0,10 per 1 miljoen tokens, outputtokens kosten $0,40 per 1 miljoen tokens. OrcaRouter factureert tegen het provider-tarief zonder opslag.
Wat is de grootte van het contextvenster?
Het contextvenster is 1,048,576 tokens (1 miljoen tokens) en de maximale uitvoer is 65,536 tokens.
Wat zijn de belangrijkste sterke punten van het model?
Sterke punten zijn onder andere lage kosten, hoge snelheid, sterke wiskundige redenering (92.6 op MATH-500), een zeer groot contextvenster en multimodale ondersteuning voor tekst, afbeeldingen, bestanden, audio en video.
Hoe verhoudt het zich tot Gemini 2.5 Flash?
Gemini 2.5 Flash Lite is goedkoper en sneller, maar heeft waarschijnlijk iets lagere prestaties op het gebied van complex redeneren, creatief schrijven en codegeneratie vergeleken met het volledige Flash model.
Slaat OrcaRouter mijn gegevens op of deelt het deze bij gebruik van dit model?
De verstrekte feiten specificeren het gegevensverwerkingsbeleid van OrcaRouter niet. Normaal gesproken mogen API-aanbieders gegevens alleen verwerken om verzoeken uit te voeren. Raadpleeg het privacybeleid van OrcaRouter voor details.
Hoe roep ik dit model aan via een OpenAI-compatibele API?
Gebruik de basis-URL https://api.orcarouter.ai/v1 met model-id "google/gemini-2.5-flash-lite" in je OpenAI-clientbibliotheek. Voeg je OrcaRouter API-sleutel toe aan de Authorization-header.
Kan ik multimodale invoer zoals afbeeldingen en audio gebruiken?
Ja, het model accepteert tekst, afbeelding, bestand, audio en video als invoer. U kunt ze opnemen als inhoudsdelen in het gebruikersbericht met behulp van het standaard OpenAI multimodale formaat.
Wat is de verwachte latentie?
Het model is ontworpen voor lage latentie, vooral in vergelijking met grotere modellen. Exacte tijden zijn afhankelijk van de lengte van de invoer/uitvoer en de serverbelasting. Er worden geen specifieke latentiecijfers verstrekt.
Welke programmeertalen en frameworks worden ondersteund?
Elke taal die HTTP-verzoeken en de OpenAI API-indeling ondersteunt (Python, JavaScript, Go, Java, etc.) kan worden gebruikt. De officiële OpenAI Python-bibliotheek werkt naadloos.
Biedt OrcaRouter caching of kortingen voor hoge volumes?
Er werd geen informatie over caching of volumekorting verstrekt. De prijs is per token tegen de tarieven van de provider zonder opslag. Neem contact op met OrcaRouter voor zakelijke vragen.

Sluit deze badge in

Google: Gemini 2.5 Flash Lite$0.10/M in1337ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg" alt="Google: Gemini 2.5 Flash Lite op OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash Lite](https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite)

Modelkaart als data

GET /api/public/models/google/gemini-2.5-flash-liteOpenen
Machineleesbaar:/llms.txt/llms-full.txt