Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
VisionAudioToolsJSONReasoning
von Google · 2025-07-22

Gemini 2.5 Flash-Lite ist ein leichtgewichtiges Reasoning-Modell der Gemini 2.5-Familie, optimiert für extrem niedrige Latenz und Kosteneffizienz. Es bietet verbesserten Durchsatz, schnellere Token-Generierung und bessere Leistung...

Ktx1M Tokens
Max. Ausgabe65K
Eingabetext + image + file + audio + video
Ausgabetext
p50 TTFT1.34 s
EINGABE$0.10/ 1M Tokens
AUSGABE$0.40/ 1M Tokens
p50 TTFT1.34 s7 T
p95 TTFT8.52 s7 T
DATENVERKEHR11.3MTokens / 7 T

Google Gemini 2.5 Flash Lite ist eine kleinere, schnellere und günstigere Variante des Gemini 2.5 Flash-Modells von Google. Es wurde entwickelt, um eine breite Palette multimodaler Eingaben zu…

Was ist Google Gemini 2.5 Flash Lite?

Wer sollte dieses Modell verwenden?

Welche Eingabemodalitäten werden unterstützt?

Wie schneidet es im Vergleich zu anderen Google-Modellen ab?

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Preise

Eingabe / 1M Tokens$0.100
Ausgabe / 1M Tokens$0.400
Cache-Lesen / 1M$0.010
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $1.90 · Mit Prompt-Caching $1.59

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.000203

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
1.34 s
Ausgabegeschwindigkeit
541 tok/s
p95 TTFT
8.52 s
Fehlerquote
0.44%

Öffentliche Benchmarks

7.4
AA Coding
Besser als 1 % der verglichenen Modelle
Nr. 125 von 126
6.7
AA Intelligence
Besser als 3 % der verglichenen Modelle
Nr. 122 von 128
35.3
AA Math
Besser als 12 % der verglichenen Modelle
Nr. 71 von 81
AIME
50.0
AIME 2025
35.3
GPQA Diamond
47.4
Humanity's Last Exam
3.7
IFBench
31.5
LiveCodeBench
40.0
Long-Context Recall
32.0
MATH-500
92.6
MMLU-Pro
72.4
SciCode
17.7
TerminalBench Hard
2.3
τ²-Bench
19.0
Quelle: artificialanalysis.ai

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News0 Erwähnungen · 7 T1 weniger als in der Vorwoche

Im Vergleich

Gemini 2.5 Flash LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Eingabe $/M$0.10$2.00$4.00$0.50
Ausgabe $/M$0.40$12.00$18.00$3.00
Kontext1.0M1.0M1.0M1.0M
Qualität2/1010/1010/109/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Was sind die Kosten pro Token für Gemini 2.5 Flash Lite auf OrcaRouter?
Eingabe-Tokens kosten $0,10 pro 1 Million Tokens, Ausgabe-Tokens kosten $0,40 pro 1 Million Tokens. OrcaRouter rechnet zum Anbietersatz ohne Aufschlag ab.
Wie groß ist das Kontextfenster?
Das Kontextfenster hat 1.048.576 Token (1 Million Token), und die maximale Ausgabe beträgt 65.536 Token.
Was sind die Hauptstärken des Modells?
Zu den Stärken gehören niedrige Kosten, hohe Geschwindigkeit, starkes mathematisches Denken (92.6 auf MATH-500), ein sehr großes Kontextfenster und multimodale Unterstützung für Text, Bilder, Dateien, Audio und Video.
Wie schneidet es im Vergleich zu Gemini 2.5 Flash ab?
Gemini 2.5 Flash Lite ist günstiger und schneller, hat aber wahrscheinlich eine etwas geringere Leistung bei komplexem Denken, kreativem Schreiben und Codegenerierung im Vergleich zum vollständigen Flash-Modell.
Speichert oder teilt OrcaRouter meine Daten bei der Nutzung dieses Modells?
Die angegebenen Fakten spezifizieren nicht die Datenverarbeitungsrichtlinien von OrcaRouter. Normalerweise verarbeiten API-Anbieter Daten nur zur Erfüllung von Anfragen. Überprüfen Sie die Datenschutzrichtlinie von OrcaRouter für Details.
Wie rufe ich dieses Modell über eine OpenAI-kompatible API auf?
Verwenden Sie die Basis-URL https://api.orcarouter.ai/v1 mit der Modell-ID "google/gemini-2.5-flash-lite" in Ihrer OpenAI-Clientbibliothek. Fügen Sie Ihren OrcaRouter-API-Schlüssel in den Authorization-Header ein.
Kann ich multimodale Eingaben wie Bilder und Audio verwenden?
Ja, das Modell akzeptiert Text-, Bild-, Datei-, Audio- und Videoeingaben. Sie können sie als Inhaltsteile in die Benutzernachricht einfügen, indem Sie das standardmäßige OpenAI-multimodale Format verwenden.
Was ist die erwartete Latenz?
Das Modell ist für geringe Latenz ausgelegt, insbesondere im Vergleich zu größeren Modellen. Die genauen Zeiten hängen von der Eingabe-/Ausgabelänge und der Serverlast ab. Es werden keine spezifischen Latenzzahlen angegeben.
Welche Programmiersprachen und Frameworks werden unterstützt?
Jede Sprache, die HTTP-Anfragen und das OpenAI API-Format unterstützt (Python, JavaScript, Go, Java usw.), kann verwendet werden. Die offizielle OpenAI Python-Bibliothek funktioniert nahtlos.
Bietet OrcaRouter Caching oder Rabatte für hohe Volumen an?
Es wurden keine Informationen zu Caching oder Mengenrabatten bereitgestellt. Die Preisgestaltung erfolgt pro Token zu den Tarifen des Anbieters ohne Aufschlag. Kontaktieren Sie OrcaRouter für Unternehmensanfragen.

Dieses Abzeichen einbetten

Google: Gemini 2.5 Flash Lite$0.10/M in1337ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg" alt="Google: Gemini 2.5 Flash Lite auf OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash Lite](https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite)

Modellkarte als Daten

GET /api/public/models/google/gemini-2.5-flash-liteÖffnen
Maschinenlesbar:/llms.txt/llms-full.txt