Gemini 3.8 Flash

google/gemini-3.8-flash
NeuEmpfohlen
VisionAudioToolsJSONReasoning
von Google · 2026-09-02

Gemini 3.8 Flash ist Googles intelligentestes Flash-Modell mit deutlichen Verbesserungen gegenüber 3.7 Flash bei Softwareentwicklung, agentischen Aufgaben und mehrstufigem Denken.

Ktx1M Tokens
Max. Ausgabe65K
Eingabetext + image + video + file + audio
Ausgabetext
p50 TTFT4.53 s
EINGABE$0.75/ 1M Tokens
AUSGABE$3.75/ 1M Tokens
p50 TTFT4.53 s7 T
p95 TTFT10.00 s7 T
DATENVERKEHR105.8MTokens / 7 T

Gemini 3.8 Flash richtet sich an Teams, die ein Google-Modell mit breitem multimodalem Input, einem langen Kontextfenster, einem großen Output-Limit und einer OpenAI-kompatiblen API benötigen. Es…

Für wen ist Gemini 3.8 Flash geeignet?

Welche Eingaben und Ausgaben werden unterstützt?

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Preise

Eingabe / 1M Tokens$0.750
Ausgabe / 1M Tokens$3.75
Cache-Lesen / 1M$0.075
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $16.50 · Mit Prompt-Caching $14.14

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.001895

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
4.53 s
Ausgabegeschwindigkeit
282 tok/s
p95 TTFT
10.00 s
Fehlerquote
0.54%

Öffentliche Benchmarks

76.3
AA Coding
Besser als 95 % der verglichenen Modelle
Nr. 7 von 137
58.7
AA Intelligence
Besser als 92 % der verglichenen Modelle
Nr. 11 von 139
GPQA Diamond
95.3
HLE-Verified
54.9
Humanity's Last Exam
47.8
Long-Context Recall
81.0
SciCode
53.6
tau_banking
44.9
terminalbench_v2_1
87.6
Quelle: artificialanalysis.ai, deepmind.google

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News13 Erwähnungen · 7 T13 mehr als in der Vorwoche

Im Vergleich

Gemini 3.8 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Eingabe $/M$0.75$2.00$4.00$0.50
Ausgabe $/M$3.75$12.00$18.00$3.00
Kontext1.0M1.0M1.0M1.0M
Qualität9/1010/1010/109/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Was kostet Gemini 3.8 Flash über OrcaRouter?
OrcaRouter berechnet Gemini 3.8 Flash zum Anbieterpreis ohne Aufschlag: 0,75 $ pro 1 Million Eingabe-Token und 3,75 $ pro 1 Million Ausgabe-Token. Im Katalog sind keine Sitzungs- oder Plattformgebühren aufgeführt. Da der Ausgabepreis das Fünffache des Eingabepreises beträgt, kosten lange Generierungen proportional mehr als lange Eingabeaufforderungen.
Was sind das Kontextfenster und die maximale Ausgabegröße?
Gemini 3.8 Flash verfügt über ein Kontextfenster von 1.048.576 Token und eine maximale Ausgabe von 65.536 Token. Das Kontextfenster wird für Text-, Bild-, Video-, Datei- und Audioeingaben angegeben. Der Anbieter gibt in dieser Auflistung keine separate Token-Formel pro Medium an.
Was sind die Hauptstärken von Gemini 3.8 Flash?
Zu den aufgeführten Stärken gehören ein Kontext von 1.048.576 Token, eine maximale Ausgabe von 65.536 Token, eine breite multimodale Eingabe und ein Score von 54,9 bei HLE-Verified. Diese Funktionen eignen sich für die Bearbeitung von Fragen auf Expertenniveau, für Aufgaben mit langen Dokumenten und für Multimedia-Verständnis über eine OpenAI-kompatible API. Im Katalog werden keine weiteren Qualitätsaussagen gemacht.
Wie schneidet Gemini 3.8 Flash im Vergleich zu anderen Modellen ab?
Der Katalogeintrag enthält keine Benchmark-Ergebnisse oder Preise für alternative Modelle. Vergleiche sollten durchgeführt werden, indem identische Testdatensätze über OrcaRouter ausgeführt und Genauigkeit, Kosten und Geschwindigkeit gemessen werden. Verwenden Sie die Modell-ID google/gemini-3.8-flash zusammen mit anderen IDs und vergleichen Sie die für Ihre Arbeitslast tatsächlich zurückgegebenen Felder.
Welche Begriffe zur Datenverarbeitung gelten?
Diese Katalogseite enthält keine Angaben zu Aufbewahrungs-, Trainings- oder Datenaustauschregeln. Wenn Sie Daten über OrcaRouter an Gemini 3.8 Flash senden, werden die Anfrageinhalte verarbeitet, um die Transaktion abzuschließen. Die Geschäftsbedingungen für die Datenverarbeitung finden Sie in den Google-Anbieterbedingungen und den OrcaRouter-Bedingungen. Prüfen Sie diese Dokumente, bevor Sie regulierte oder vertrauliche Daten senden.
Wie kann ich Gemini 3.8 Flash mit einer OpenAI-kompatiblen API aufrufen?
Verwenden Sie die OrcaRouter-Basis-URL https://api.orcarouter.ai/v1 und setzen Sie das Modellfeld auf google/gemini-3.8-flash. Senden Sie dann eine Standard-Chat-Completion-Anfrage im OpenAI-Stil mit Ihrem OrcaRouter-API-Schlüssel. Bestehende Clients, die chat.completions.create unterstützen, sollten funktionieren, nachdem Sie die Basis-URL und den Modellnamen geändert haben.
Fügt OrcaRouter dem Anbieterpreis einen Aufschlag hinzu?
Nein. Der Katalogeintrag besagt, dass das Modell zum Anbieterpreis ohne Aufschlag abgerechnet wird. Die angezeigten Token-Preise für Eingabe und Ausgabe betragen $0.75 pro 1M Eingabe-Token und $3.75 pro 1M Ausgabe-Token. Dadurch entspricht der aufgeführte Preis pro Token dem direkten Anbieterpreis.
Ist Prompt-Caching für dieses Modell verfügbar?
Die Modellfakten erwähnen weder Prompt-Caching noch Cache-Hit-Preise oder automatisches Cache-Verhalten. Sie sollten sich nicht darauf verlassen, dass gecachte Prompts die Kosten senken. Die sicherste Kostenschätzung basiert auf der Abrechnung vollständiger Eingabe-Tokens zu 0,75 $ pro 1 Million Eingabe-Tokens.
Welche Eingabemodalitäten werden unterstützt?
Das Modell akzeptiert Text-, Bild-, Video-, Datei- und Audioeingaben. Die Ausgabe ist mit bis zu 65.536 Token angegeben; eine Medienausgabe-Modalität ist nicht dokumentiert. Testen Sie bei Bild-, Video-, Datei- oder Audio-Prompts das Inhaltsformat Ihres Clients, da das Medien-Schema der API im Katalog nicht beschrieben ist.

Dieses Abzeichen einbetten

Google: Gemini 3.8 Flash$0.75/M in4529ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg" alt="Google: Gemini 3.8 Flash auf OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.8 Flash](https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.8-flash)

Modellkarte als Daten

GET /api/public/models/google/gemini-3.8-flashÖffnen
Maschinenlesbar:/llms.txt/llms-full.txt