Gemini 3.8 Flash

google/gemini-3.8-flash
NieuwUitgelicht
VisieAudioToolsJSONRedeneren
door Google · 2026-09-02

Gemini 3.8 Flash is Google's meest intelligente Flash-model met aanzienlijke verbeteringen ten opzichte van 3.7 Flash op het gebied van software engineering, agentische taken en meerstapsredenering.

ctx1M tokens
Max. uitvoer65K
Invoertext + image + video + file + audio
Uitvoertext
p50 TTFT4.52 s
INPUT$0.75/ 1M tokens
OUTPUT$3.75/ 1M tokens
p50 TTFT4.52 s7d
p95 TTFT10.00 s7d
VERKEER111.9Mtokens / 7d

Gemini 3.8 Flash is bedoeld voor teams die een Google-model nodig hebben met brede multimodale invoer, een lang contextvenster, een grote uitvoerlimiet en een OpenAI-compatibele API. Het past bij…

Wie zou Gemini 3.8 Flash moeten gebruiken?

Welke inputs en outputs worden ondersteund?

Codevoorbeelden

Aanroepen vanuit elke SDK

OpenAI-compatibel — behoud je huidige SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Ondersteunde parameters

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Prijzen

Invoer / 1M tokens$0.750
Uitvoer / 1M tokens$3.75
Cache lezen / 1M$0.075
ValutaUSD

Kostencalculator

Tokens / maand10MM
Invoeraandeel70%%
Geschat / maand $16.50 · Met prompt-caching $14.14

Schatting op basis van catalogusprijs

Token- en kostenschatter

Invoertokens: 20Kosten per verzoek: $0.001890

Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.

Prestaties

p50 TTFT
4.52 s
Outputsnelheid
280 tok/s
p95 TTFT
10.00 s
Foutpercentage
0.52%

Openbare benchmarks

76.3
AA Coding
Beter dan 95% van de vergeleken modellen
#7 van 137
58.7
AA Intelligence
Beter dan 92% van de vergeleken modellen
#11 van 139
GPQA Diamond
95.3
HLE-Verified
54.9
Humanity's Last Exam
47.8
Long-Context Recall
81.0
SciCode
53.6
tau_banking
44.9
terminalbench_v2_1
87.6
Bron: artificialanalysis.ai, deepmind.google

Community-buzz

Waar ontwikkelaars het deze week over hebben

Hacker News13 vermeldingen · 7 d13 meer dan vorige week

Vergelijking

Gemini 3.8 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Invoer $/M$0.75$2.00$4.00$0.50
Uitvoer $/M$3.75$12.00$18.00$3.00
Context1.0M1.0M1.0M1.0M
Kwaliteit9/1010/1010/109/10
Naast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijken

FAQ

Wat kost Gemini 3.8 Flash via OrcaRouter?
OrcaRouter factureert Gemini 3.8 Flash tegen het tarief van de provider zonder opslag: $0.75 per 1M inputtokens en $3.75 per 1M outputtokens. In de catalogus worden geen sessiekosten of platformkosten vermeld. Omdat output vijf keer de inputprijs is, zullen lange generaties proportioneel duurder zijn dan lange prompts.
Wat zijn het contextvenster en de maximale uitvoergrootte?
Gemini 3.8 Flash heeft een contextvenster van 1.048.576 tokens en een maximale output van 65.536 tokens. Het contextvenster geldt voor tekst-, beeld-, video-, bestands- en audio-invoer. De provider geeft in deze vermelding geen afzonderlijke tokenformule per mediatype.
Wat zijn de belangrijkste sterke punten van Gemini 3.8 Flash?
De genoemde sterke punten zijn een context van 1.048.576 tokens, een maximale uitvoer van 65.536 tokens, brede multimodale invoer en een score van 54,9 op HLE-Verified. Deze functies zijn geschikt voor vraagstukken op expertniveau, taken met lange documenten en multimediabegrip via een OpenAI-compatibele API. In de catalogus worden geen aanvullende kwaliteitsclaims gedaan.
Hoe verhoudt Gemini 3.8 Flash zich tot andere modellen?
Het catalogusrecord bevat geen benchmarkscores of prijzen voor welk alternatief model dan ook. Vergelijkingen moeten worden gemaakt door identieke testsets via OrcaRouter uit te voeren en daarbij nauwkeurigheid, kosten en snelheid te meten. Gebruik model-ID google/gemini-3.8-flash naast andere ID's en vergelijk de velden die daadwerkelijk voor uw workload worden geretourneerd.
Welke termen voor gegevensverwerking zijn van toepassing?
Deze cataloguspagina vermeldt geen regels voor bewaartermijnen, training of het delen van gegevens. Als u via OrcaRouter gegevens naar Gemini 3.8 Flash verzendt, wordt de inhoud van het verzoek verwerkt om de transactie te voltooien. De zakelijke voorwaarden voor gegevensverwerking staan in de providervoorwaarden van Google en de voorwaarden van OrcaRouter. Raadpleeg deze documenten voordat u gereguleerde of vertrouwelijke gegevens verzendt.
Hoe roep ik Gemini 3.8 Flash aan via een OpenAI-compatibele API?
Gebruik de OrcaRouter-basis-URL https://api.orcarouter.ai/v1 en stel het modelveld in op google/gemini-3.8-flash. Stuur vervolgens een standaard OpenAI-stijl chatvoltooiingsverzoek met uw OrcaRouter API-sleutel. Bestaande clients die chat.completions.create ondersteunen, zouden moeten werken na het wijzigen van de basis-URL en modelnaam.
Voegt OrcaRouter een opslag toe aan het provider-tarief?
Nee. De catalogusvermelding zegt dat het model tegen het provider-tarief wordt gefactureerd met nul opslag. De weergegeven prijzen voor invoer- en uitvoertokens zijn $0,75 per 1M invoer en $3,75 per 1M uitvoer. Dit maakt de vermelde kosten per token gelijk aan het directe provider-tarief.
Is prompt caching beschikbaar voor dit model?
De feiten over het model vermelden geen prompt-caching, cache-hit-prijzen of automatisch cachegedrag. U moet niet vertrouwen op gecachte prompts om de kosten te verlagen. De veiligste kostenraming is gebaseerd op volledige facturering van invoertokens tegen $0,75 per 1M invoertokens.
Welke invoermodaliteiten worden ondersteund?
Het model accepteert tekst-, afbeelding-, video-, bestand- en audio-invoer. De uitvoer wordt vermeld als maximaal 65.536 tokens en er is geen uitvoermodaliteit voor media gedocumenteerd. Test voor afbeelding-, video-, bestand- of audio-prompts het contentformaat van uw client, omdat het API-mediaschema niet in de catalogus wordt beschreven.

Sluit deze badge in

Google: Gemini 3.8 Flash$0.75/M in4522ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg" alt="Google: Gemini 3.8 Flash op OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.8 Flash](https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.8-flash)

Modelkaart als data

GET /api/public/models/google/gemini-3.8-flashOpenen
Machineleesbaar:/llms.txt/llms-full.txt