Gemini 3.8 Flash

google/gemini-3.8-flash
NyUtvalt
VisionLjudVerktygJSONResonemang
av Google · 2026-09-02

Gemini 3.8 Flash är Googles mest intelligenta Flash-modell med betydande förbättringar jämfört med 3.7 Flash inom mjukvaruteknik, agentiska uppgifter och flerstegsresonemang.

ctx1M tokens
Max output65K
Inmatningtext + image + video + file + audio
Utdatatext
p50 TTFT4.52 s
INMATNING$0.75/ 1M token
UTDATA$3.75/ 1M token
p50 TTFT4.52 s7d
p95 TTFT10.00 s7d
TRAFIK111.9Mtokens/7d

Gemini 3.8 Flash är inriktad på team som behöver en Google-modell med bred multimodal inmatning, ett långt kontextfönster, en stor utdatagräns och ett OpenAI-kompatibelt API. Den passar för…

Vem borde använda Gemini 3.8 Flash?

Vilka in- och utdata stöds?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Priser

Inmatning / 1M token$0.750
Utdata / 1M tokens$3.75
Cacheläsning / 1M$0.075
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $16.50 · Med promptcachning $14.14

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.001888

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
4.52 s
Utdatahastighet
280 tok/s
p95 TTFT
10.00 s
Felfrekvens
0.52%

Offentliga benchmarks

76.3
AA Coding
Bättre än 95% av jämförda modeller
#7 av 137
58.7
AA Intelligence
Bättre än 92% av jämförda modeller
#11 av 139
GPQA Diamond
95.3
HLE-Verified
54.9
Humanity's Last Exam
47.8
Long-Context Recall
81.0
SciCode
53.6
tau_banking
44.9
terminalbench_v2_1
87.6
Källa: artificialanalysis.ai, deepmind.google

Community-buzz

Vad utvecklare säger den här veckan

Hacker News13 omnämnanden · 7dupp 13 jämfört med föregående vecka

Så jämför den sig

Gemini 3.8 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Input $/M$0.75$2.00$4.00$0.50
Output $/M$3.75$12.00$18.00$3.00
Kontext1.0M1.0M1.0M1.0M
Kvalitet9/1010/1010/109/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad kostar Gemini 3.8 Flash via OrcaRouter?
OrcaRouter fakturerar Gemini 3.8 Flash till leverantörens pris utan påslag: $0,75 per 1M input-tokens och $3,75 per 1M output-tokens. Ingen sessionsavgift eller plattformsavgift finns listad i katalogen. Eftersom priset för utmatning är fem gånger priset för inmatning, kommer långa genereringar att kosta proportionellt mer än långa promptar.
Vad är kontextfönstret och den maximala utdatastorleken?
Gemini 3.8 Flash har ett kontextfönster på 1,048,576 tokens och en maximal utmatning på 65,536 tokens. Kontextfönstret annonseras för text-, bild-, video-, fil- och ljudinmatningar. Leverantören anger ingen separat tokenformel per medietyp i den här listningen.
Vilka är de främsta styrkorna hos Gemini 3.8 Flash?
Dess listade styrkor är en kontext på 1 048 576 token, en maximal utdatastorlek på 65 536 token, bred multimodal inmatning och ett resultat på 54,9 på HLE-Verified. Dessa funktioner passar avancerat frågearbete, uppgifter med långa dokument och multimediaförståelse genom ett OpenAI-kompatibelt API. Inga ytterligare kvalitetspåståenden görs i katalogen.
Hur står sig Gemini 3.8 Flash jämfört med andra modeller?
Katalogposten innehåller inte benchmarkpoäng eller priser för någon alternativ modell. Jämförelser bör göras genom att köra identiska testset via OrcaRouter och mäta noggrannhet, kostnad och hastighet. Använd modell-ID google/gemini-3.8-flash tillsammans med andra ID:n och jämför de fält som faktiskt returneras för din arbetsbelastning.
Vilka datahanteringstermer gäller?
Denna katalogsida anger inte regler för datalagring, träning eller datadelning. Om du skickar data till Gemini 3.8 Flash via OrcaRouter behandlas förfrågningsinnehållet för att slutföra transaktionen. Affärsvillkor för datahantering finns i Googles leverantörsvillkor och OrcaRouters villkor. Kontrollera dessa dokument innan du skickar reglerad eller konfidentiell data.
Hur anropar jag Gemini 3.8 Flash med ett OpenAI-kompatibelt API?
Använd OrcaRouter-bas-URL:en https://api.orcarouter.ai/v1 och sätt modellfältet till google/gemini-3.8-flash. Skicka sedan en vanlig chat completion-förfrågan i OpenAI-stil med din OrcaRouter-API-nyckel. Befintliga klienter som stödjer chat.completions.create bör fungera efter att du har ändrat bas-URL:en och modellnamnet.
Lägger OrcaRouter till ett påslag på leverantörspriset?
Nej. Kataloglistan anger att modellen faktureras enligt leverantörens pris utan påslag. De visade priserna för in- och utdatatokens är $0,75 per 1M inmatning och $3,75 per 1M utdata. Detta gör att den angivna kostnaden per token är direkt leverantörens pris.
Är promptcachning tillgänglig för den här modellen?
Modellfakta nämner inte prompt caching, priser för cache-träffar eller automatiskt cache-beteende. Du bör inte förlita dig på cachade prompts för att minska kostnader. Den säkraste kostnadsuppskattningen baseras på full fakturering av inmatningstokens till $0.75 per 1M inmatningstokens.
Vilka inmatningsmodaliteter stöds?
Modellen accepterar text-, bild-, video-, fil- och ljudinmatning. Utdata anges som upp till 65 536 tokens och ingen mediamodalitet för utdata är dokumenterad. För bild-, video-, fil- eller ljudpromptar, testa din klients innehållsformat eftersom API:ns mediaschema inte beskrivs i katalogen.

Bädda in denna badge

Google: Gemini 3.8 Flash$0.75/M in4522ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg" alt="Google: Gemini 3.8 Flash på OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.8 Flash](https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.8-flash)

Modellkort som data

GET /api/public/models/google/gemini-3.8-flashÖppna