Gemini 3 Flash Preview

google/gemini-3-flash-preview
VisionLjudVerktygJSONResonemang
av Google · 2025-12-17

Gemini 3 Flash Preview är en höghastighets-, högvärdig tänkandemodell utformad för agentiska arbetsflöden, flervarvschatt och kodningsassistans. Den levererar nästan Pro-nivå resonemang och verktyg...

ctx1.05M tokens
Max output65.5K
Inmatningtext + image + file + audio + video
Utdatatext
p50 TTFT10.00 s
INMATNING$0.50/ 1M token
UTDATA$3.00/ 1M token
p50 TTFT10.00 s7d
p95 TTFT10.00 s7d
TRAFIK2.8Mtokens/7d

Google Gemini 3 Flash Preview är en multimodal modell utvecklad av Google, optimerad för hastighet och bearbetning av stora kontexter. Den accepterar indata i text-, bild-, fil-, ljud- och…

Vad är Google Gemini 3 Flash Preview?

Vilken målgrupp är denna modell avsedd för?

Vilka multimodala indata stöder den?

Vad är status för förhandsvisningen och hur stabil är den?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-3-flash-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Priser

Inmatning / 1M token$0.500
Utdata / 1M tokens$3.00
Cacheläsning / 1M$0.050
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $12.50 · Med promptcachning $10.93

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.001509

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
10.00 s
Utdatahastighet
3445 tok/s
p95 TTFT
10.00 s
Felfrekvens
0%

Offentliga benchmarks

37.8
AA Coding
Bättre än 39% av jämförda modeller
#72 av 123
27.4
AA Intelligence
Bättre än 33% av jämförda modeller
#84 av 125
55.7
AA Math
Bättre än 32% av jämförda modeller
#55 av 81
AIME 2025
55.7
GPQA Diamond
81.2
Humanity's Last Exam
14.1
IFBench
55.1
LiveCodeBench
79.7
Long-Context Recall
48.0
MMLU-Pro
88.2
SciCode
49.9
TerminalBench Hard
31.8
τ²-Bench
43.3
Källa: artificialanalysis.ai

Så jämför den sig

Gemini 3 Flash PreviewGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3.5 Flash
Input $/M$0.50$2.00$4.00$1.50
Output $/M$3.00$12.00$18.00$9.00
Kontext1.0M1.0M1.0M1.0M
Kvalitet9/1010/1010/109/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad kostar det att använda Gemini 3 Flash Preview?
Priset är $0.50 per miljon inmatningstokens och $3.00 per miljon utmatningstokens, debiterat enligt leverantörens taxa utan påslag från OrcaRouter.
Vad är storleken på kontextfönstret?
Kontextfönstret är 1,048,576 token för indata och modellen kan generera upp till 65,536 utdata-token.
Vilka är de stödda inmatningsmodaliteterna?
Text, bild, fil, ljud och video accepteras alla som indata. Utdata är enbart text.
Hur står den sig mot Gemini 2 Flash?
Gemini 3 Flash Preview har ett större kontextfönster (1M jämfört med upp till 1M men ofta mindre), högre MMLU-Pro-poäng (88.2) och utökat multimodalt stöd inklusive video. Det är snabbare och mer kapabelt för komplexa uppgifter, men Gemini 2 Flash är billigare per token.
Hur hanterar OrcaRouter datasekretess?
OrcaRouter skickar dina förfrågningar till Googles API. Datahantering följer Googles integritetspolicy. OrcaRouter loggar eller lagrar inte ditt innehåll utöver vad som är nödvändigt för att behandla förfrågan. Granska båda leverantörernas policyer för detaljer.
Kan jag anropa Gemini 3 Flash Preview med ett OpenAI-kompatibelt API?
Ja. Använd OrcaRouter's API på https://api.orcarouter.ai/v1 med modell-ID "google/gemini-3-flash-preview". Autentisering använder en OrcaRouter API-nyckel. Förfrågnings- och svarsformat följer OpenAIs Chat Completions-schema.
Vilka är modellens främsta styrkor?
Hög inferenshastighet, stor 1M-tokens kontext, multimodal indata (text, bild, fil, ljud, video), starkt MMLU-Pro benchmark (88,2) och låg kostnad relativt större modeller.
Är Gemini 3 Flash Preview tillgänglig för produktion?
Det är en förhandsversion, vilket innebär att den kan ha ändringar, intermittent tillgänglighet eller begränsat stöd. Den är lämplig för testning och utveckling; för kritiska produktionsarbetsbelastningar överväg att använda den stabila versionen när den blir tillgänglig.
Hur uppskattar jag tokenanvändningen för multimodala indata?
Varje modalitet har sin egen tokenisering. Bilder, ljud och video delas upp i tokens baserat på upplösning och längd. OrcaRouter rapporterar tokenanvändning i API-svaret. Du kan även konsultera Googles dokumentation för detaljerade regler för tokenräkning.
Vad händer om jag överskrider kontextfönstret?
Inmatningar som överstiger 1 048 576 tokens kommer att trunkeras från det äldsta innehållet. Modellen kommer att ignorera de överskjutande tokensen. Se till att dina meddelanden ryms inom gränsen genom att övervaka totalt antal tokens i din begäran.

Bädda in denna badge

Google: Gemini 3 Flash Preview$0.50/M in10000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3-flash-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3-flash-preview.svg" alt="Google: Gemini 3 Flash Preview på OrcaRouter" /> </a>
Markdown [![Google: Gemini 3 Flash Preview](https://www.orcarouter.ai/embed/google/gemini-3-flash-preview.svg)](https://www.orcarouter.ai/models/google/gemini-3-flash-preview)

Modellkort som data

GET /api/public/models/google/gemini-3-flash-previewÖppna