Gemini 3.5 Flash

google/gemini-3.5-flash
VisionLjudVerktygJSONResonemang
av google · 2026-05-23

Google Gemini 3.5 Flash — Googles starkaste Flash-nivåmodell, som ligger strax under 3.1-pro-preview i intelligens (AA Intel 55.3 jämfört med 57.2) med Flash-svarstid. 1M token kontextfönster (1,048,576), 64K maximal utdata (65,536). Full multimodal inmatning över text, bild, ljud, video och fil; endast textutdata. AA Coding 45, GPQA Diamond 92.2%, IFBench 76.3% (toppklass för instruktionsföljning), Long-Context Recall 69.3%, SciCode 53.1%, τ²-Bench 95.3% (agentisk verktygsanvändning), HLE 41%. Stöder reasoning (include_reasoning / reasoning), strukturerade utdata, verktygsanrop, response_format, seed, stop och standard provtagningskontroller. Slutpunkter: chat_completions, gemini_generate. Bäst lämpad för: högvolyms agentiska loopar, långdokumentsanalys och multimodal extraktion där Pro-nivåns latens eller kostnad är överdriven.

ctx1.05M tokens
Max output65.5K
Inmatningtext + image + video + file + audio
Utdatatext
p50 TTFT10.00 s
INMATNING$1.50/ 1M token
UTDATA$9.00/ 1M token
p50 TTFT10.00 s7d
p95 TTFT10.00 s7d
TRAFIK4.6Mtokens/7d

Gemini 3.5 Flash är en stor språkmodell utvecklad av Google, finjusterad för hastighet och effektivitet. Den tillhör Gemini-familjen och är utformad för att hantera multimodala inmatningar—text,…

Vad är Gemini 3.5 Flash?

Vem borde använda Gemini 3.5 Flash?

Vilka inmatningsmodaliteter stöder Gemini 3.5 Flash?

Hur nås Gemini 3.5 Flash via OrcaRouter?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Priser

Inmatning / 1M token$1.50
Utdata / 1M tokens$9.00
Cacheläsning / 1M$0.150
Cache-skrivning / 1M$0.083
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $37.50 · Med promptcachning $32.78

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.004527

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
10.00 s
Utdatahastighet
5866 tok/s
p95 TTFT
10.00 s
Felfrekvens
20.8%

Offentliga benchmarks

70.1
AA Coding
Bättre än 87% av jämförda modeller
#16 av 123
50.2
AA Intelligence
Bättre än 82% av jämförda modeller
#22 av 125
51.0
AA Math
Bättre än 27% av jämförda modeller
#59 av 81
GPQA Diamond
92.2
Humanity's Last Exam
41.0
IFBench
76.3
Long-Context Recall
69.3
MMLU-Pro
59.0 index
SciCode
53.1
tau_banking
25.4
TerminalBench Hard
40.9
terminalbench_v2_1
78.7
τ²-Bench
95.3
Källa: artificialanalysis.ai

Så jämför den sig

Gemini 3.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Input $/M$1.50$2.00$4.00$0.50
Output $/M$9.00$12.00$18.00$3.00
Kontext1.0M1.0M1.0M1.0M
Kvalitet9/1010/1010/109/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Hur mycket kostar Gemini 3.5 Flash på OrcaRouter?
Inmatningstokens kostar $1.50 per 1 miljon tokens; utmatningstokens kostar $9.00 per 1 miljon tokens. OrcaRouter debiterar till leverantörens taxa utan påslag. Det tillkommer inga avgifter.
Vad är kontextfönstrets storlek för Gemini 3.5 Flash?
Den stöder en kontextfönster på 1 048 576 tokens (ungefär 1 miljon tokens). Detta inkluderar både inmatnings- och utmatningstokens tillsammans.
Vilka är de främsta styrkorna hos Gemini 3.5 Flash?
Den är optimerad för låg latens, hög genomströmning och kostnadseffektivitet. Den stöder multimodala indata (text, bild, video, fil, ljud) och ett stort kontextfönster, vilket gör den idealisk för realtidsapplikationer och bearbetning av långa dokument.
Hur står sig Gemini 3.5 Flash jämfört med Gemini 3.5 Pro?
Flash är snabbare och billigare men har sämre benchmark-prestanda på komplexa resonemangs- och matematikuppgifter. Pro är mer exakt men långsammare och dyrare. Flash är bättre för högvolym-, latenskänsliga applikationer.
Hur hanteras data när man använder Gemini 3.5 Flash via OrcaRouter?
OrcaRouter fungerar som en proxyserver och lagrar inte dina data. Googles policyer för datahantering gäller dock för den underliggande modellen. OrcaRouter rekommenderar att du granskar Googles villkor för datalagring och integritet.
Hur anropar jag Gemini 3.5 Flash med ett OpenAI-kompatibelt API?
Använde bas-URL:en https://api.orcarouter.ai/v1, modell-ID "google/gemini-3.5-flash", och skicka en OrcaRouter API-nyckel i Authorization-huvudet. API:et stöder vanliga chattkompletteringar och streaming.
Vilken utdatalängd kan Gemini 3.5 Flash generera?
Den kan generera upp till 65,536 tokens per svar. Detta är avsevärt större än många modeller, vilket möjliggör långformat innehåll, kod eller utökat resonemang.
Finns det någon rabatt för upprepade eller cachade tokens?
Baserat på de angivna fakta erbjuder OrcaRouter inga cache- eller volymrabatter. Varje token faktureras enligt standardpris oavsett återanvändning.

Bädda in denna badge

Gemini 3.5 Flash$1.50/M in10000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.5-flash.svg" alt="Gemini 3.5 Flash på OrcaRouter" /> </a>
Markdown [![Gemini 3.5 Flash](https://www.orcarouter.ai/embed/google/gemini-3.5-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.5-flash)

Modellkort som data

GET /api/public/models/google/gemini-3.5-flashÖppna