Gemini 3.1 Flash Lite Preview

google/gemini-3.1-flash-lite-preview
VisionLjudVerktygJSONResonemang
av Google · 2026-03-03

Gemini 3.1 Flash Lite Preview är Googles högeffektiva modell optimerad för högvolymanvändning. Den överträffar Gemini 2.5 Flash Lite i övergripande kvalitet och närmar sig Gemini 2.5 Flash prestanda över...

ctx1.05M tokens
Max output65.5K
Inmatningtext + image + video + file + audio
Utdatatext
p50 TTFT1.46 s
INMATNING$0.25/ 1M token
UTDATA$1.50/ 1M token
p50 TTFT1.46 s7d
p95 TTFT4.29 s7d
TRAFIK678.0Ktokens/7d

Google Gemini 3.1 Flash Lite Preview är en förhandsversion av en lättviktsvariant från Gemini 3.1-serien. Den är utformad för att leverera stark resonemangsförmåga och multimodal förståelse till en…

Vad är Google Gemini 3.1 Flash Lite Preview?

Vem bör använda den här modellen?

Vilka är de viktigaste specifikationerna?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-3.1-flash-lite-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Priser

Inmatning / 1M token$0.250
Utdata / 1M tokens$1.50
Cacheläsning / 1M$0.025
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $6.25 · Med promptcachning $5.46

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000754

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
1.46 s
Utdatahastighet
181 tok/s
p95 TTFT
4.29 s
Felfrekvens
0%

Offentliga benchmarks

34.7
AA Coding
Bättre än 35% av jämförda modeller
#80 av 123
25.0
AA Intelligence
Bättre än 27% av jämförda modeller
#91 av 125
59.4
AA Math
Bättre än 42% av jämförda modeller
#47 av 81
GPQA Diamond
82.2
Humanity's Last Exam
16.2
IFBench
77.2
Long-Context Recall
65.3
MMLU-Pro
62.4 index
SciCode
41.9
tau_banking
8.7
TerminalBench Hard
24.2
terminalbench_v2_1
31.1
τ²-Bench
31.3
Källa: artificialanalysis.ai

Så jämför den sig

Gemini 3.1 Flash Lite PreviewGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Input $/M$0.25$2.00$4.00$0.50
Output $/M$1.50$12.00$18.00$3.00
Kontext1.0M1.0M1.0M1.0M
Kvalitet6/1010/1010/109/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad är kostnaden per token för Google Gemini 3.1 Flash Lite Preview på OrcaRouter?
Modellen debiteras med $0.25 per 1 miljon inmatningstokens och $1.50 per 1 miljon utmatningstokens. Detta är den exakta leverantörsavgiften från Google; OrcaRouter lägger ingen påslag. Du debiteras endast för de tokens du använder.
Vad är längden på kontextfönstret?
Kontextfönstret är 1 048 576 tokens (ungefär 1 miljon tokens). Den maximala utdatalängden är 65 536 tokens. Detta gör att du kan bearbeta mycket långa dokument eller multimodala indata i en enda förfrågan.
Vilka är de främsta styrkorna hos denna modell?
Dess främsta styrkor är den mycket stora kontextfönstret, stöd för multimodal inmatning (text, bild, video, fil, ljud) och ett starkt GPQA Diamond benchmarkresultat på 82,2, vilket indikerar hög resonemangsförmåga. Den är även kostnadseffektiv för uppgifter med lång kontext.
Hur står sig det jämfört med GPT-4o mini?
GPT-4o mini har en 128K kontext och lägre priser ($0.15/$0.60 per M tokens). Gemini 3.1 Flash Lite Preview erbjuder 1M kontext, 65K utdata och liknande resonemangspoäng. Välj Gemini om du behöver mer kontext eller fil-/ljudinmatning; välj GPT-4o mini för kortkontext, uppgifter med lägre kostnad.
Hur hanteras data när man använder OrcaRouter?
OrcaRouter loggar eller lagrar inte dina uppmaningar eller slutföranden om du inte uttryckligen konfigurerar loggning. Data överförs säkert och bearbetas av Googles infrastruktur. Du bör granska OrcaRouters sekretesspolicy och Googles databehandlingsvillkor för fullständig information.
Kan jag anropa den här modellen med ett OpenAI-kompatibelt API?
Ja. Modellen nås via OrcaRouters OpenAI-kompatibla API vid bas-URL https://api.orcarouter.ai/v1 med modell-ID "google/gemini-3.1-flash-lite-preview". Standard OpenAI chatt-slutföringsparametrar stöds, inklusive multimodala innehållsarrayer.

Bädda in denna badge

Google: Gemini 3.1 Flash Lite Preview$0.25/M in1462ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.1-flash-lite-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.1-flash-lite-preview.svg" alt="Google: Gemini 3.1 Flash Lite Preview på OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.1 Flash Lite Preview](https://www.orcarouter.ai/embed/google/gemini-3.1-flash-lite-preview.svg)](https://www.orcarouter.ai/models/google/gemini-3.1-flash-lite-preview)

Modellkort som data

GET /api/public/models/google/gemini-3.1-flash-lite-previewÖppna