Gemma 4 31B

google/gemma-4-31b-it
av Google · 2026-04-02

Gemma 4 31B Instruct är Google DeepMinds 30,7B täta multimodala modell som stödjer text- och bildinmatning med textutmatning. Har ett kontextfönster på 256K tokens, konfigurerbart tanke-/resonemangsläge, inbyggd funktion...

p50 TTFT8.25 s
INMATNING$0.13/ 1M token
UTDATA$0.38/ 1M token
p50 TTFT8.25 s7d
p95 TTFT10.00 s7d
TRAFIK73.0Mtokens/7d

Google Gemma 4 31B är en instruktionsjusterad variant av Gemma 4-familjen, utvecklad av Google. Den har cirka 31 miljarder parametrar och är optimerad för chatt- och instruktionsföljningsuppgifter.…

Vad exakt är Google Gemma 4 31B?

Vem bör använda den här modellen?

Hur levererar OrcaRouter denna modell?

Vad är betydelsen av GPQA Diamond-poängen?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemma-4-31b-it",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Priser

Inmatning / 1M token$0.130
Utdata / 1M tokens$0.380
Cacheläsning / 1M$0.020
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $2.05 · Med promptcachning $1.67

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000192

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
8.25 s
Utdatahastighet
92.9 tok/s
p95 TTFT
10.00 s
Felfrekvens
3.8%

Offentliga benchmarks

43.4
AA Coding
Bättre än 50% av jämförda modeller
#62 av 123
29.4
AA Intelligence
Bättre än 37% av jämförda modeller
#79 av 125
65.9
AA Math
Bättre än 54% av jämförda modeller
#37 av 81
GPQA Diamond
85.7
Humanity's Last Exam
22.7
IFBench
75.6
Long-Context Recall
62.0
MMLU-Pro
72.9 index
SciCode
43.4
tau_banking
15.1
TerminalBench Hard
36.4
terminalbench_v2_1
43.4
τ²-Bench
59.9
Källa: artificialanalysis.ai

Så jämför den sig

Gemma 4 31BGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Input $/M$0.13$2.00$4.00$0.50
Output $/M$0.38$12.00$18.00$3.00
Kontext1.0M1.0M1.0M
Kvalitet10/1010/109/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad är kostnaden per token för Gemma 4 31B via OrcaRouter?
Inmatningstokens kostar $0,13 per 1 miljon tokens, och utmatningstokens kostar $0,38 per 1 miljon tokens. Det finns inget påslag; detta är det exakta leverantörspriset.
Vad är kontextfönstrets storlek för Gemma 4 31B?
Kontextfönstrets storlek anges inte i den givna informationen. Se Googles officiella dokumentation för det exakta maximala tokenantalet.
Vilka är de främsta styrkorna hos Gemma 4 31B?
Baserat på den angivna fakta uppnår den ett GPQA Diamond-poäng på 85.7%, vilket indikerar stark resonemangsförmåga på forskarnivå. Den är också effektivt prissatt för en modell med 31B parametrar.
Hur jämför sig Gemma 4 31B med andra modeller av liknande storlek?
Inga direkta riktmärken mot andra modeller tillhandahålls. Dock indikerar dess GPQA-poäng att den är konkurrenskraftig för expertfrågebesvarande. Användare bör testa på sina egna uppgifter.
Vilka datahanteringsmetoder följer OrcaRouter?
OrcaRouter's datahantering beskrivs inte i detalj i de angivna fakta. För integritets- och datalagringspolicyer, konsultera OrcaRouter's användarvillkor och integritetspolicy.
Hur kan jag anropa Gemma 4 31B med OpenAI SDK?
Ställ in bas-URL:en till https://api.orcarouter.ai/v1, använd din OrcaRouter API-nyckel och ange modell-ID "google/gemma-4-31b-it". SDK:ns chat completion-metod fungerar direkt.
Finns det någon cachning eller rabatt för upprepade tokens?
Inga cachnings- eller volymrabatter nämns i de angivna fakta. Kontrollera OrcaRouters dokumentation för eventuella kostnadsoptimeringsfunktioner.
Varför skulle jag välja Gemma 4 9B framför denna 31B-modell?
Om dina uppgifter är enkla och inte kräver den starka resonemangsförmåga som mäts av GPQA Diamond, är 9B-modellen billigare och snabbare. 31B-modellen är bäst för komplex instruktionsföljning och expertfrågor.
Stöder OrcaRouter streaming-svar för denna modell?
Ja, OrcaRouters OpenAI-kompatibla API stöder strömning (ställ in stream=True i begäran). Detta fungerar på samma sätt som med OpenAI-modeller.

Bädda in denna badge

Google: Gemma 4 31B$0.13/M in8246ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemma-4-31b-it" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemma-4-31b-it.svg" alt="Google: Gemma 4 31B på OrcaRouter" /> </a>
Markdown [![Google: Gemma 4 31B](https://www.orcarouter.ai/embed/google/gemma-4-31b-it.svg)](https://www.orcarouter.ai/models/google/gemma-4-31b-it)

Modellkort som data

GET /api/public/models/google/gemma-4-31b-itÖppna