Gemma 4 31B

google/gemma-4-31b-it
av Google · 2026-04-02

Gemma 4 31B Instruct är Google DeepMinds 30,7B täta multimodala modell som stödjer text- och bildinmatning med textutmatning. Har ett kontextfönster på 256K tokens, konfigurerbart tanke-/resonemangsläge, inbyggd funktion...

p50 TTFT1.22 s
INMATNING$0.13/ 1M token
UTDATA$0.38/ 1M token
p50 TTFT1.22 s7d
p95 TTFT3.84 s7d
TRAFIK74.4Ktokens/7d

Google Gemma 4 31B är en instruktionsjusterad variant av Gemma 4-familjen, utvecklad av Google. Den har cirka 31 miljarder parametrar och är optimerad för chatt- och instruktionsföljningsuppgifter.…

Vad exakt är Google Gemma 4 31B?

Vem bör använda den här modellen?

Hur levererar OrcaRouter denna modell?

Vad är betydelsen av GPQA Diamond-poängen?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemma-4-31b-it",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Priser

Priser
Inmatning / 1M token$0.130
Utdata / 1M tokens$0.380
Cacheläsning / 1M$0.020
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $2.05 · Med promptcachning $1.67

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000192

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
1.22 s
Utdatahastighet
36.7 tok/s
p95 TTFT
3.84 s
Felfrekvens
67.3%

Offentliga benchmarks

43.4
AA Coding
Bättre än 45% av jämförda modeller
#76 av 138
14.7
AA Intelligence
Bättre än 20% av jämförda modeller
#117 av 147
65.9
AA Math
Bättre än 54% av jämförda modeller
#38 av 82
GPQA Diamond
85.7
Humanity's Last Exam
23.6
IFBench
75.6
Long-Context Recall
69.7
MMLU-Pro
72.9 index
SciCode
45.5
tau_banking
14.8
TerminalBench Hard
36.4
terminalbench_v2_1
43.4
τ²-Bench
59.9
Källa: artificialanalysis.ai

Community-buzz

Vad utvecklare säger den här veckan

Hacker News0 omnämnanden · 7d

Så jämför den sig

Gemma 4 31BGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Input $/M$0.13$2.00$4.00$0.50
Output $/M$0.38$12.00$18.00$3.00
Kontext—1.0M1.0M1.0M
Kvalitet—10/1010/109/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad är kostnaden per token för Gemma 4 31B via OrcaRouter?
Inmatningstokens kostar $0,13 per 1 miljon tokens, och utmatningstokens kostar $0,38 per 1 miljon tokens. Det finns inget påslag; detta är det exakta leverantörspriset.
Vad är kontextfönstrets storlek för Gemma 4 31B?
Kontextfönstrets storlek anges inte i den givna informationen. Se Googles officiella dokumentation för det exakta maximala tokenantalet.
Vilka är de främsta styrkorna hos Gemma 4 31B?
Baserat på den angivna fakta uppnår den ett GPQA Diamond-poäng på 85.7%, vilket indikerar stark resonemangsförmåga på forskarnivå. Den är också effektivt prissatt för en modell med 31B parametrar.
Hur jämför sig Gemma 4 31B med andra modeller av liknande storlek?
Inga direkta riktmärken mot andra modeller tillhandahålls. Dock indikerar dess GPQA-poäng att den är konkurrenskraftig för expertfrågebesvarande. Användare bör testa på sina egna uppgifter.
Vilka datahanteringsmetoder följer OrcaRouter?
OrcaRouter's datahantering beskrivs inte i detalj i de angivna fakta. För integritets- och datalagringspolicyer, konsultera OrcaRouter's användarvillkor och integritetspolicy.
Hur kan jag anropa Gemma 4 31B med OpenAI SDK?
Ställ in bas-URL:en till https://api.orcarouter.ai/v1, använd din OrcaRouter API-nyckel och ange modell-ID "google/gemma-4-31b-it". SDK:ns chat completion-metod fungerar direkt.
Finns det någon cachning eller rabatt för upprepade tokens?
Inga cachnings- eller volymrabatter nämns i de angivna fakta. Kontrollera OrcaRouters dokumentation för eventuella kostnadsoptimeringsfunktioner.
Varför skulle jag välja Gemma 4 9B framför denna 31B-modell?
Om dina uppgifter är enkla och inte kräver den starka resonemangsförmåga som mäts av GPQA Diamond, är 9B-modellen billigare och snabbare. 31B-modellen är bäst för komplex instruktionsföljning och expertfrågor.
Stöder OrcaRouter streaming-svar för denna modell?
Ja, OrcaRouters OpenAI-kompatibla API stöder strömning (ställ in stream=True i begäran). Detta fungerar på samma sätt som med OpenAI-modeller.

Bädda in denna badge

Google: Gemma 4 31B•$0.13/M in•1222ms p50•via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemma-4-31b-it" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemma-4-31b-it.svg" alt="Google: Gemma 4 31B på OrcaRouter" /> </a>
Markdown [![Google: Gemma 4 31B](https://www.orcarouter.ai/embed/google/gemma-4-31b-it.svg)](https://www.orcarouter.ai/models/google/gemma-4-31b-it)

Modellkort som data

GET /api/public/models/google/gemma-4-31b-itÖppna