Gemma 4 26B A4B

google/gemma-4-26b-a4b-it
VisionVerktygJSONResonemang
av Google · 2026-04-03

Gemma 4 26B A4B IT är en instruktionstränad Mixture-of-Experts (MoE)-modell från Google DeepMind. Trots totalt 25.2B parametrar aktiveras endast 3.8B per token under inferens — levererar kvalitet nära 31B vid...

ctx262.1K tokens
Inmatningtext + image + video
Utdatatext
p50 TTFT10.00 s
INMATNING$0.06/ 1M token
UTDATA$0.33/ 1M token
p50 TTFT10.00 s7d
p95 TTFT10.00 s7d
TRAFIK369.1Ktokens/7d

Gemma 4 26B A4B är en Mixture-of-Experts-modell utvecklad av Google. Den har totalt 26 miljarder parametrar men endast 4 miljarder är aktiva per token – denna design minskar beräkningskostnaden…

Vad är Gemma 4 26B A4B?

Vem bör använda den här modellen?

Hur får jag åtkomst till Gemma 4 26B A4B via OrcaRouter?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemma-4-26b-a4b-it",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Priser

Inmatning / 1M token$0.060
Utdata / 1M tokens$0.330
Cacheläsning / 1M$0.0075
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $1.41 · Med promptcachning $1.23

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000166

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
10.00 s
Utdatahastighet
41.8 tok/s
p95 TTFT
10.00 s
Felfrekvens
0%

Offentliga benchmarks

39.3
AA Coding
Bättre än 43% av jämförda modeller
#69 av 123
25.7
AA Intelligence
Bättre än 30% av jämförda modeller
#86 av 125
70.5
AA Math
Bättre än 63% av jämförda modeller
#30 av 81
GPQA Diamond
79.2
Humanity's Last Exam
18.3
IFBench
72.4
Long-Context Recall
55.7
MMLU-Pro
73.5 index
SciCode
40.0
tau_banking
11.8
TerminalBench Hard
13.6
terminalbench_v2_1
39.0
τ²-Bench
43.6
Källa: artificialanalysis.ai

Så jämför den sig

Gemma 4 26B A4BGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Input $/M$0.06$2.00$4.00$0.50
Output $/M$0.33$12.00$18.00$3.00
Kontext262K1.0M1.0M1.0M
Kvalitet5/1010/1010/109/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Hur mycket kostar Gemma 4 26B A4B per token?
Indata-tokens kostar $0.06 per 1M tokens, utdata-tokens kostar $0.33 per 1M tokens. Dessa priser debiteras enligt leverantörens taxa utan något pålägg från OrcaRouter.
Vad är storleken på kontextfönstret?
Kontextfönstret är 262 144 tokens. Detta inkluderar text-, bild- och videotokens. Den effektiva längden du kan använda beror på det totala antalet tokens i din begäran.
Vilka är modellens främsta styrkor?
Styrkor inkluderar multimodal förståelse (text, bild, video), ett stort kontextfönster, MoE-effektivitet (26B totalt, 4B aktiv) och ett starkt GPQA Diamond-poäng på 79,2 för vetenskapligt resonerande.
Hur jämför det sig med Gemma 3 8B?
Gemma 4 har en större kontext (262k vs 128k), stödjer video och har ett högre GPQA-betyg. Den är mer kapabel för komplexa multimodala uppgifter men dyrare per token.
Stöder modellen videoinmatning?
Ja, den accepterar video via URL eller bildsekvenser. Du kan ange en videolänk i innehållsarrayen. Modellen bearbetar bildrutor och svarar på frågor om videon.
Hur anropar jag denna modell via OrcaRouter’s API?
Använd bas-URL https://api.orcarouter.ai/v1, modell-ID google/gemma-4-26b-a4b-it, och skicka en POST till /chat/completions med standard OpenAI-parametrar för text- eller multimodala indata.
Lägger OrcaRouter till något påslag på leverantörens prissättning?
Nej, OrcaRouter fakturerar till exakt leverantörens pris utan påslag. Du betalar $0.06/$0.33 per miljon tokens, samma som om du använde Google direkt.
Vilka datahanterings- eller integritetsöverväganden gäller?
Datahantering följer OrcaRouters användarvillkor och Googles modellspecifika integritetspolicy. OrcaRouter använder inte dina data för att träna sina modeller. Besök OrcaRouters integritetssida för mer information.
Kan jag använda den här modellen för realtidsapplikationer?
Ja, API:et stödjer streaming (stream=true). Latens beror dock på indatastorlek, hårdvara och samtidighet. Testa med ditt specifika användningsfall för att bedöma lämplighet för realtidsbehov.
Vilka är begränsningarna med den här modellen?
Begränsningar inkluderar: endast 4B aktiva parametrar per token, så uppgifter som kräver extremt resonemangsdjup kan prestera sämre än mycket större täta modeller. Det stöder inte ljudinmatning. Kostnaden kan vara hög för mycket långa videoinmatningar på grund av tokenanvändning.

Bädda in denna badge

Google: Gemma 4 26B A4B$0.06/M in10000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemma-4-26b-a4b-it" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemma-4-26b-a4b-it.svg" alt="Google: Gemma 4 26B A4B på OrcaRouter" /> </a>
Markdown [![Google: Gemma 4 26B A4B](https://www.orcarouter.ai/embed/google/gemma-4-26b-a4b-it.svg)](https://www.orcarouter.ai/models/google/gemma-4-26b-a4b-it)

Modellkort som data

GET /api/public/models/google/gemma-4-26b-a4b-itÖppna