Gemma 4 26B A4B

google/gemma-4-26b-a4b-it
VisieToolsJSONRedeneren
door Google · 2026-04-03

Gemma 4 26B A4B IT is een instructie-afgestemd Mixture-of-Experts (MoE) model van Google DeepMind. Ondanks 25.2B totale parameters, worden er tijdens inferentie slechts 3.8B per token geactiveerd — wat bijna 31B kwaliteit levert bij...

ctx262K tokens
Invoertext + image + video
Uitvoertext
p50 TTFT2.38 s
INPUT$0.06/ 1M tokens
OUTPUT$0.33/ 1M tokens
p50 TTFT2.38 s7d
p95 TTFT10.00 s7d
VERKEER7.3Mtokens / 7d

Gemma 4 26B A4B is een Mixture-of-Experts-model ontwikkeld door Google. Het heeft in totaal 26 miljard parameters, maar slechts 4 miljard zijn actief per token—dit ontwerp verlaagt de rekenkosten…

Wat is Gemma 4 26B A4B?

Wie zou dit model moeten gebruiken?

Hoe krijg ik toegang tot Gemma 4 26B A4B via OrcaRouter?

Codevoorbeelden

Aanroepen vanuit elke SDK

OpenAI-compatibel — behoud je huidige SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemma-4-26b-a4b-it",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Ondersteunde parameters

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Prijzen

Prijzen
Invoer / 1M tokens$0.060
Uitvoer / 1M tokens$0.330
Cache lezen / 1M$0.0075
ValutaUSD

Kostencalculator

Tokens / maand10MM
Invoeraandeel70%%
Geschat / maand $1.41 · Met prompt-caching $1.23

Schatting op basis van catalogusprijs

Token- en kostenschatter

Invoertokens: 20Kosten per verzoek: $0.000166

Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.

Prestaties

p50 TTFT
2.38 s
Outputsnelheid
66.8 tok/s
p95 TTFT
10.00 s
Foutpercentage
17.7%

Openbare benchmarks

39.3
AA Coding
Beter dan 39% van de vergeleken modellen
#83 van 138
16.7
AA Intelligence
Beter dan 25% van de vergeleken modellen
#109 van 147
70.5
AA Math
Beter dan 62% van de vergeleken modellen
#31 van 82
GPQA Diamond
79.2
Humanity's Last Exam
19.3
IFBench
72.4
Long-Context Recall
65.7
MMLU-Pro
73.5 index
SciCode
40.0
tau_banking
12.0
TerminalBench Hard
13.6
terminalbench_v2_1
39.0
τ²-Bench
43.6
Bron: artificialanalysis.ai

Community-buzz

Waar ontwikkelaars het deze week over hebben

Hacker News0 vermeldingen · 7 d

Vergelijking

Gemma 4 26B A4BGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Invoer $/M$0.06$2.00$4.00$0.50
Uitvoer $/M$0.33$12.00$18.00$3.00
Context262K1.0M1.0M1.0M
Kwaliteit5/1010/1010/109/10
Naast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijken

FAQ

Hoeveel kost Gemma 4 26B A4B per token?
Invoertokens kosten $0.06 per 1M tokens, uitvoertokens kosten $0.33 per 1M tokens. Deze tarieven worden gefactureerd tegen het tarief van de provider zonder opslag van OrcaRouter.
Wat is de grootte van het contextvenster?
Het contextvenster is 262,144 tokens. Dit omvat tekst-, afbeeldings- en videotokens. De effectieve lengte die u kunt gebruiken, hangt af van het totale aantal tokens in uw verzoek.
Wat zijn de belangrijkste sterke punten van het model?
Sterke punten zijn onder andere multimodaal begrip (tekst, afbeelding, video), een groot contextvenster, MoE-efficiëntie (26B totaal, 4B actief) en een sterke GPQA Diamond-score van 79.2 voor wetenschappelijk redeneren.
Hoe verhoudt het zich tot Gemma 3 8B?
Gemma 4 heeft een grotere context (262k vs 128k), ondersteunt video, en heeft een hogere GPQA-score. Het is capabeler voor complexe multimodale taken, maar duurder per token.
Ondersteunt het model video-invoer?
Ja, het accepteert video via URL of beeldreeksen. Je kunt een video-URL opgeven in de content-array. Het model verwerkt frames en beantwoordt vragen over de video.
Hoe roep ik dit model aan via OrcaRouter's API?
Gebruik basis-URL https://api.orcarouter.ai/v1, model-ID google/gemma-4-26b-a4b-it, en stuur een POST naar /chat/completions met standaard OpenAI-parameters voor tekst of multimodale invoer.
Voegt OrcaRouter enige markup toe aan de prijsstelling van de provider?
Nee, OrcaRouter factureert tegen het exacte tarief van de aanbieder zonder opslag. U betaalt $0,06/$0,33 per miljoen tokens, hetzelfde als wanneer u Google rechtstreeks gebruikt.
Welke gegevensverwerking of privacyoverwegingen zijn van toepassing?
Gegevensverwerking volgt de servicevoorwaarden van OrcaRouter en het modelspecifieke privacybeleid van Google. OrcaRouter gebruikt uw gegevens niet voor het trainen van zijn modellen. Raadpleeg de privacy-pagina van OrcaRouter voor meer details.
Kan ik dit model gebruiken voor real-time toepassingen?
Ja, de API ondersteunt streaming (stream=true). Echter, latentie hangt af van invoergrootte, hardware en gelijktijdigheid. Test met uw specifieke gebruikssituatie om de geschiktheid voor real-time behoeften te beoordelen.
Wat zijn de beperkingen van dit model?
Beperkingen zijn onder andere: slechts 4B actieve parameters per token, dus taken die extreme redeneerdiepte vereisen kunnen slechter presteren dan veel grotere dichte modellen. Het ondersteunt geen audio-invoer. De kosten kunnen hoog zijn voor zeer lange video-invoer vanwege het tokenverbruik.

Sluit deze badge in

Google: Gemma 4 26B A4B•$0.06/M in•2384ms p50•via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemma-4-26b-a4b-it" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemma-4-26b-a4b-it.svg" alt="Google: Gemma 4 26B A4B op OrcaRouter" /> </a>
Markdown [![Google: Gemma 4 26B A4B](https://www.orcarouter.ai/embed/google/gemma-4-26b-a4b-it.svg)](https://www.orcarouter.ai/models/google/gemma-4-26b-a4b-it)

Modelkaart als data

GET /api/public/models/google/gemma-4-26b-a4b-itOpenen
Machineleesbaar:/llms.txt/llms-full.txt