Gemma 4 26B A4B

google/gemma-4-26b-a4b-it
VisiAlatJSONPenalaran
oleh Google · 2026-04-03

Gemma 4 26B A4B IT adalah model Mixture-of-Experts (MoE) yang disesuaikan dengan instruksi dari Google DeepMind. Meskipun memiliki 25.2B total parameter, hanya 3.8B yang aktif per token selama inferensi — memberikan kualitas mendekati 31B pada...

ctx262K token
Masukantext + image + video
Keluarantext
p50 TTFT2.38 s
INPUT$0.06/ 1M token
OUTPUT$0.33/ 1M token
p50 TTFT2.38 s7h
p95 TTFT10.00 s7h
LALU LINTAS7.3Mtoken / 7h

Gemma 4 26B A4B adalah model Campuran Ahli (Mixture-of-Experts) yang dikembangkan oleh Google. Model ini memiliki total 26 miliar parameter, tetapi hanya 4 miliar yang aktif per token—desain ini…

Apa itu Gemma 4 26B A4B?

Siapa yang harus menggunakan model ini?

Bagaimana cara mengakses Gemma 4 26B A4B melalui OrcaRouter?

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemma-4-26b-a4b-it",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Harga

Harga
Input / 1M token$0.060
Output / 1M token$0.330
Baca cache / 1M$0.0075
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $1.41 · Dengan cache prompt $1.23

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.000166

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
2.38 s
Kecepatan output
66.8 tok/s
p95 TTFT
10.00 s
Tingkat kesalahan
17.7%

Benchmark publik

39.3
AA Coding
Lebih baik dari 39% model yang dibandingkan
#83 dari 138
16.7
AA Intelligence
Lebih baik dari 25% model yang dibandingkan
#109 dari 147
70.5
AA Math
Lebih baik dari 62% model yang dibandingkan
#31 dari 82
GPQA Diamond
79.2
Humanity's Last Exam
19.3
IFBench
72.4
Long-Context Recall
65.7
MMLU-Pro
73.5 index
SciCode
40.0
tau_banking
12.0
TerminalBench Hard
13.6
terminalbench_v2_1
39.0
τ²-Bench
43.6
Sumber: artificialanalysis.ai

Perbincangan komunitas

Yang dibicarakan developer minggu ini

Hacker News0 sebutan · 7 hr

Perbandingan

Gemma 4 26B A4BGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Input $/M$0.06$2.00$4.00$0.50
Output $/M$0.33$12.00$18.00$3.00
Konteks262K1.0M1.0M1.0M
Kualitas5/1010/1010/109/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa biaya Gemma 4 26B A4B per token?
Biaya token input adalah $0.06 per 1M token, biaya token output adalah $0.33 per 1M token. Tarif ini ditagih berdasarkan tarif penyedia tanpa markup dari OrcaRouter.
Berapa ukuran jendela konteksnya?
Jendela konteks adalah 262.144 token. Ini mencakup token teks, gambar, dan video. Panjang efektif yang dapat Anda gunakan tergantung pada total token dalam permintaan Anda.
Apa kekuatan utama model ini?
Kekuatan termasuk pemahaman multimodal (teks, gambar, video), jendela konteks besar, efisiensi MoE (total 26B, 4B aktif), dan skor GPQA Diamond yang kuat sebesar 79.2 untuk penalaran ilmiah.
Bagaimana perbandingannya dengan Gemma 3 8B?
Gemma 4 memiliki konteks yang lebih besar (262k vs 128k), mendukung video, dan memiliki skor GPQA yang lebih tinggi. Ia lebih mampu untuk tugas multimodal yang kompleks tetapi lebih mahal per token.
Apakah model mendukung input video?
Ya, ini menerima video melalui URL atau urutan gambar. Anda dapat memberikan URL video di dalam array konten. Model akan memproses bingkai-bingkai dan menjawab pertanyaan-pertanyaan tentang video tersebut.
Bagaimana cara memanggil model ini melalui API OrcaRouter?
Gunakan base URL https://api.orcarouter.ai/v1, model ID google/gemma-4-26b-a4b-it, dan kirimkan POST ke /chat/completions dengan parameter OpenAI standar untuk input teks atau multimodal.
Apakah OrcaRouter menambahkan markup pada harga penyedia?
Tidak, OrcaRouter menagih dengan tarif penyedia yang tepat tanpa markup. Anda membayar $0.06/$0.33 per juta token, sama seperti jika Anda menggunakan Google secara langsung.
Pertimbangan penanganan data atau privasi apa yang berlaku?
Penanganan data mengikuti ketentuan layanan OrcaRouter dan kebijakan privasi khusus model Google. OrcaRouter tidak menggunakan data Anda untuk melatih modelnya. Periksa halaman privasi OrcaRouter untuk detail lebih lanjut.
Bisakah saya menggunakan model ini untuk aplikasi real-time?
Ya, API mendukung streaming (stream=true). Namun, latensi tergantung pada ukuran input, perangkat keras, dan konkurensi. Uji dengan kasus penggunaan spesifik Anda untuk menilai kesesuaian dengan kebutuhan waktu nyata.
Apa keterbatasan model ini?
Keterbatasan meliputi: hanya 4 miliar parameter aktif per token, sehingga tugas yang memerlukan kedalaman penalaran ekstrem mungkin berkinerja lebih buruk daripada model padat yang jauh lebih besar. Ini tidak mendukung input audio. Biaya bisa tinggi untuk input video yang sangat panjang karena penggunaan token.

Sematkan lencana ini

Google: Gemma 4 26B A4B•$0.06/M in•2384ms p50•via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemma-4-26b-a4b-it" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemma-4-26b-a4b-it.svg" alt="Google: Gemma 4 26B A4B di OrcaRouter" /> </a>
Markdown [![Google: Gemma 4 26B A4B](https://www.orcarouter.ai/embed/google/gemma-4-26b-a4b-it.svg)](https://www.orcarouter.ai/models/google/gemma-4-26b-a4b-it)

Kartu model sebagai data

GET /api/public/models/google/gemma-4-26b-a4b-itBuka