Gemma 4 26B A4B ist eine Mixture-of-Experts-Variante der Google-Gemma-4-Familie (insgesamt 26B Parameter, etwa 4B aktive pro Token) mit einem Kontextfenster von 262K-Token sowie Text- und Bildeingabe. Sie bewahrt die Denkfähigkeit, mehrsprachige Leistung und das multimodale Verständnis des Basismodells. Die Balanced-Variante wird für die meisten Arbeitslasten empfohlen: konsistentes Sampling, stabiles Long-Context-Verhalten und reduzierte Themenabdrift über längere Unterhaltungen. Das Modell kann gelegentlich seine Überlegungen kurz umreißen, bevor es die vollständige Antwort liefert. Gut geeignet für kreatives Schreiben, Rollenspiele, mehrsprachige Assistenten, Long-Context-Schlussfolgerungen und allgemeine KI-Anwendungen, bei denen Qualität, Kohärenz und Zuverlässigkeit die obersten Prioritäten sind.
OpenAI-kompatibel — behalte dein bisheriges SDK
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="obsidian/gemma-4-26B-A4B",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)include_reasoningreasoningmax_tokenstemperaturetop_ptop_kmin_ppresence_penaltyfrequency_penaltystopseedresponse_formatstructured_outputstoolstool_choice| Eingabe / 1M Tokens | $0.250 |
|---|---|
| Ausgabe / 1M Tokens | $2.90 |
| Währung | USD |
Schätzung auf Basis des Listenpreises
Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.
Worüber Entwickler diese Woche sprechen
GET /api/public/models/obsidian/gemma-4-26B-A4BÖffnen @misc{orcarouter_gemma_4_26b_a4b,
title = {Gemma 4 26B A4B API},
author = {obsidian},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/obsidian/gemma-4-26B-A4B}
}obsidian. (2026). Gemma 4 26B A4B API. OrcaRouter. https://www.orcarouter.ai/models/obsidian/gemma-4-26B-A4B