Gemma 4 26B A4B

obsidian/gemma-4-26B-A4B
ראייהכליםJSONהיגיון
מאת obsidian · 2026-07-02

Gemma 4 26B A4B הוא מבנה תמהיל מומחים של משפחת Gemma 4 של גוגל (26B פרמטרים בסך הכול, כ-4B פעילים לכל טוקן) עם חלון הקשר של 262K טוקנים וקלט טקסט + תמונה. הוא שומר על יכולות החשיבה, הביצועים הרב-לשוניים וההבנה המולטי-מודאלית של המודל הבסיסי. גרסת ה-Balanced מומלצת לרוב עומסי העבודה: דגימה עקבית, התנהגות יציבה בהקשרים ארוכים, והפחתת סטייה מהנושא בשיחות ממושכות. המודל עשוי מדי פעם לנסח את החשיבה שלו בקצרה לפני מתן התשובה המלאה. הוא מתאים במיוחד לכתיבה יצירתית, משחק תפקידים, עוזרים רב-לשוניים, חשיבה בהקשרים ארוכים ויישומי בינה מלאכותית לשימוש כללי שבהם איכות, קוהרנטיות ואמינות הם העדיפויות המרכזיות.

מתאים ביותר עבור:reasoningvision
נקודות קצה:/v1/chat/completions
הקשר262K tokens
קלטtext + image
פלטtext
מתאים ביותר עבורreasoning, vision
p50 TTFT1.88 s
קלט$0.25/ 1M טוקנים
פלט$2.90/ 1M טוקנים
p50 TTFT1.88 s7 ימים
p95 TTFT10.00 s7 ימים
תעבורה2.5Mטוקנים / 7 ימים

דוגמאות קוד

קריאה מכל SDK

תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="obsidian/gemma-4-26B-A4B",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

פרמטרים נתמכים

  • include_reasoning
  • reasoning
  • max_tokens
  • temperature
  • top_p
  • top_k
  • min_p
  • presence_penalty
  • frequency_penalty
  • stop
  • seed
  • response_format
  • structured_outputs
  • tools
  • tool_choice

תמחור

תמחור
קלט / 1M טוקנים$0.250
פלט / 1M tokens$2.90
מטבעUSD

מחשבון עלות

טוקנים / חודש10MM
נתח קלט70%%
מוערך / חודש $10.45

הערכה מבוססת מחיר מחירון

מחשבון טוקנים ועלות

טוקני קלט: 12עלות לבקשה: $0.001453

הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.

ביצועים

p50 TTFT
1.88 s
מהירות פלט
97.5 tok/s
p95 TTFT
10.00 s
שיעור שגיאות
22.5%

מבחני ביצועים ציבוריים

39.3
AA Coding
טוב יותר מ-39% מהמודלים שהושוו
#83 מתוך 138
16.7
AA Intelligence
טוב יותר מ-26% מהמודלים שהושוו
#103 מתוך 141
GPQA Diamond
79.2
Humanity's Last Exam
19.3
IFBench
72.4
Long-Context Recall
65.7
SciCode
40.0
tau_banking
12.0
TerminalBench Hard
13.6
terminalbench_v2_1
39.0
τ²-Bench
43.6
מקור: artificialanalysis.ai

באזז קהילתי

על מה מפתחים מדברים השבוע

Hacker News0 אזכורים · 7 ימיםירידה של 1 מול השבוע הקודם

איך זה משתווה

Gemma 4 26B A4BQwen3.6 35B A3BQwen3.8 27B
קלט $/מיליון$0.25$0.31$0.40
פלט $/מיליון$2.90$4.21$4.21
הקשר262K262K262K
איכות4/104/104/10
השוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זו

שאלות נפוצות

כמה עולה Gemma 4 26B A4B ב-OrcaRouter?
Gemma 4 26B A4B מתומחר ב-$0.25 לכל 1M טוקני קלט ו-$2.90 לכל 1M טוקני פלט דרך OrcaRouter. התמחור נמשך בזמן אמת משכבת הניתוב.
מהו חלון ההקשר של Gemma 4 26B A4B?
Gemma 4 26B A4B תומך בחלון הקשר של 262K טוקנים. השתמש בתכונות הקשר ארוך (RAG, סיכום) עד לגבול זה.
איך אני קורא ל-Gemma 4 26B A4B דרך OpenAI SDK?
הגדר את base_url של OpenAI ל-https://api.orcarouter.ai/v1, ספק את מפתח ה-API של OrcaRouter שלך, והעבר את model="obsidian/gemma-4-26B-A4B" בקריאה ל-chat.completions.create.
האם OrcaRouter מגביל קצב ל-Gemma 4 26B A4B?
מגבלות קצב לפי מודל עוקבות אחרי תוכנית OrcaRouter שלך. רמות חינמיות מגיעות עם מגבלות שמרניות; רמות בתשלום מסירות אותן. בדוק /pricing עבור המכסות הנוכחיות.

הטמעת התג הזה

Gemma 4 26B A4B$0.25/M in1876ms p50דרך OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/obsidian/gemma-4-26B-A4B" target="_blank"> <img src="https://www.orcarouter.ai/embed/obsidian/gemma-4-26B-A4B.svg" alt="Gemma 4 26B A4B ב-OrcaRouter" /> </a>
Markdown [![Gemma 4 26B A4B](https://www.orcarouter.ai/embed/obsidian/gemma-4-26B-A4B.svg)](https://www.orcarouter.ai/models/obsidian/gemma-4-26B-A4B)

כרטיס מודל כנתונים

GET /api/public/models/obsidian/gemma-4-26B-A4Bפתיחה
קריא למכונה:/llms.txt/llms-full.txt