Gemma 4 26B A4B

obsidian/gemma-4-26B-A4B
비전도구JSON추론
제공 obsidian · 2026-07-02

Gemma 4 26B A4B는 Google Gemma 4 제품군의 mixture-of-experts 빌드로, 총 26B 파라미터(토큰당 약 4B 활성)와 262K-토큰 컨텍스트 창, 텍스트 + 이미지 입력을 지원합니다. 기본 모델의 추론 능력, 다국어 성능, 멀티모달 이해력을 그대로 유지합니다. Balanced 변형은 대부분의 워크로드에 권장됩니다: 일관된 샘플링, 안정적인 장기 컨텍스트 동작, 그리고 긴 대화 전반에 걸친 주제 이탈 감소를 제공합니다. 이 모델은 전체 응답을 제공하기 전에 간혹 추론 과정을 간략히 제시할 수 있습니다. 품질, 일관성, 신뢰성이 최우선인 창작 글쓰기, 롤플레이, 다국어 어시스턴트, 장기 컨텍스트 추론, 범용 AI 애플리케이션에 적합합니다.

추천 용도:reasoningvision
엔드포인트:/v1/chat/completions
컨텍스트262K 토큰
입력text + image
출력text
추천 용도reasoning, vision
p50 TTFT1.84 s
입력$0.25/ 100만 토큰
출력$2.90/ 100만 토큰
p50 TTFT1.84 s7일
p95 TTFT10.00 s7일
트래픽2.4M토큰 / 7일

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="obsidian/gemma-4-26B-A4B",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • include_reasoning
  • reasoning
  • max_tokens
  • temperature
  • top_p
  • top_k
  • min_p
  • presence_penalty
  • frequency_penalty
  • stop
  • seed
  • response_format
  • structured_outputs
  • tools
  • tool_choice

가격

가격
입력 / 1M tokens$0.250
출력 / 1M tokens$2.90
통화USD

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $10.45

정가 기준 추정치

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.001452

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
1.84 s
출력 속도
96.2 tok/s
p95 TTFT
10.00 s
오류율
22.9%

공개 벤치마크

39.3
AA Coding
비교된 모델 중 39%보다 우수
138개 중 83위
16.7
AA Intelligence
비교된 모델 중 26%보다 우수
141개 중 103위
GPQA Diamond
79.2
Humanity's Last Exam
19.3
IFBench
72.4
Long-Context Recall
65.7
SciCode
40.0
tau_banking
12.0
TerminalBench Hard
13.6
terminalbench_v2_1
39.0
τ²-Bench
43.6
소스: artificialanalysis.ai

커뮤니티 화제

이번 주 개발자들의 이야기

Hacker News0 회 언급 · 7일지난주 대비 1 감소

비교

Gemma 4 26B A4BQwen3.6 35B A3BQwen3.8 27B
입력 $/100만$0.25$0.31$0.40
출력 $/100만$2.90$4.21$4.21
컨텍스트262K262K262K
품질4/104/104/10
나란히 비교나란히 비교나란히 비교

FAQ

OrcaRouter에서 Gemma 4 26B A4B 비용은 얼마인가요?
Gemma 4 26B A4B는 OrcaRouter를 통해 1M 입력 토큰당 $0.25, 1M 출력 토큰당 $2.90에 가격이 책정되어 있습니다. 가격은 라우팅 레이어에서 실시간으로 가져옵니다.
Gemma 4 26B A4B의 컨텍스트 윈도우는 얼마인가요?
Gemma 4 26B A4B는 262K 토큰의 컨텍스트 윈도우를 지원합니다. 해당 제한까지 롱 컨텍스트 기능(RAG, 요약)을 사용하세요.
OpenAI SDK를 통해 Gemma 4 26B A4B를 호출하려면 어떻게 하나요?
OpenAI base_url을 https://api.orcarouter.ai/v1로 설정하고, OrcaRouter API 키를 제공한 후, chat.completions.create 호출에서 model="obsidian/gemma-4-26B-A4B"를 전달하세요.
OrcaRouter가 Gemma 4 26B A4B를 속도 제한합니까?
모델별 속도 제한은 OrcaRouter 플랜을 따릅니다. 무료 티어는 보수적인 한도로 제공되며, 유료 티어는 한도를 높입니다. 현재 할당량은 /pricing에서 확인하세요.

이 배지 임베드

Gemma 4 26B A4B$0.25/M in1841ms p50OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/obsidian/gemma-4-26B-A4B" target="_blank"> <img src="https://www.orcarouter.ai/embed/obsidian/gemma-4-26B-A4B.svg" alt="OrcaRouter 의 Gemma 4 26B A4B" /> </a>
Markdown [![Gemma 4 26B A4B](https://www.orcarouter.ai/embed/obsidian/gemma-4-26B-A4B.svg)](https://www.orcarouter.ai/models/obsidian/gemma-4-26B-A4B)

모델 카드를 데이터로

GET /api/public/models/obsidian/gemma-4-26B-A4B열기
기계 판독 가능:/llms.txt/llms-full.txt