GLM 4.5 Air

z-ai/glm-4.5-air
VerktygJSONResonemang
av Z.ai · 2025-07-25

Kompakt MoE-syskon till GLM-4.5: 106B totalt / 12B aktiv. Samma hybrid-resonemangs- och verktygsanropsstack anpassad för hög genomströmning, låg kostnad inferens. 128K kontext.

ctx128K tokens
Max output96K
Inmatningtext
Utdatatext
p50 TTFT1.06 s
INMATNING$0.20/ 1M token
UTDATA$1.10/ 1M token
p50 TTFT1.06 s7d
p95 TTFT9.40 s7d
TRAFIK6.4Mtokens/7d

GLM 4.5 Air är en textgenererande språkmodell utvecklad av Z.ai. Den erbjuder ett kontextfönster på 128 000 tokens och kan generera upp till 96 000 tokens i ett enda svar. Modellen är optimerad för…

Vad är GLM 4.5 Air?

Vem bör använda GLM 4.5 Air?

Vilka modaliteter stöder GLM 4.5 Air?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="z-ai/glm-4.5-air",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • do_sample
  • include_reasoning
  • max_tokens
  • reasoning
  • request_id
  • response_format
  • stop
  • stream
  • temperature
  • thinking
  • tool_choice
  • tool_stream
  • tools
  • top_p
  • user_id

Priser

Inmatning / 1M token$0.200
Utdata / 1M tokens$1.10
Cacheläsning / 1M$0.030
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $4.70 · Med promptcachning $4.11

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000554

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
1.06 s
Utdatahastighet
74.0 tok/s
p95 TTFT
9.40 s
Felfrekvens
18.3%

Offentliga benchmarks

23.8
AA Coding
Bättre än 23% av jämförda modeller
#102 av 133
16.7
AA Intelligence
Bättre än 16% av jämförda modeller
#113 av 135
80.7
AA Math
Bättre än 70% av jämförda modeller
#24 av 82
AIME
67.3
AIME 2025
80.7
GPQA Diamond
73.3
Humanity's Last Exam
7.0
IFBench
37.6
LiveCodeBench
68.4
Long-Context Recall
45.7
MATH-500
96.5
MMLU-Pro
81.5
SciCode
30.6
TerminalBench Hard
20.5
τ²-Bench
46.5
Källa: artificialanalysis.ai

Community-buzz

Vad utvecklare säger den här veckan

Hacker News0 omnämnanden · 7d

Så jämför den sig

GLM 4.5 AirGLM 5.1GLM 5.2GLM 5.3
Input $/M$0.20$1.40$1.40$1.26
Output $/M$1.10$4.40$4.40$3.96
Kontext128K200K1.0M1.0M
Kvalitet6/109/109/109/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad är kostnaden för att använda GLM 4.5 Air på OrcaRouter?
Kostnaden är $0,20 per 1 miljon inmatningstoken och $1,10 per 1 miljon utmatningstoken. Detta debiteras enligt leverantörens taxa med noll påslag på OrcaRouter. Inga ytterligare plattformsavgifter tillkommer.
Vad är kontextfönstrets storlek för GLM 4.5 Air?
Kontextfönstret är 128 000 tokens. Den maximala utmatningen är 96 000 tokens per svar. Både inmatnings- och utmatningstokens räknas mot den totala kontextgränsen.
Vilka är de främsta styrkorna hos GLM 4.5 Air?
Den uppnår en poäng på 96.5 på MATH-500 benchmark, vilket indikerar stark matematisk resonemangsförmåga. Den erbjuder också ett stort kontextfönster och hög utmatningsgräns, vilket gör den lämplig för långformsgenerering och dokumentbehandling.
Hur jämför sig GLM 4.5 Air med andra GLM-4-modeller?
GLM 4.5 Air är en optimerad variant av GLM-4-serien. Specifika skillnader i prestanda eller hastighet anges inte, men beteckningen "Air" innebär vanligtvis en balans mellan effektivitet och kapacitet. Se OrcaRouters katalog för andra detaljer om GLM-4-modeller.
Stödjer GLM 4.5 Air bild- eller ljudinmatningar?
Nej. Det är en textbaserad modell. Den accepterar endast textinmatning och genererar textutdata. Den kan inte bearbeta bilder, ljud eller video.
Hur anropar jag GLM 4.5 Air via OrcaRouter API?
Skicka förfrågningar till https://api.orcarouter.ai/v1 med modell-ID "z-ai/glm-4.5-air". Använd ett standard OpenAI-kompatibelt chat completion-format med din API-nyckel. Parametrar som stöds inkluderar temperature, max_tokens, top_p, stop och streaming.
Är GLM 4.5 Air lämplig för realtidsapplikationer?
Latens beror på in-/utgångslängd och serverbelastning. Även om den snabbt kan generera korta svar, kommer det att ta längre tid att generera maximalt 96 000 tokens. Testa under förväntad belastning för att avgöra om hastigheten uppfyller dina krav.
Vilka policyer för datahantering gäller när man använder GLM 4.5 Air via OrcaRouter?
Datahantering regleras av OrcaRouters integritetspolicy och användarvillkor. Som en värdbaserad API kan data komma att behandlas på tredjepartsservrar. Z.ai och OrcaRouter kan ha specifika datalagringsrutiner. Granska plattformens datahanteringsavtal för detaljer.
Kan jag använda GLM 4.5 Air gratis?
OrcaRouter kräver troligen en betald prenumeration eller pay-as-you-go-krediter. Ingen gratisnivå nämns. Kolla OrcaRouters prissida för eventuella testkrediter eller kampanjerbjudanden.
Hur migrerar jag från OpenAIs API till GLM 4.5 Air på OrcaRouter?
Ändra din bas-URL till https://api.orcarouter.ai/v1, ställ in modellen till "z-ai/glm-4.5-air" och använd din OrcaRouter API-nyckel. Formatet för begäran och svar är identiskt med OpenAIs chat completions, så minimala kodändringar krävs.

Bädda in denna badge

Z.ai: GLM 4.5 Air$0.20/M in1058ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/z-ai/glm-4.5-air" target="_blank"> <img src="https://www.orcarouter.ai/embed/z-ai/glm-4.5-air.svg" alt="Z.ai: GLM 4.5 Air på OrcaRouter" /> </a>
Markdown [![Z.ai: GLM 4.5 Air](https://www.orcarouter.ai/embed/z-ai/glm-4.5-air.svg)](https://www.orcarouter.ai/models/z-ai/glm-4.5-air)

Modellkort som data

GET /api/public/models/z-ai/glm-4.5-airÖppna