GLM 5

z-ai/glm-5
VerktygJSONResonemang
av Z.ai · 2026-02-11

Nästa generations flaggskepp från Zhipu med flera tankelägen och starka verktygsanrop. 200K kontext / 128K max utdata.

ctx200K tokens
Max output128K
Inmatningtext
Utdatatext
p50 TTFT10.00 s
INMATNING$1.00/ 1M token
UTDATA$3.20/ 1M token
p50 TTFT10.00 s7d
p95 TTFT10.00 s7d
TRAFIK691.1Ktokens/7d

GLM 5 är en textmodell utvecklad av Z.ai, tillgänglig via OrcaRouters OpenAI-kompatibla API. Den accepterar textinmatning och erbjuder ett kontextfönster på 200 000 tokens med en maximal utmatning på…

Vad är Z.ai's GLM 5?

Vem borde använda GLM 5?

Hur passar GLM 5 in i Z.ai's sortiment?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="z-ai/glm-5",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • do_sample
  • include_reasoning
  • max_tokens
  • reasoning
  • request_id
  • response_format
  • stop
  • stream
  • temperature
  • thinking
  • tool_choice
  • tool_stream
  • tools
  • top_p
  • user_id

Priser

Inmatning / 1M token$1.00
Utdata / 1M tokens$3.20
Cacheläsning / 1M$0.260
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $16.60 · Med promptcachning $14.01

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.001618

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
10.00 s
Utdatahastighet
851 tok/s
p95 TTFT
10.00 s
Felfrekvens
0%

Offentliga benchmarks

44.2
AA Coding
Bättre än 50% av jämförda modeller
#61 av 123
39.5
AA Intelligence
Bättre än 63% av jämförda modeller
#46 av 125
GPQA Diamond
82.0
Humanity's Last Exam
27.2
IFBench
72.3
Long-Context Recall
63.3
SciCode
46.2
TerminalBench Hard
43.2
τ²-Bench
98.2
Källa: artificialanalysis.ai

Community-buzz

Vad utvecklare säger den här veckan

Hacker News16 omnämnanden · 7dupp 9 jämfört med föregående vecka

Så jämför den sig

GLM 5GLM 5.1GLM 5.2GLM 4.5
Input $/M$1.00$1.40$1.40$0.60
Output $/M$3.20$4.40$4.40$2.20
Kontext200K200K1.0M128K
Kvalitet8/109/109/107/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad är kostnaden för att använda GLM 5 via OrcaRouter?
GLM 5 är prissatt till $1,00 per 1 miljon indatatokens och $3,20 per 1 miljon utdatatokens. OrcaRouter fakturerar till leverantörens taxa utan påslag, så du betalar exakt det beloppet.
Vad är kontextfönstrets storlek för GLM 5?
GLM 5 har en kontextfönster på 200 000 tokens. Detta inkluderar alla inmatningstokens (systemprompt, konversationshistorik, användarprompt). Maxutdata är 128 000 tokens.
Vilka är GLM 5:s styrkor?
Dess styrkor inkluderar ett mycket stort kontextfönster (200K tokens), en hög utmatningsgräns (128K tokens) och ett toppresultat på τ²-Bench på 98,2, vilket indikerar stark prestanda på agentiska uppgifter.
Hur jämför sig GLM 5 med GPT-4o?
Jämförelser beror på specifika mått. GLM 5 erbjuder ett större kontextfönster (200K jämfört med GPT-4os 128K). Dess τ²-Bench-poäng på 98.2 kan vara högre än GPT-4os på det riktmärket. Däremot stödjer GPT-4o multimodal inmatning (bilder, ljud) medan GLM 5 endast är textbaserad. Priserna skiljer sig också; kontrollera aktuella priser för båda.
Lagrar eller använder OrcaRouter mina data när jag anropar GLM 5?
Policyerna för datahantering hos OrcaRouter är separata. Som en gateway vidarebefordrar den förfrågningar till Z.ai. Du bör granska integritetspolicyn för Z.ai angående deras dataanvändning. OrcaRouter loggar vanligtvis inte promptinnehåll om det inte uttryckligen anges; se OrcaRouters dokumentation för detaljer.
Hur anropar jag GLM 5 med ett OpenAI-kompatibelt API?
Ställ in bas-URL:en till https://api.orcarouter.ai/v1 och använd modell-ID "z-ai/glm-5". Du kan använda vilket OpenAI SDK som helst; peka det bara mot OrcaRouters slutpunkt. Exempel: openai.OpenAI(base_url="https://api.orcarouter.ai/v1", api_key="your_key"). Skapa sedan en chattkomplettering med modellparametern.
Finns det en hastighetsbegränsning för GLM 5 på OrcaRouter?
Hastighetsbegränsningar beror på din OrcaRouter-plan och kontonivå. Kontrollera din OrcaRouter-instrumentpanel för detaljer. Det finns ingen modellspecifik hastighetsbegränsning från Z.ai som tillämpas via OrcaRouter utöver standard infrastrukturbegränsningar.
Kan jag använda streaming med GLM 5?
Ja, GLM 5 stöder strömning via OpenAI-kompatibelt API. Ange stream=True i din förfrågan för att ta emot tokens stegvis. Detta fungerar med OrcaRouters slutpunkt.
Vad händer om min indata överstiger 200 000 tokens?
API:et kommer att returnera ett fel som indikerar att kontextlängden har överskridits. Du måste minska indatastorleken. OrcaRouter trunkerar inte automatiskt.
Stöder GLM 5 funktionsanrop?
Ja, det OpenAI-kompatibla API:et stöder funktionsanrop (tools). GLM 5 kan användas med funktionsdefinitioner, även om prestanda beror på modellen. OrcaRouter vidarebefordrar dessa parametrar till leverantören.

Bädda in denna badge

Z.ai: GLM 5$1.00/M in10000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/z-ai/glm-5" target="_blank"> <img src="https://www.orcarouter.ai/embed/z-ai/glm-5.svg" alt="Z.ai: GLM 5 på OrcaRouter" /> </a>
Markdown [![Z.ai: GLM 5](https://www.orcarouter.ai/embed/z-ai/glm-5.svg)](https://www.orcarouter.ai/models/z-ai/glm-5)

Modellkort som data

GET /api/public/models/z-ai/glm-5Öppna