GLM 5.3 Flash

z-ai/glm-5.3-flash
新着
ビジョンツールJSON推論
提供 Z.ai · 2026-08-26

GLM-5.3-Flash は Z.ai のネイティブマルチモーダルモデルです。効率的なコーディングと長期的なエージェントタスクに適しています。そのハイブリッドなスパース/リニアアテンションアーキテクチャは、正確なロングコンテキスト動作を維持しつつ、サービングコストを大幅に削減します。合計320B(アクティブ18B)パラメータ、1Mトークンのコンテキスト、テキスト+画像+動画の入力、テキスト出力。

エンドポイント:/v1/chat/completions
コンテキスト1M トークン
最大出力128K
入力text + image + video
出力text
p50 TTFT7.78 s
入力$0.07/ 100万 tokens
出力$0.25/ 100万 tokens
p50 TTFT7.78 s7日
p95 TTFT10.00 s7日
トラフィック799.8Mtokens / 7日

コードサンプル

あらゆる SDK から呼び出し

OpenAI 互換——今お使いの SDK のまま

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="z-ai/glm-5.3-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

対応パラメータ

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_p

料金

入力 / 1M tokens$0.075
出力 / 1M tokens$0.250
キャッシュ読み取り / 1M$0.017
通貨USD

料金計算ツール

月間トークン数10MM
入力の割合70%%
月額見積もり $1.28 · プロンプトキャッシュ利用時 $1.07

表示価格に基づく概算

トークン・コスト見積もり

入力トークン: 8リクエストあたりのコスト: $0.000126

見積もりのみ — 実際のトークン数はプロバイダーのトークナイザーに依存します。

パフォーマンス

p50 TTFT
7.78 s
出力速度
113 tok/s
p95 TTFT
10.00 s
エラー率
7.5%

公開ベンチマーク

71.5
AA Coding
比較対象モデルの 88% を上回る
134 中 15 位
57.5
AA Intelligence
比較対象モデルの 92% を上回る
136 中 11 位
Agents' Last Exam
26.3
AutomationBench v1.0.6
48.8
BabyVision
53.4
Chartography (with tools)
78.0
CharXiv Reasoning (with tools)
89.4
DeepSWE v1.1
63.4
GPQA Diamond
91.2
HLE (with tools)
55.3
Humanity's Last Exam
39.9
Long-Context Recall
78.0
MMVU
80.5
MVBench
77.8
NL2Repo
56.3
OfficeQA Pro
62.4
SciCode
46.1
tau_banking
47.2
Terminal-Bench 2.1
84.3
terminalbench_v2_1
84.3
Toolathlon Verified
78.4
ソース: artificialanalysis.ai, z.ai

コミュニティの話題

今週の開発者の声

Hacker News10 件の言及 · 7日間先週比 8 増加

比較

GLM 5.3 FlashGLM 5.1GLM 5.2GLM 5.3
入力 $/100万$0.07$1.40$1.40$1.26
出力 $/100万$0.25$4.40$4.40$3.96
コンテキスト1.0M200K1.0M1.0M
品質8/109/109/109/10
並べて比較並べて比較並べて比較並べて比較

よくある質問

Z.ai: GLM 5.3 FlashはOrcaRouterでいくらですか?
Z.ai: GLM 5.3 FlashはOrcaRouter経由で、1M入力トークンあたり$0.07、1M出力トークンあたり$0.25の価格設定です。料金はルーティングレイヤーからリアルタイムで取得されます。
Z.ai: GLM 5.3 Flashのコンテキストウィンドウは何ですか?
Z.ai: GLM 5.3 Flash は 1M トークンのコンテキストウィンドウをサポートします。その制限まで長文コンテキスト機能(RAG、要約)を使用してください。
OpenAI SDK を介して Z.ai: GLM 5.3 Flash を呼び出すにはどうすればよいですか?
OpenAIのbase_urlをhttps://api.orcarouter.ai/v1に設定し、OrcaRouter APIキーを指定して、chat.completions.createの呼び出し時にmodel="z-ai/glm-5.3-flash"を渡してください。
OrcaRouterはZ.ai: GLM 5.3 Flashをレート制限しますか?
モデルごとのレート制限は、OrcaRouterのプランに準じます。無料ティアには控えめな上限が設定されていますが、有料ティアでは上限が引き上げられます。現在の割り当て量については/pricingをご確認ください。

このバッジを埋め込む

Z.ai: GLM 5.3 Flash$0.07/M in7777ms p50OrcaRouter 経由
HTML <a href="https://www.orcarouter.ai/models/z-ai/glm-5.3-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/z-ai/glm-5.3-flash.svg" alt="OrcaRouter の Z.ai: GLM 5.3 Flash" /> </a>
Markdown [![Z.ai: GLM 5.3 Flash](https://www.orcarouter.ai/embed/z-ai/glm-5.3-flash.svg)](https://www.orcarouter.ai/models/z-ai/glm-5.3-flash)

モデルカードをデータで取得

GET /api/public/models/z-ai/glm-5.3-flash開く