GLM 5.2 API:価格、アクセス、および使用方法

GLM 5.2 API:価格、アクセス、および使用方法

著者

Fengya Tian

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

GLM-5.2は2026年6月16日から一般提供されており、そのAPIは夏の間、最も検索された開発者向けトピックの1つに急速になりました。その理由は単純です:1Mトークンのコンテキストウィンドウを備え、入力トークン100万あたり$1.40、出力トークン100万あたり$4.40で、最先端に近いコーディングとエージェントのパフォーマンスを実現します。待機リストもプレビューゲートもありません。キーを取得して今日から出荷できます。

本ガイドでは、検索ボックスが実際に尋ねているすべてをカバーしています:GLM 5.2 APIのコスト、アクセスするための4つの方法(無料のものを含む)、思考モードと努力レベルの仕組み、APIとコーディングプランのどちらを選ぶかの判断、そして単一のエンドポイントを介して他のモデルと一緒にGLM-5.2を実行する方法。

クイックアンサー

GLM 5.2 APIは現在利用可能ですか?はい — 2026年6月16日から一般提供されています、モデルID `glm-5.2`。

いくらですか? 100万トークンあたり$1.40 / $4.40(入力/出力)、キャッシュ入力は$0.26、キャッシュストレージは期間限定で無料です。

コンテキストウィンドウ?100万トークン入力、最大128Kトークン出力。

無料オプションはありますか? ウェイトはセルフホスティング用にMITライセンスされており、ゲートウェイの無料ティアではカード不要でテストできます。詳細は以下をご覧ください。

マルチモーダルですか?いいえ — テキスト入力、テキスト出力です。VisionはZ.aiの別のGLM-Vラインにあります。

開発者がこのAPIを必要とする理由

ベンチマークの要点を簡潔に述べる:Z.aiの公開表によると、GLM-5.2は利用可能なオープンウェイトのコーディングモデルの中で最も強力であり、Terminal-Bench 2.1で81.0(GLM-5.1の63.5に対し)、SWE-bench Proで62.1、そして長期ホライゾンのFrontierSWEベンチマークではClaude Opus 4.8と1ポイント差という結果を、フロンティア価格のごく一部で達成している。この組み合わせに加えて、コーディングエージェントのワークロードに特化して学習された100万トークンのコンテキストがあるからこそ、このAPIは単なる興味深い存在ではなく、統合する価値があるのだ。

GLM 5.2 APIで得られるもの

APIのインターフェースは現代的で、良い意味で予想通りです。モデル`glm-5.2`を呼び出すと、次のものが得られます:最大128Kトークンの出力に対応する100万トークンのコンテキストウィンドウ;リクエストごとに有効/無効にできる思考モード;最も難しい問題に対して`max`までの設定可能な推論努力レベル;リアルタイムストリーミング;ツール使用やエージェントのための関数呼び出し;構造化JSON出力;そして、繰り返し入力を割り引くインテリジェントなコンテキストキャッシングメカニズム。エージェントフレームワーク向けにMCPスタイルのツール統合がサポートされています。

それを基にアーキテクチャを設計する前に知っておくべき境界の一つ:GLM-5.2はテキストのみです。スクリーンショット、ピクセルとしてのPDF、グラフの読み取りはマルチモーダルモデルに属します — Z.aiのGLM-Vラインか、別レーン上の別プロバイダーのモデルのいずれかです。

GLM 5.2 API 料金

公式のファーストパーティ価格は入力トークン100万個あたり$1.40、出力トークン100万個あたり$4.40 — GLM-5.1と同一であり、6月の機能向上が価格上昇なしで実現したことを意味します。キャッシュされた入力の料金は100万個あたり$0.26、そしてZ.aiは期間限定でキャッシュストレージ料金を免除しています。長文脈の追加料金はありません: 完全な1Mウィンドウは標準料金で課金されます。

参考までに、これはベンチマーク対象のクローズドモデル(Claude Sonnet 5 は $3 / $15、Claude Opus 4.8 は $5 / $25 と表示)を大きく下回っており、そのためキャッシュ管理が請求額に最も影響を与える要因となります。安定したプロジェクトコンテキストを再読み込みするエージェントループでは、毎回 $1.40 の代わりに $0.26 を支払うことになります。予算に関する注意点が2つあります。努力レベルが高いほど思考トークンを多く消費し、サードパーティのホストは独自の料金を公開しています(一部はファーストパーティよりも低い)。実際にデプロイする場所で現在の数値を確認してください。

GLM 5.2 APIキーの取得方法

ルート1 — Z.aiプラットフォーム。Z.aiの開発者プラットフォームでアカウントを作成し、キーを生成し、上記の公式レートでペイ・パー・トークンの`glm-5.2`を呼び出します。これは直接的なファーストパーティのルートです。

ルート2 — GLMコーディングプラン。GLM-5.2をコーディングツールにプラグインするサブスクリプション(GLM-5.2は公開APIのローンチ前にそこで登場しました)。使用状況が一人の開発者が一日中IDEアシスタントを酷使するような場合、定額プランはトークンごとの課金より有利になることがあります。現在の階層価格はZ.aiでご確認ください。

Route 3 — AIゲートウェイ。 GLM-5.2を、OrcaRouterのようなマルチモデルゲートウェイ経由で呼び出します:OpenAI互換のエンドポイント、モデルID `z-ai/glm-5.2`、同じ$1.40 / $4.40、トークンマークアップゼロ — Claude、GPT、Gemini、DeepSeek、その他200以上のモデルと一緒に。1つのキー、プロバイダーごとのアカウント操作不要、フェイルオーバーも含まれています。

ルート4 — セルフホスト。 重みは、MITライセンスの下で、地域制限なくHugging Face上にあります。正直に予算を言うと、これは約750BパラメータのMoEなので、クラスター規模のGPUメモリを計画してください — プラットフォームチーム向けの手段であり、ラップトップ向けではありません。

APIの呼び出し:設定すべき内容とその理由

統合は意図的に退屈です — OpenAIスタイルのチャット補完で、モデル文字列は`glm-5.2`(またはOrcaRouter経由の`z-ai/glm-5.2`。OrcaRouterは`/v1/responses`エンドポイントも公開しています)。実際に結果を変えるパラメータ:

思考のオン/オフ。コーディング、エージェント、分析では思考を有効にしたままにし、分類や短いチャットターンのような高速で低コストな処理では無効にしてください。

努力レベル。品質、レイテンシ、コストの間のダイヤル。本当に難しい問題のためにトップ設定(`max`)を取っておきます。公開ゲートウェイの統計によると、モデルが思考する際のファーストトークンまでの中央時間は数秒の範囲です。そのため、レイテンシに敏感なUXはより低い努力を求めます。

キャッシュフレンドリーなプロンプト構造。安定したコンテンツ(システムプロンプト、プロジェクトコンテキスト、数発例)を最初に配置し、呼び出し間で同一にすることで、$0.26のキャッシュレートが重い処理を行います。

関数呼び出し + 構造化出力.両方ともファーストクラスです。OpenAIスタイルのツールスキーマに基づいて構築されたエージェントは、最小限の変更で移植できます.

API またはコーディングプラン?

多くのチームを困惑させる判断です。そこで、明確な分割をお示しします。そのAPIは従量制のインフラです。製品、パイプライン、そしてプログラム可能なあらゆるものに適しており、コストは使用量に応じてスケールし、キャッシュは優れたエンジニアリングに報います。そのCoding Planは人間向けの定額シートです。AIコーディングツールを活用する個人開発者に適しており、使用量の多い月はトークンで数倍のコストがかかります。多くのチームは賢明にも両方を運用しています—人間向けにはプラン、製品にはAPIを使います。

GLM 5.2を無料で使う方法はありますか?

正直な3つの答え。 セルフホスティングはライセンスフリー (MIT) ですがハードウェアは高価 — 言論の自由としての無料であり、昼食の無料ではありません。 ゲートウェイ無料ティア:OrcaRouterの無料Hackerプランでは、クレジットカードなしでモデル(GLM-5.2を含む)を呼び出すことができ、実際のプロンプトに対して評価する最速の無料方法です。 トライアルクレジット Z.ai自身のプラットフォームでは時間と地域によって異なるため、現在のサインアップ特典を確認してください。1ヶ月前のブログ記事を信頼するのではなく。

OrcaRouterを介したGLM 5.2 APIの使用

GLM-5.2を他のモデルと併用する場合(テキスト専用という特性と思考レイテンシのプロファイルを考慮すると、通常は併用すべきです)、ルーティングレイヤーがあればマルチプロバイダー向けの配管処理が不要になります。OrcaRouterはすでにGLM-5.2をファーストパーティ料金で、マークアップなしで提供しており、200以上の他のモデルと同じOpenAI互換エンドポイントの背後で動作しています。高負荷なコーディングやエージェントトラフィックをGLM-5.2にルーティングし、ビジョンタスクをマルチモーダルモデルに送り、最も難しい推論はフロンティアフラッグシップにエスカレーションし、自動フェイルオーバーでプロバイダーの障害をカバーします。モデルごとの観測可能性により、各レーンがタスク完了あたりにどのくらいのコストがかかるかがわかります。これにより、「トークンあたりの安さ」が「成果あたりの安さ」として検証されます。

結論

GLM 5.2 APIは、誇大広告が価格ページに直面しても消えない珍しいリリースです。$1.40 / $4.40という最先端に近いコーディング、実際の1Mコンテキスト、そして本当に無料のものを含む4つのアクセス方法を提供します。キーを取得し、キャッシュ用にプロンプトを構成し、GLM-5.2が適切なレーンであるときにルーターに判断させてください。

数分でGLM 5.2を呼び出す準備はできましたか? 無料のOrcaRouterアカウントを作成し、APIキーを1つ取得するだけで、Claude、GPT、Gemini、その他200以上のモデルと共に、GLM-5.2をゼロマークアップで利用できます—すべて1つのOpenAI互換エンドポイントを通じて。

よくある質問

GLM 5.2 APIはClaude Codeや既存のコーディングツールで動作しますか?

非常に優れています — Z.aiの独自ベンチマーク表によると、GLM-5.2の最高Terminal-Benchスコア(82.7)はClaude Codeをハーネスとして使用して報告されており、GLM Coding PlanはClaude Codeスタイルのワークフローのドロップインとして位置づけられています。ほとんどのOpenAI互換のエージェントフレームワークは、ベースURLとモデル名の変更で接続できます。

GLM 5.2 API を使用した場合、私のデータはどこに送られますか?

ファーストパーティAPIはZ.aiによって運営されています。厳格なデータ保存地またはコンプライアンス要件を持つチームは、その利用規約を確認し、希望する地域のサードパーティホストを選択するか、MITライセンスの重みを使用してGLM-5.2を自社のインフラストラクチャ内で完全に実行することを検討すべきです——これはクローズドモデルには提供できない選択肢です。

GLM 5.2 APIは画像やファイルを処理できますか?

いいえ — テキスト入力、テキスト出力です。Z.aiは画像理解のために別個のビジョンモデル(GLM-Vライン)を提供しているので、マルチモーダル製品は通常、画像リクエストをビジョンモデルにルーティングし、GLM-5.2をテキストレーンに保持します。

glm-5.2とz-ai/glm-5.2の違いは何ですか?

同じモデル、異なるドア:`glm-5.2` はZ.aiのファーストパーティAPIのモデルIDであり、`z-ai/glm-5.2` はOrcaRouterのようなゲートウェイで使用される名前空間付きIDです。価格はOrcaRouterでどちらも同じ $1.40 / $4.40 で、トークン手数料はかかりません。


© 2026 OrcaRouter

プロバイダー向け

推論プラットフォームを運営していますか?OrcaRouter にモデルを掲載しましょう。

お問い合わせ

コミュニティに参加

DiscordEmailXGitHubYouTube