「Step 5 Preview vs GLM-5.5 — 一方は提供中、一方は提供なし」というタイトルの生成済みタイトルカード。2列構成: Step 5 Preview は AA Index 44、総600B/アクティブ27B、価格 $1.00/$2.70、出力99.8トークン/秒、9月20日から稼働中のライブAPI。GLM-5.5 は、行にモデルカードなし、API識別子なし、価格設定なし、確定名なしと表示。フッターには「Step 5 Preview の数値は Artificial Analysis に基づく。GLM-5.5 は未発表かつ未リリースのモデルです。」と表示されている。
Guides & Insights

Step 5 Preview 対 GLM-5.5:一方のモデルは本日リリース、もう一方は依然として予測に過ぎない

著者

Gideon Frost

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Step 5 Previewは2026年9月20日にAPIを公開しました。StepFunがそれを発表したのと同じ日で、今日の午後には単一のエンドポイントから、入力トークン100万あたり$1.00、出力トークン100万あたり$2.70で呼び出せます。GLM-5.5は存在しません。モデルカードも、API識別子も、価格も、チェックポイントも、ライセンスファイルもなく、この名前を使っているZ.aiのページはどこにもありません。なぜならGLM-5.5はコミュニティの略称であり、同社が採用したことは一度もないからです。その非対称性こそが、この記事の主題です。以下では、StepFunが実際に出荷したもの、Z.aiの次期フラッグシップについて確かに確立している事実、そしてタイトルにある対決の代わりに今日実行できる直接対決を紹介します。

GLM-5.5とは何か、そして何ではないか

その名前は2026年半ばに、あるリリース時期と結びついて流通し始めた。その時期には追跡可能な起源がある。2026年6月25日に伝えられたアナリスト予測が、Z.aiの次期フラッグシップを8月に置いていた。それは監視期間であり、ベンダーからの確約ではなく、8月はそれを迎えることなく終わった。代わりにZ.aiが出荷したのはGLM-5.3で、8月14日に発表され、APIは8月18日ごろに稼働、オープンウェイトは8月28日、続いて8月26日にGLM-5.3-Flashが登場した。ベンダー自身のHugging Face組織にはGLM-5.5チェックポイントは一切現れておらず、そこでは最新リポジトリも依然としてGLM-5.3シリーズが上限だ。

命名もまだ定まっていない。GLM-5.3、GLM-5.4、GLM-5.5、GLM-6 がいずれも同じ時期に取り沙汰されているが、Z.ai はいずれも認めていない。企業側の唯一のシグナルは、共同創業者による「epic plus」リリースに関する発言で、これは仕様というより雰囲気の表明にすぎない。アナリストはベンダーの投入ペース——およそ54〜70日ごとに1つのフラッグシップ——を読み取り、次のモデルを2026年10月8日から11月9日にわたる期間と予測し、GLM-5.5ではなくGLM-5.4という番号になると見ている。

三つの主張が確認済みであるかのように出回っているが、その三つすべてについて正確を期す価値がある。最も弱いのはパラメータ数だ。「1兆超」という数字を裏付ける公式のものは何もなく、後にそれを3兆超まで膨らませたソーシャル投稿には、何の根拠も示されていない。100万トークンのコンテキストは最も安全な想定だ。GLM-5.2 と GLM-5.3 の両方がそれを備えているからだ。オープンウェイトは約束というより期待である——Z.ai は直近の複数のフラッグシップでウェイトを公開してきたが、それはパターンであり、コミットメントではない。

Step 5 Preview が実際に提供するもの

StepFunのモデルは、この比較における具体的な一方の側であり、その仕様は異例だ。総パラメータ数600B、トークンあたり約27Bが活性化するスパースな混合エキスパートモデル——活性化率は約4.5%——で、スパースなグループ化クエリ注意とブロック単位のトークンマージを備えた92層の狭く深いトランスフォーマーに基づいている。コンテキストウィンドウは1Mトークン、入力はテキストと画像、出力はテキストで、拡張思考を用いて推論する。StepFunはStep 4.x系を丸ごと飛ばしてここに至り、Step-3.7-FlashからStep 5へ直接進んだ。

• インテリジェンス指数 — Artificial Analysisで44、スコア評価された200モデル中24位、中央値24に対して

• 出力速度 — 毎秒99.8トークン、200中45位

• 初回トークンまでの時間 — 同じ独立実行で2.96秒

• 価格 — 入力トークン100万あたり$1.00、出力トークン100万あたり$2.70、95%のキャッシュ割引付き

• Intelligence Indexタスクあたりのコスト — $0.71、200件中27位

• 重み — 本日はなし;BF16チェックポイントは2026年10月15日に予定されています

• ライセンス — 公開されているものはなし。本モデルはプロプライエタリで、商用利用の許諾、再配布権、ファインチューニングの許可は明記されていない

価格は目を引く行であり、一見したほどにはStepFunに有利に働かない行も同様だ。Intelligence Indexで1億6000万出力トークン、中央値9200万に対して、その指標では200中64位。このモデルは冗長で、冗長性は、まさにそれが売り込まれているエージェント型ワークロードにおいてコスト倍率となる。タスクあたり0.71ドルという数字はすでにそれを織り込んでおり、だからこそ定価よりも引用するのにより誠実な数字なのだ。

StepFun自身の評価は再現されておらず、誰か独立した第三者がそれらを実行するまではベンダー資料として読むべきだ。それらは、このモデルをALE-CLIで29.5、FrontierFinanceで66.4、DRACOで83.3、ProgramBenchで80.5、DeepSWE v1.1で67.7、StepCodeBenchで49.0、Terminal-Bench 4.0で33.3%、GDPval-AA v2で1571と位置づけている。StepFunはまた、24時間のGPUカーネル最適化タスクで508 TFLOPSのMLAピークを報告しており、これはClaude Opus 5の493と対比されている。これらは、StepFunがオープンにしていないモデルについてのStepFunの数字である。

Screenshot of the Artificial Analysis model page for Step 5 Preview, showing StepFun as the creator with a September 2026 release date, an Intelligence Index of 44 at rank 24 of 200, output speed 99.8 tokens per second at rank 45 of 200, cost per Intelligence Index task $0.71 at rank 27 of 200, verbosity 160M output tokens against a 92M median, pricing of $1.00 per million input tokens and $2.70 per million output tokens with a 95% cache discount, and technical specifications listing reasoning support, text and image input, and a 1M-token context window.

これの代わりに実行できる一対一比較

タイトルが約束する比較を望むなら、正直な代替は Step 5 Preview 対 GLM-5.3 だ——Z.ai が実際にリリースしたモデルであり、今も現行のオープンフラッグシップで、GLM-5.5 が登場すれば置き換えることになるモデルでもある。独立系のリーダーボードでは、両者は1点差だ。それ以外のほぼすべての面では、そうではない。

• インテリジェンス指数 — Step 5 Preview 44 対 GLM-5.3 45

• パラメータ — 合計600B / アクティブ27B 対 合計753B / アクティブ40B

• 出力速度 — 99.8 トークン/秒 対 72.1 トークン/秒

• 最初のトークンまでの時間 — 2.96秒 対 2.99秒

• 100万トークンあたりの価格 — 入力 $1.00 / 出力 $2.70 対 入力 $1.40 / 出力 $4.40

• キャッシュ割引 — 95% 対 81%

• Intelligence Index タスクあたりのコスト — $0.71 対 $2.01

• 入力モダリティ — テキストと画像 vs テキストのみ

• ライセンス — 公開されているものなし 対 MIT ではないカスタム Z.ai ライセンス

その構図は、Step 5 Previewのローンチが、スコアリング対象となったあらゆる提供済みモデルに対して打ち立てたものと同じだ。効率における決定的な優位と、能力における統計的な互角。トークン生成は約38%速く、百万トークンあたりのコストは双方向ともおよそ半分で、GLM-5.3に対するインデックスタスクあたりでは2.8倍安い——その一方でスコアは1ポイント低い。ボード上では、その44という数字はKimi K3と並ぶことも意味しており、どちらかをリーダーとして扱う前に知っておく価値がある。

Step 5 Preview が明確に後れを取っている唯一の行こそ、ベンチマークを取ることすらできない行だ。GLM-5.3 にはライセンスファイルとダウンロード可能な重みがあるが、Step 5 Preview の Hugging Face リポジトリには単一の .gitattributes が置かれているだけで、BF16 チェックポイントの日付として10月15日と記載されているのみだ。Z.ai の次のフラッグシップが、今年を通して使ってきたのと同じ独自条項のもとでオープンウェイトとして登場するなら、それは Step 5 Preview が現時点で答えを持たない唯一のカテゴリに収まることになる——これこそが、GLM-5.5 の比較を実行するよりも待つ価値がある本当の理由だ。

Generated two-column comparison scoreboard titled 'Step 5 Preview vs GLM-5.5 — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, cost per index task $0.71, and API live since September 20. The right column gives GLM-5.5 the rows AA Index no model to score, parameters more than 1T rumored and unconfirmed, price none, cache discount none, cost per index task none, and availability not released. A footer reads 'Step 5 Preview figures per Artificial Analysis Intelligence Index; GLM-5.5 is an unannounced, unreleased model with no vendor or independent figures.'

GLM-5.5を待つのが高くつく選択である理由

「2か月先」と言われ続けてすでに2か月が経つモデルに関する実務上の問題は、評価作業のほうはそのモデルを待ってはくれないという点にある。GLM-5.5にはエンドポイントが存在しないため、ベンチマークを取ることも、価格を比較することも、負荷テストをすることもできず、フォールバックルールの後ろに置くこともできない。それを前提に計画を立てて過ごす1週間は、予測だけを頼りに意思決定を先送りする1週間であり、しかもその予測はすでに1つのウィンドウを逃している。

対照的に、GLM-5.3はOrcaRouterで公開されていますモデルID:z-ai/glm-5.3は、Z.aiが自社ページに掲載している$1.40と$4.40に対して、入力$1.26、出力$3.96です。これはマークアップゼロでそのまま反映されているため、表示される数字は当社が設定したものではなくプロバイダーの現在の料金であり、ベンダーの価格変更は次の請求サイクルを待たずに当日中に当社側で反映されます。

Step 5 Preview は当社のカタログには含まれておらず、当社がルーティングすることもありません。これは StepFun 独自の API と Studio 上で動作し、10月15日のチェックポイントが登場するまで、動作するのはそこだけです。その間、OrcaRouter が提供するのは、その比較の反対側にあるすべてです 200以上のモデルを1つのAPIに集約して: 上記の料金での GLM-5.3、GPT-6 Astra、DeepSeek V4 Pro、Claude Opus 5 など。プロバイダー間の自動フェイルオーバーにより、プレビューの容量曲線がまだ不明な間も本番パスを安定させ、ルーティング DSL は複数のモデルを2つ目の統合ではなく単一の呼び出しにまとめます。同じキーでプレビューを本番モデルとベンチマーク比較し、本番パスはそのままにしてください。

Screenshot of the OrcaRouter model page for GLM-5.3 at www.orcarouter.ai/models/z-ai/glm-5.3, showing the model id z-ai/glm-5.3, a 1M-token context and 131.1K max output, input pricing of $1.26 and output pricing of $3.96 per million tokens against the crossed-out list rates of $1.40 and $4.40, a seven-day median time to first token of 3.68 seconds and a 95th percentile of 10.00 seconds, seven-day traffic of 2296.2M tokens, and the endpoints and SDK snippets behind the OrcaRouter API.

何が答えを変えるだろうか

これを決めるのは2つの日付だ。10月15日は、StepFunがStep 5 PreviewのBF16チェックポイントが登場すると述べている日であり、それと同時に提供されるライセンスは、この比較で最も重大な未知要素だ——寛容なライセンスなら、タスクあたりコストで2.8倍の優位を、借りるものではなく所有するものにし、GLM-5.3が明確に優位に立つ唯一の軸を消し去ることになる。制限的なライセンスなら、この2つのうち製品を構築できる唯一のものとしてGLM-5.3が残り、1点差は、どのみち使い分ける2つのモデルに関する些末な話に変わってしまう。

2つ目は、Z.aiの次期フラッグシップに関する、10月8日から11月9日まで続くアナリストウィンドウだ。そのフラッグシップはGLM-5.5と呼ばれるかもしれないし、そうでないかもしれず、噂に似ているかもしれないし、似ていないかもしれない。もしそもそも登場するなら、ライセンスとチェックポイントを備えたモデルとして登場する——Step 5 Previewに欠けている2つのものだ——そして比較は現実のものになる。

両方が決着するまでは、有益な問いは、その二つのどちらが優れているかではない。なぜなら、そのうちの一方は実行できないからだ。問いは、今、存在するモデルのどれを土台にすべきか、そして次のチェックポイントが現れたときに答えが変わるかどうかである。その問いには今週、検証可能な答えがあり、名前がモデルになるのを待つ必要はない。

この記事で比較したモデル3

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新