「Qwen 4 Max vs GLM-5.3」のヒーロータイトルカード。サブタイトルは「オープンウェイト、カスタムライセンス、そして実際に出荷されるティア」、3つのピルバッジは「$1.26 と $3.96」「テキスト専用 vs マルチモーダル」「27B が注目の的」、フッター行は「Alibaba が 2026年9月22日に発表、GLM-5.3 は 2026年8月18日に掲載」、右下隅に OrcaRouter ロゴ。
Engineering & Research

Qwen 4 Max 対 GLM-5.3:オープンウェイト、独自ライセンス、そして実際に出荷されるティア

著者

Gideon Frost

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Qwen 4 Maxは、2026年9月22日に杭州で開催された雲栖大会で、Qwen 4 Flash、Qwen 4 Plus、およびオープンウェイトのQwen 4 27B階層も含む4モデル構成ラインナップの旗艦としてプレビューされた。Z.aiのGLM-5.3は、2026年8月18日からテキスト専用で掲載されており、100万トークンのコンテキストウィンドウと128,000トークンの出力上限を備え、当社カタログでは入力100万トークンあたり1.26ドル、出力100万トークンあたり3.96ドルで、Z.aiが公表している定価の1.40ドルおよび4.40ドルに対して設定されている。両社はどちらもオープンウェイトの伝統から生まれ、今では両社ともホスト型APIを通じてフロンティア級モデルを販売しているため、よくあるクローズド対オープンという枠組みはここでは当てはまらない。実際に当てはまる軸は、誰も比較表には載せない軸だ。ライセンスが実際に何を許可しているのか、そして各ファミリーの中で、何か面白いことをしてよいのはどの階層なのか、である。

二つの研究室、同じ問いへの二つの答え

アリババとZ.aiは、フロンティア隣接ラボの中で最も一貫してオープンウェイトを公開している2社であり、その開放性のどれほどがフラッグシップ層まで生き残るかについて、異なる姿勢に至っている。

AlibabaQwen 3.8世代は、最大モデルQwen3.8-2.4T-A95Bの重みをBF16およびFP8で2026年8月12日に公開した。公開されたのはApache 2.0ではなく、独自のQwenライセンスの下だった。この区別こそが肝心だ。重みが存在するということは、ファインチューニング、量子化、セルフホスティングが可能であり、それはクローズドモデルでは決してあり得ない形で実現できるということだが、条件はAlibaba独自のものであり、「オープンウェイト」という言葉が一般に示唆しがちな寛容な既定条件ではない。

Z.aiのGLMシリーズは、オープンウェイトの系譜を持つラボから生まれており、その主力モデルももはや例外ではない。GLM-5.3自身の重みは2026年8月28日に公開された——7430億パラメータの主力モデルが、141個のsafetensorsシャードとして——MITではなく、Z.aiがそのために独自に作成したカスタムライセンスの下で。その条件はおおむねMITの許諾に、高い売上閾値を超えるモデル・アズ・ア・サービス事業者向けのセキュリティ審査条件を付加したものだ。これがファミリーにとって何を意味するかに注目してほしい。GLM-5.2とGLM-5.3-FlashはMITを採用しているが、主力モデルはそうではない。

記載のとおり、GLM-5.3 はテキスト専用モデルであり、公開されたコンテキストウィンドウ、公開された出力上限、そして文書化されたツール使用、JSON モード、推論を備えています。

二つを並べてみれば、実際の違いはこうだ:

• フラッグシップの重み — Qwen 3.8 のフラッグシップは独自の Qwen ライセンスの下で公開、一方 GLM-5.3 の重みは 2026年8月28日に独自の Z.ai ライセンスの下で公開

• 入力価格 — Qwen3.8-Max は100万トークンあたり$2.00、GLM-5.3 は当社カタログで100万トークンあたり$1.26、Z.ai の自社リストでは$1.40

• 出力価格 — Qwen3.8-Max は100万トークンあたり6.00ドル、当社カタログでは GLM-5.3 は100万トークンあたり3.96ドル、Z.ai 自身のリストでは4.40ドル

• コンテキスト — Qwen3.8-Max 1Mトークン 対 GLM-5.3 1Mトークン

• 出力上限 — Qwen3.8-Max 128Kトークン 対 GLM-5.3 128Kトークン

• モダリティ — Qwen3.8-Max はテキスト、画像、動画の入力に対応する一方、GLM-5.3 はテキストのみであり、そのように明記されている

• ケイパビリティタグ — Qwen3.8-Max のビジョン、ツール、JSON、推論 対 GLM-5.3 のツール、JSON、推論

• Qwen 4 Max — 2026年9月22日に発表、価格なし、コンテキストなし、重みなし、日付なし。一方、GLM-5.3は出荷済みでトラフィックを処理している

価格差の分を負担しているのは、マルチモーダルの行だ。Qwenのフラッグシップは画像と動画を入力として受け付け、入力$2.00、出力$6.00を請求する。GLM-5.3はテキストを扱い、入力$1.26、出力$3.96を請求する。ワークロードがテキストなら、あなたは決して呼び出さないビジョンエンコーダー分の割増を支払っている。そしてこれが、テキスト専用のスペシャリストがテキスト作業のコストでマルチモーダルのフラッグシップを上回る、最も具体的な理由だ。

A two-column scoreboard titled "Qwen 4 Max vs GLM-5.3 - the scoreboard". Left column Qwen 4 Max: Status Max announced, no date; Input price $2.00 per 1M tokens; Output price $6.00 per 1M tokens; Modality text, image, video in; Flagship weights custom Qwen licence; Output ceiling 128K tokens. Right column GLM-5.3: Status shipping since Aug 18 2026; Input price $1.26 per 1M tokens; Output price $3.96 per 1M tokens; Modality text-only; Flagship weights custom Z.ai licence, Aug 28 2026; Output ceiling 128K tokens. Footer reads "GLM-5.3 pricing from its catalogue listing; Qwen3.8-Max figures from its published model card, September 22 2026.", with the OrcaRouter logo bottom-right.

これを決めるのは27Bティアだ。

Qwen 4 Maxは見出しにすぎず、本題は27Bティアにある。Qwenの各世代は、人々が自由に使える条件で小規模オープンティアを公開してきた。そして下流での証拠は明白だ。Qwen 3.8 27Bの重みが公開されてから数日以内に、エコシステムはMLX変換、NVFP4量子化、検閲なしのファインチューンを生み出したが、そのいずれも誰の許可も必要としなかった。これこそが、寛容な小規模モデル公開がもたらすものであり、どのホスト型APIも太刀打ちできない流通の形なのだ。

フラッグシップティアはまた別の話だ。カスタムライセンスの下で公開された2.4兆パラメータのモデルは、バイト列をダウンロードできるという意味ではオープンであり、それを使って何をしてよいかが公開元によって定義されているという意味ではクローズドである。両者は同時に成り立っており、Qwen 4の発表によってそのどちらも変わらなかった。Qwen 4 27Bティアが前世代のパターンに従うなら、それは最も多くの人にとって重要なリリースとなり、また最もリリース時期が予測しやすいリリースでもある。なぜなら、小規模なオープンティアはロードマップ上で最も仕上げるのが簡単なものだからだ。

これで比較は再び使える話に戻る。GLM-5.3は、公開された価格で提供され、文書化された能力セットを備えたホスト型モデルであり、今すぐ利用できる。Qwen 4 Maxはティア名にすぎない。オープン性の議論を哲学的ではなく具体的なものにしたいなら、待つべきはMaxではなく27Bだ。

ルーティング層では、ライセンスの問題はもはや重要ではなくなる

この決定には、ライセンスの問題を完全に回避するバージョンがあり、それが妥協ではなく現実的な選択肢であることを正直に認める価値がある。モデルを所有するのではなく呼び出すことが要件なら、重みのライセンスは無関係であり、重要な条件は価格、レイテンシ、障害時の挙動である。

OrcaRouterはGLM-5.3をz-ai/glm-5.3として提供しています。100万トークンあたり入力$1.26、出力$3.96——これはZ.aiが公表している$1.40と$4.40を下回る価格で、モデルページにはそれらの定価が当社の請求レートの隣に表示され、当社がプロバイダーに支払う額に上乗せされるマークアップは一切ありません。同じOpenAI互換エンドポイントではQwen 3.8ファミリー、Qwen3.8-Max、Qwen3.8-Flash、Qwen3.8-27Bを、他に約200のモデルとあわせて提供しており、プロバイダーの経路が劣化した際の自動フェイルオーバーと、ルーティングDSLを備えています。これにより、アプリケーションコード内のモデル文字列を編集するのではなく、置換ポリシーを明示的に表現できます。ベンダーがレートを変更すると、その変更は当日にあなたのキーへ反映されます。間に挟まって滞留するマージン層が存在しないからです。

OrcaRouterが取り扱っていないのは、Qwen 4 MaxやQwen 4のどのティアでもありません。カタログにはこのファミリーの項目がなく、これはステージで発表されただけでまだリリースされていないモデルにとっては正しい状態です。Qwen 4 Maxは、仮に利用可能になるとしたら、ベンダー自身のAPIと複数のサードパーティプラットフォームを通じて利用できるようになるでしょう。それまでは、この比較で実際に呼び出せるQwenモデルはQwen3.8-Maxであり、それはGLM-5.3と同じカタログに載っています。つまり、この対決の現行版は、調達の決定というよりもルーティングポリシーの決定になります。

A screenshot of the OrcaRouter model page for GLM 5.3 (z-ai/glm-5.3, English UI), showing the 1M token context badge, the model ID z-ai/glm-5.3, a 128K maximum output, text input, the Tools, JSON and Reasoning tags, the listing date 2026-08-18 credited to Z.ai, a p50 time-to-first-token of 4.41s, the OpenAI-compatible code samples against api.orcarouter.ai/v1, and the opening of the model description calling GLM-5.3 Z.ai's latest flagship for complex software engineering and long-horizon agentic tasks.

ライセンスの疑問が実際に決めること

GLM-5.3は両方の軸でより安価で、そのコンテキストウィンドウと出力上限はQwenフラッグシップと一致し、モダリティの制限は推測に委ねず文書化されており、今日すでにトラフィックを処理している。Qwen 4 Maxにはカンファレンスの登壇枠とティア名があるだけで、Qwen 4ロードマップの中で予測可能な提供時期があるのは27Bティアだけだ。

ローンチを経ても残る決断は、どちらのモデルが優れているかではない。自分でそのものを所有する必要があるかどうかだ。セルフホストやファインチューニング、改変が必要なら、どちらのラボのフラッグシップの重みにも、その上にビジネスを築く前に読むべき条件が付いており、寛容なライセンスの選択肢はこれまで小規模なオープン層にあった。モデルを呼び出すだけでよいなら、テキスト処理では今日GLM-5.3がより安価な答えであり、画像や動画の入力が必要ならQwen3.8-Maxが答えだ。そしてどちらも、エンドポイント1つと請求1つで済む。Alibabaがモデルカードを公開したらフラッグシップの問いを再検討し、ベンチマーク表より先にライセンスを読むこと。

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the 1M token context badge, the model ID qwen/qwen3.8-max, text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, and the model description naming Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

この記事で比較したモデル2

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新