
Qwen 4 Max 対 GLM-5.3:オープンウェイト、独自ライセンス、そして実際に出荷されるティア
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0345知能76コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Qwen 4 Maxは、2026年9月22日に杭州で開催された雲栖大会で、Qwen 4 Flash、Qwen 4 Plus、およびオープンウェイトのQwen 4 27B階層も含む4モデル構成ラインナップの旗艦としてプレビューされた。Z.aiのGLM-5.3は、2026年8月18日からテキスト専用で掲載されており、100万トークンのコンテキストウィンドウと128,000トークンの出力上限を備え、当社カタログでは入力100万トークンあたり1.26ドル、出力100万トークンあたり3.96ドルで、Z.aiが公表している定価の1.40ドルおよび4.40ドルに対して設定されている。両社はどちらもオープンウェイトの伝統から生まれ、今では両社ともホスト型APIを通じてフロンティア級モデルを販売しているため、よくあるクローズド対オープンという枠組みはここでは当てはまらない。実際に当てはまる軸は、誰も比較表には載せない軸だ。ライセンスが実際に何を許可しているのか、そして各ファミリーの中で、何か面白いことをしてよいのはどの階層なのか、である。
二つの研究室、同じ問いへの二つの答え
アリババとZ.aiは、フロンティア隣接ラボの中で最も一貫してオープンウェイトを公開している2社であり、その開放性のどれほどがフラッグシップ層まで生き残るかについて、異なる姿勢に至っている。
AlibabaのQwen 3.8世代は、最大モデルQwen3.8-2.4T-A95Bの重みをBF16およびFP8で2026年8月12日に公開した。公開されたのはApache 2.0ではなく、独自のQwenライセンスの下だった。この区別こそが肝心だ。重みが存在するということは、ファインチューニング、量子化、セルフホスティングが可能であり、それはクローズドモデルでは決してあり得ない形で実現できるということだが、条件はAlibaba独自のものであり、「オープンウェイト」という言葉が一般に示唆しがちな寛容な既定条件ではない。
Z.aiのGLMシリーズは、オープンウェイトの系譜を持つラボから生まれており、その主力モデルももはや例外ではない。GLM-5.3自身の重みは2026年8月28日に公開された——7430億パラメータの主力モデルが、141個のsafetensorsシャードとして——MITではなく、Z.aiがそのために独自に作成したカスタムライセンスの下で。その条件はおおむねMITの許諾に、高い売上閾値を超えるモデル・アズ・ア・サービス事業者向けのセキュリティ審査条件を付加したものだ。これがファミリーにとって何を意味するかに注目してほしい。GLM-5.2とGLM-5.3-FlashはMITを採用しているが、主力モデルはそうではない。
記載のとおり、GLM-5.3 はテキスト専用モデルであり、公開されたコンテキストウィンドウ、公開された出力上限、そして文書化されたツール使用、JSON モード、推論を備えています。
二つを並べてみれば、実際の違いはこうだ:
• フラッグシップの重み — Qwen 3.8 のフラッグシップは独自の Qwen ライセンスの下で公開、一方 GLM-5.3 の重みは 2026年8月28日に独自の Z.ai ライセンスの下で公開
• 入力価格 — Qwen3.8-Max は100万トークンあたり$2.00、GLM-5.3 は当社カタログで100万トークンあたり$1.26、Z.ai の自社リストでは$1.40
• 出力価格 — Qwen3.8-Max は100万トークンあたり6.00ドル、当社カタログでは GLM-5.3 は100万トークンあたり3.96ドル、Z.ai 自身のリストでは4.40ドル
• コンテキスト — Qwen3.8-Max 1Mトークン 対 GLM-5.3 1Mトークン
• 出力上限 — Qwen3.8-Max 128Kトークン 対 GLM-5.3 128Kトークン
• モダリティ — Qwen3.8-Max はテキスト、画像、動画の入力に対応する一方、GLM-5.3 はテキストのみであり、そのように明記されている
• ケイパビリティタグ — Qwen3.8-Max のビジョン、ツール、JSON、推論 対 GLM-5.3 のツール、JSON、推論
• Qwen 4 Max — 2026年9月22日に発表、価格なし、コンテキストなし、重みなし、日付なし。一方、GLM-5.3は出荷済みでトラフィックを処理している
価格差の分を負担しているのは、マルチモーダルの行だ。Qwenのフラッグシップは画像と動画を入力として受け付け、入力$2.00、出力$6.00を請求する。GLM-5.3はテキストを扱い、入力$1.26、出力$3.96を請求する。ワークロードがテキストなら、あなたは決して呼び出さないビジョンエンコーダー分の割増を支払っている。そしてこれが、テキスト専用のスペシャリストがテキスト作業のコストでマルチモーダルのフラッグシップを上回る、最も具体的な理由だ。

これを決めるのは27Bティアだ。
Qwen 4 Maxは見出しにすぎず、本題は27Bティアにある。Qwenの各世代は、人々が自由に使える条件で小規模オープンティアを公開してきた。そして下流での証拠は明白だ。Qwen 3.8 27Bの重みが公開されてから数日以内に、エコシステムはMLX変換、NVFP4量子化、検閲なしのファインチューンを生み出したが、そのいずれも誰の許可も必要としなかった。これこそが、寛容な小規模モデル公開がもたらすものであり、どのホスト型APIも太刀打ちできない流通の形なのだ。
フラッグシップティアはまた別の話だ。カスタムライセンスの下で公開された2.4兆パラメータのモデルは、バイト列をダウンロードできるという意味ではオープンであり、それを使って何をしてよいかが公開元によって定義されているという意味ではクローズドである。両者は同時に成り立っており、Qwen 4の発表によってそのどちらも変わらなかった。Qwen 4 27Bティアが前世代のパターンに従うなら、それは最も多くの人にとって重要なリリースとなり、また最もリリース時期が予測しやすいリリースでもある。なぜなら、小規模なオープンティアはロードマップ上で最も仕上げるのが簡単なものだからだ。
これで比較は再び使える話に戻る。GLM-5.3は、公開された価格で提供され、文書化された能力セットを備えたホスト型モデルであり、今すぐ利用できる。Qwen 4 Maxはティア名にすぎない。オープン性の議論を哲学的ではなく具体的なものにしたいなら、待つべきはMaxではなく27Bだ。
ルーティング層では、ライセンスの問題はもはや重要ではなくなる
この決定には、ライセンスの問題を完全に回避するバージョンがあり、それが妥協ではなく現実的な選択肢であることを正直に認める価値がある。モデルを所有するのではなく呼び出すことが要件なら、重みのライセンスは無関係であり、重要な条件は価格、レイテンシ、障害時の挙動である。
OrcaRouterはGLM-5.3をz-ai/glm-5.3として提供しています。100万トークンあたり入力$1.26、出力$3.96——これはZ.aiが公表している$1.40と$4.40を下回る価格で、モデルページにはそれらの定価が当社の請求レートの隣に表示され、当社がプロバイダーに支払う額に上乗せされるマークアップは一切ありません。同じOpenAI互換エンドポイントではQwen 3.8ファミリー、Qwen3.8-Max、Qwen3.8-Flash、Qwen3.8-27Bを、他に約200のモデルとあわせて提供しており、プロバイダーの経路が劣化した際の自動フェイルオーバーと、ルーティングDSLを備えています。これにより、アプリケーションコード内のモデル文字列を編集するのではなく、置換ポリシーを明示的に表現できます。ベンダーがレートを変更すると、その変更は当日にあなたのキーへ反映されます。間に挟まって滞留するマージン層が存在しないからです。
OrcaRouterが取り扱っていないのは、Qwen 4 MaxやQwen 4のどのティアでもありません。カタログにはこのファミリーの項目がなく、これはステージで発表されただけでまだリリースされていないモデルにとっては正しい状態です。Qwen 4 Maxは、仮に利用可能になるとしたら、ベンダー自身のAPIと複数のサードパーティプラットフォームを通じて利用できるようになるでしょう。それまでは、この比較で実際に呼び出せるQwenモデルはQwen3.8-Maxであり、それはGLM-5.3と同じカタログに載っています。つまり、この対決の現行版は、調達の決定というよりもルーティングポリシーの決定になります。

ライセンスの疑問が実際に決めること
GLM-5.3は両方の軸でより安価で、そのコンテキストウィンドウと出力上限はQwenフラッグシップと一致し、モダリティの制限は推測に委ねず文書化されており、今日すでにトラフィックを処理している。Qwen 4 Maxにはカンファレンスの登壇枠とティア名があるだけで、Qwen 4ロードマップの中で予測可能な提供時期があるのは27Bティアだけだ。
ローンチを経ても残る決断は、どちらのモデルが優れているかではない。自分でそのものを所有する必要があるかどうかだ。セルフホストやファインチューニング、改変が必要なら、どちらのラボのフラッグシップの重みにも、その上にビジネスを築く前に読むべき条件が付いており、寛容なライセンスの選択肢はこれまで小規模なオープン層にあった。モデルを呼び出すだけでよいなら、テキスト処理では今日GLM-5.3がより安価な答えであり、画像や動画の入力が必要ならQwen3.8-Maxが答えだ。そしてどちらも、エンドポイント1つと請求1つで済む。Alibabaがモデルカードを公開したらフラッグシップの問いを再検討し、ベンチマーク表より先にライセンスを読むこと。

この記事で比較したモデル2
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
