「Qwen 4 Max、Apsara 2026で発表」のヒーロータイトルカード。サブタイトルは「Alibabaが確認したこと、しなかったこと」、3つのピルバッジは「4つのティアをプレビュー」「公開仕様は0件」「2026年9月22日」、右下隅にはOrcaRouterのロゴ。
Guides & Insights

Qwen 4 Max、Apsara 2026で発表:Alibabaが確認したこと、そしてしなかったこと

著者

Alistair Wren

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

2026年9月22日、杭州のYunqi conference — Apsara Conference — は、まだ出荷されていない4モデルを披露するために使われた。ラボのLLM責任者Liu Da Yiheng氏は壇上でQwen 4 Max、Qwen 4 Flash、Qwen 4 Plus、Qwen 4 27Bを予告し、同ファミリーは新世代アーキテクチャでトレーニング中だと説明し、まもなく登場するとだけ述べた。本稿執筆時点で、4モデルのいずれにもモデルカードはなく、オープンウェイトも、API識別子も、コンテキストウィンドウも、価格も、ベンチマークスコアも存在しない。今日実際に呼び出せる最新のフラッグシップはQwen3.8-Maxで、2026年8月3日から一般提供されており、ステージ発表と呼び出し可能なエンドポイントとの間のこの隔たりこそ、この話の中で注意深く読む価値のある部分だ。

4つの階層と、それぞれの本来の目的

阿里巴巴のQwenシリーズは、Qwen 3世代以降、能力階層に整理されており、Qwen 4の発表もそれを置き換えるのではなく、その形を維持した。ステージで示されたのは、仕様書ではなく名簿だった:

• Qwen 4 Max — フラッグシップ階層であり、Alibabaが他すべてのフロンティアラボのトップモデルに対抗させているモデル

• Qwen 4 Flash — ハイスループット層。ピーク推論性能よりも、低レイテンシーや大量処理が求められる用途向けに設計

• Qwen 4 Plus — バランスの取れた中間層で、歴史的にマルチモーダル対応の幅が最も広いモデル

• Qwen 4 27B — オープンウェイトのローカル層。ホスト型APIに一切触れることのない人々がダウンロードし、ファインチューニングし、量子化するもの

• アーキテクチャ — 新世代と説明され、またトレーニング中とも説明されているが、それは完成していることとは同じではない

• 主要なワークロード — 会議の位置づけによれば、チャットではなく、エージェント的でツールを活用するタスク

• 提供状況 — なし。いずれのティアにも、リリース日、価格、コンテキストウィンドウ、モダリティ一覧、公表されたスコアはない

27Bティアは、ベンチマークとは無関係な理由で注目に値する。それはこのファミリーの中で歴史的にオープンウェイトで提供されてきた唯一のティアであり、Qwen 3.8世代はそれによってどれほど多くの独立した取り組みが可能になるかを示した。27Bのウェイトが公開されてから数日以内に、コミュニティはMLX変換、NVFP4量子化、そして検閲なしのファインチューニングを生み出したのだ。発表された27Bは下流エコシステム全体の約束であり、このロードマップの中で最も確実な提供が期待できる部分である。

5兆から10兆パラメータという数字はQwen 4のものではない

そのカンファレンスの報道は、ある数字について曖昧だった。「5~10兆パラメータ」という目標は、Qwen 4のニュースとともに出回ったが、それはQwen 4の仕様ではなく、その後の世代、つまりQwen 4.5とQwen 5の時期に関する将来を見据えた発言である。アリババはQwen 4 Maxにパラメータ数を一切公表しておらず、入手可能な証拠に照らせば、数を記載するのは誤りだろう。

これは重要です。なぜなら、パラメータ数は読者が拠り所にする数字であり、広まっていく数字でもあるからです。公開されたアーキテクチャを持たないモデルに付された5Tパラメータという主張は、どちらの方向にも反証不可能です。誰もそれを確認できず、一度繰り返されてしまえば誰も訂正できません。今週、Qwen 4 Max が数兆パラメータのモデルとして説明されているのを見かけたなら、その数字は別のスライドから借用されたものです。

正直に言えるのは、前世代のフラッグシップが2.4兆パラメータのMixture-of-Expertsであり、トークンあたり950億パラメータがアクティブになるということだ。これはQwen3.8-Maxの公式モデルカードと、その後公開されたオープンウェイト版で確認されている。Qwen 4 Maxが何であれ、それが打ち破らなければならないベースラインであり、ロードマップ上の願望ではなく、公表された検証可能な数字なのだ。

A two-column scoreboard titled "Qwen 4 Max vs the model you can call today". Left column Qwen 4 Max: Release date not given, Input price not given, Output price not given, Context window not given, Open weights not given, Benchmarks not given. Right column Qwen3.8-Max: Release date August 3 2026, Input price $2.00 per 1M tokens, Output price $6.00 per 1M tokens, Context window 1M tokens, Open weights published August 12 2026, Benchmarks vendor and independent. Footer reads "Qwen 4 Max status per Alibaba's September 22 2026 conference; Qwen3.8-Max from its published model card.", with the OrcaRouter logo bottom-right.

アーキテクチャは噂ではない。そのプレビュー版はすでに出荷されている

Qwen 4 の発表で最も有用な点は、そのアーキテクチャの一部がすでに別の名前で公開されていたことだ。Qwen3.8-Flash-Next は 2026年8月下旬にオープンソース化され、そのモデルカードには Qwen 4 アーキテクチャのプレビューであると明白に記載されている。これにより、アリババの外部にいる誰もが Qwen 4 ファミリーの構築方法について持つ唯一の具体的な証拠となっている。

これは、1250億の主要パラメータと510億のN-gram埋め込みパラメータを持つスパースモデルで、推論ステップごとに約60億を活性化する。262,000トークンのネイティブコンテキストを備え、カードによれば100万トークンに向けて拡張され、AlibabaはQwen3.7-Plusより約90%低いコストで訓練されたと報告している。カードには3つの技術が挙げられている:

• QSA、Qwen特有のスパースアテンション方式であり、低コストな長文脈トレーニングの主張を支える仕組み

• ゲート付き残差接続——深層スパースネットワークのための安定化手法

• N-gram埋め込み。密に計算されるのではなく、参照によって取得される、別個の510億パラメータのパラメータストア

Qwen 4の各ティアがその設計を受け継ぐなら、興味深い帰結はアーキテクチャ上ではなく経済上のものになる。およそ10分の1の学習コストでフロンティアに近い品質に到達するよう設計されたファミリーは、攻めた価格設定が可能なファミリーであり、Alibabaによる攻めた価格設定は、この2年間、オープンウェイトモデルの経済性において最も信頼できる唯一の力であり続けてきた。これは事実ではなく予測であり、予測として明示されるべきだ——しかし、このロードマップを切り捨てずに追うべき理由はそこにある。

待っている間に実行するもの

Qwen 4の発表には、今週利用可能なものを変えるものは何もありません。今日構築している人にとっての正直な答えは、Qwen 3.8世代です。Qwen3.8-Maxは2026年8月3日から一般提供されており、入力100万トークンあたり2.00ドル、出力100万トークンあたり6.00ドルで、100万トークンのコンテキスト全体を通じて一律、長いプロンプトへの追加料金はありません。またその重みは2026年8月12日に、カスタムQwenライセンスの下でBF16とFP8の両方でQwen3.8-2.4T-A95Bとして公開されました。これはQwen 4の各ティアが比較される際の基準となるモデルであり、今日すでに本番トラフィックを処理しています。

出荷済みのQwen世代を、ラボごとに別々のアカウントやキー、請求を管理することなく他のフロンティアモデルと比較したいなら、OrcaRouterはQwen 3.8ファミリーを取り揃えています — Qwen3.8-Max、Qwen3.8-Flash、Qwen3.8-27B — を、Claude Opus 5、DeepSeek V4 Pro、Gemini 3.1 Pro Preview、GLM 5.3と並べて、1つのOpenAI互換エンドポイントで。つまり約200モデルに対応する1つのAPIを0%のマークアップで、つまりプロバイダーの定価がそのまま反映されるため、ベンダーの値下げは次の請求サイクルを待たずにその当日あなたのキーに反映されます。Qwen 4のティアが実際に登場したとき、それが現れるのも同じカタログです。現時点では、そのいずれも登場していません。

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the on-page nav, the 1M token context badge, the model ID qwen/qwen3.8-max, multi-modality shown as text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, the code-samples panel with the OpenAI-compatible Python import, the Public benchmarks and Community buzz blocks, and the opening line of the model description calling Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

結論

Qwen 4 Maxは本物の発表であり、本物の製品ではない。そしてその文のどちらの半分も重要だ。ラインナップは確認されている。4つの階層、新世代アーキテクチャ、エージェント指向、そしてオープンウェイトの27B階層であり、これはフラッグシップよりも多くの人にとってより重要になるだろう。購入判断に必要なもの——価格、コンテキスト、モダリティ、ウェイト、スコア、日付——はすべて欠けている。

これを、異常に良好な証跡を伴うロードマップのシグナルとして扱いなさい。というのも、Qwen3.8-Flash-Next のリリースはアーキテクチャのプレビューを無償で与え、Qwen3.8-Max は公開された重みと公開価格を備えた現行のベースラインを与えるからです。27B 層はそれが生み出すエコシステムのために、Flash 層はスループットの経済性のために追跡しなさい。5〜10兆パラメータという数値を Qwen 4 の事実として再掲してはならず、リリース日のないモデルを中心に移行を計画してはならない——Qwen3.8-Max を中心に計画し、移行先のエンドポイントが存在するときに動きなさい。

A screenshot of the OrcaRouter model catalogue at www.orcarouter.ai/models (English UI), showing the header reading "199 models, 15 providers, one API key, one bill", the sort and filter rail with Newest selected alongside controls for input modalities and context length, the "How to call any model" panel showing a POST to api.orcarouter.ai/v1/chat/completions with a model and messages JSON body, and the first catalogue cards including openai/gpt-5-mini with a 200 Status badge.

この記事で比較したモデル2

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新