
Qwen 4 Max、Apsara 2026で発表:Alibabaが確認したこと、そしてしなかったこと
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0345知能76コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
2026年9月22日、杭州のYunqi conference — Apsara Conference — は、まだ出荷されていない4モデルを披露するために使われた。ラボのLLM責任者Liu Da Yiheng氏は壇上でQwen 4 Max、Qwen 4 Flash、Qwen 4 Plus、Qwen 4 27Bを予告し、同ファミリーは新世代アーキテクチャでトレーニング中だと説明し、まもなく登場するとだけ述べた。本稿執筆時点で、4モデルのいずれにもモデルカードはなく、オープンウェイトも、API識別子も、コンテキストウィンドウも、価格も、ベンチマークスコアも存在しない。今日実際に呼び出せる最新のフラッグシップはQwen3.8-Maxで、2026年8月3日から一般提供されており、ステージ発表と呼び出し可能なエンドポイントとの間のこの隔たりこそ、この話の中で注意深く読む価値のある部分だ。
4つの階層と、それぞれの本来の目的
阿里巴巴のQwenシリーズは、Qwen 3世代以降、能力階層に整理されており、Qwen 4の発表もそれを置き換えるのではなく、その形を維持した。ステージで示されたのは、仕様書ではなく名簿だった:
• Qwen 4 Max — フラッグシップ階層であり、Alibabaが他すべてのフロンティアラボのトップモデルに対抗させているモデル
• Qwen 4 Flash — ハイスループット層。ピーク推論性能よりも、低レイテンシーや大量処理が求められる用途向けに設計
• Qwen 4 Plus — バランスの取れた中間層で、歴史的にマルチモーダル対応の幅が最も広いモデル
• Qwen 4 27B — オープンウェイトのローカル層。ホスト型APIに一切触れることのない人々がダウンロードし、ファインチューニングし、量子化するもの
• アーキテクチャ — 新世代と説明され、またトレーニング中とも説明されているが、それは完成していることとは同じではない
• 主要なワークロード — 会議の位置づけによれば、チャットではなく、エージェント的でツールを活用するタスク
• 提供状況 — なし。いずれのティアにも、リリース日、価格、コンテキストウィンドウ、モダリティ一覧、公表されたスコアはない
27Bティアは、ベンチマークとは無関係な理由で注目に値する。それはこのファミリーの中で歴史的にオープンウェイトで提供されてきた唯一のティアであり、Qwen 3.8世代はそれによってどれほど多くの独立した取り組みが可能になるかを示した。27Bのウェイトが公開されてから数日以内に、コミュニティはMLX変換、NVFP4量子化、そして検閲なしのファインチューニングを生み出したのだ。発表された27Bは下流エコシステム全体の約束であり、このロードマップの中で最も確実な提供が期待できる部分である。
5兆から10兆パラメータという数字はQwen 4のものではない
そのカンファレンスの報道は、ある数字について曖昧だった。「5~10兆パラメータ」という目標は、Qwen 4のニュースとともに出回ったが、それはQwen 4の仕様ではなく、その後の世代、つまりQwen 4.5とQwen 5の時期に関する将来を見据えた発言である。アリババはQwen 4 Maxにパラメータ数を一切公表しておらず、入手可能な証拠に照らせば、数を記載するのは誤りだろう。
これは重要です。なぜなら、パラメータ数は読者が拠り所にする数字であり、広まっていく数字でもあるからです。公開されたアーキテクチャを持たないモデルに付された5Tパラメータという主張は、どちらの方向にも反証不可能です。誰もそれを確認できず、一度繰り返されてしまえば誰も訂正できません。今週、Qwen 4 Max が数兆パラメータのモデルとして説明されているのを見かけたなら、その数字は別のスライドから借用されたものです。
正直に言えるのは、前世代のフラッグシップが2.4兆パラメータのMixture-of-Expertsであり、トークンあたり950億パラメータがアクティブになるということだ。これはQwen3.8-Maxの公式モデルカードと、その後公開されたオープンウェイト版で確認されている。Qwen 4 Maxが何であれ、それが打ち破らなければならないベースラインであり、ロードマップ上の願望ではなく、公表された検証可能な数字なのだ。

アーキテクチャは噂ではない。そのプレビュー版はすでに出荷されている
Qwen 4 の発表で最も有用な点は、そのアーキテクチャの一部がすでに別の名前で公開されていたことだ。Qwen3.8-Flash-Next は 2026年8月下旬にオープンソース化され、そのモデルカードには Qwen 4 アーキテクチャのプレビューであると明白に記載されている。これにより、アリババの外部にいる誰もが Qwen 4 ファミリーの構築方法について持つ唯一の具体的な証拠となっている。
これは、1250億の主要パラメータと510億のN-gram埋め込みパラメータを持つスパースモデルで、推論ステップごとに約60億を活性化する。262,000トークンのネイティブコンテキストを備え、カードによれば100万トークンに向けて拡張され、AlibabaはQwen3.7-Plusより約90%低いコストで訓練されたと報告している。カードには3つの技術が挙げられている:
• QSA、Qwen特有のスパースアテンション方式であり、低コストな長文脈トレーニングの主張を支える仕組み
• ゲート付き残差接続——深層スパースネットワークのための安定化手法
• N-gram埋め込み。密に計算されるのではなく、参照によって取得される、別個の510億パラメータのパラメータストア
Qwen 4の各ティアがその設計を受け継ぐなら、興味深い帰結はアーキテクチャ上ではなく経済上のものになる。およそ10分の1の学習コストでフロンティアに近い品質に到達するよう設計されたファミリーは、攻めた価格設定が可能なファミリーであり、Alibabaによる攻めた価格設定は、この2年間、オープンウェイトモデルの経済性において最も信頼できる唯一の力であり続けてきた。これは事実ではなく予測であり、予測として明示されるべきだ——しかし、このロードマップを切り捨てずに追うべき理由はそこにある。
待っている間に実行するもの
Qwen 4の発表には、今週利用可能なものを変えるものは何もありません。今日構築している人にとっての正直な答えは、Qwen 3.8世代です。Qwen3.8-Maxは2026年8月3日から一般提供されており、入力100万トークンあたり2.00ドル、出力100万トークンあたり6.00ドルで、100万トークンのコンテキスト全体を通じて一律、長いプロンプトへの追加料金はありません。またその重みは2026年8月12日に、カスタムQwenライセンスの下でBF16とFP8の両方でQwen3.8-2.4T-A95Bとして公開されました。これはQwen 4の各ティアが比較される際の基準となるモデルであり、今日すでに本番トラフィックを処理しています。
出荷済みのQwen世代を、ラボごとに別々のアカウントやキー、請求を管理することなく他のフロンティアモデルと比較したいなら、OrcaRouterはQwen 3.8ファミリーを取り揃えています — Qwen3.8-Max、Qwen3.8-Flash、Qwen3.8-27B — を、Claude Opus 5、DeepSeek V4 Pro、Gemini 3.1 Pro Preview、GLM 5.3と並べて、1つのOpenAI互換エンドポイントで。つまり約200モデルに対応する1つのAPIを0%のマークアップで、つまりプロバイダーの定価がそのまま反映されるため、ベンダーの値下げは次の請求サイクルを待たずにその当日あなたのキーに反映されます。Qwen 4のティアが実際に登場したとき、それが現れるのも同じカタログです。現時点では、そのいずれも登場していません。

結論
Qwen 4 Maxは本物の発表であり、本物の製品ではない。そしてその文のどちらの半分も重要だ。ラインナップは確認されている。4つの階層、新世代アーキテクチャ、エージェント指向、そしてオープンウェイトの27B階層であり、これはフラッグシップよりも多くの人にとってより重要になるだろう。購入判断に必要なもの——価格、コンテキスト、モダリティ、ウェイト、スコア、日付——はすべて欠けている。
これを、異常に良好な証跡を伴うロードマップのシグナルとして扱いなさい。というのも、Qwen3.8-Flash-Next のリリースはアーキテクチャのプレビューを無償で与え、Qwen3.8-Max は公開された重みと公開価格を備えた現行のベースラインを与えるからです。27B 層はそれが生み出すエコシステムのために、Flash 層はスループットの経済性のために追跡しなさい。5〜10兆パラメータという数値を Qwen 4 の事実として再掲してはならず、リリース日のないモデルを中心に移行を計画してはならない——Qwen3.8-Max を中心に計画し、移行先のエンドポイントが存在するときに動きなさい。

この記事で比較したモデル2
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
