
Qwen3.8-27B オープンウェイト:Maxは出荷されたが、27Bは出荷されなかった — 現在判明していること
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 36 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237知能
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248知能
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- grokNEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 181 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
2026年8月13日、AlibabaがQwen3.8世代のために約束したオープンウェイト週間は2つに分裂した。Maxクラスのフラッグシップのウェイトは—Qwen3.8-2.4T-A95B、2.4兆パラメータのスパース混合専門家(MoE)モデルであり、ダウンロード可能になった初のMaxレベルQwenリリース——実際にはHugging FaceとModelScope上で出荷され、前夜遅くにModelScopeコミュニティを通じて発表された。このページが扱う小さい方のモデル、Qwen3.8-27Bは、そうではなかった。8月10日の同じ週に予定されていたにもかかわらず、公式のリポジトリ、モデルカード、ライセンスファイル、独自のベンチマークはまだ存在しない。そしてサードパーティのトラッカーは現在、そのリリースを延期と説明しており、新しい日付は示されていない。この「これまでにわかっていること」ページが答えるために作られた質問——「27Bは実際にいつ公開されるのか?」——は2つになった。なぜMaxのウェイトが先に出荷されたのか、そして27Bに何が起こったのか?
これは、現時点で分かっていることをまとめた記事であり、レビューではありません。 Qwen3.8-Maxは、APIのフラッグシップモデルであり、8月3日から100万トークンあたり2ドル/6ドルで提供されています。その基盤となるオープンウェイトのベースモデルであるQwen3.8-2.4T-A95Bは8月13日にダウンロード可能となり、Qwen3.8-27Bのウェイトはまだ公開されていません。以下の各記述には、「確認済み」「ベンダー報告」「コミュニティ推定」のいずれかのラベルが付けられています。
シグナル、そしてその週が実際にもたらしたもの
最初のシグナルは、@kimmonismus によるXへの投稿だった。「来週」が注目すべき週だと指摘し、「Qwen-3.8 27b - Grok 4.6」と挙げていたが、そのリストにAstraは明らかに含まれていなかった。その週のGrok側は8月12日にリリースされた。Qwen側は2つに分かれた。この投稿が捉えていたのは、モデルリリースを仕事としてウォッチする人々の間のムードである。Qwen3.8のオープンウェイト公開はカレンダー上の一大イベントであり、詳細がまだ確定しないままその週を迎えた。1週間後、詳細は部分的に判明した。約束されていた2つのオープンウェイト公開のうち1つが実現したが、それは投稿が名指ししていたものではなかった。
何が確認されていますか
• このファミリーは実在し、正式に発表されました。アリババは2026年8月3日、7月中旬のプレビュー版に続き、Qwen3.8ベースモデルファミリーを公開しました。
• Qwen3.8-Maxは同日にリリースされた。 APIのフラッグシップである2.4兆パラメータの混合専門家(MoE)モデルは、約950億のアクティブパラメータ、100万トークンのコンテキストウィンドウ、テキスト・画像・動画の入力に対応し、Qwen APIで100万トークンあたり2ドル/6ドルで提供が開始された。また、OrcaRouter経由でも同じリスト価格で、マークアップ0%で利用できる。
• The Maxのオープンウェイトは8月13日にリリースされました。 Qwen3.8-Max APIの基盤となるベースモデルQwen3.8-2.4T-A95Bが、FP8量子化版とともにHugging FaceとModelScopeからダウンロードできるようになりました。これは史上初のMaxレベルのQwenオープンウェイト公開です。ダウンロード可能なモデルはテキストのみで、思考モードが強制され、ネイティブな256Kトークンのコンテキストを持ち、約1Mまで拡張可能で、SGLang、vLLM、TokenSpeedでデプロイできます。
• Qwen3.8-27Bは同ファミリーの小型オープンウェイトモデルで、まだリリースされていません。 Alibabaはこれを、ローカルおよびオンプレミス展開の現実的な道として位置づけ、Maxと並んでHugging FaceとModelScopeにそのウェイトを公開すると約束した。8月13日現在、公式のQwen3.8-27Bリポジトリはまだ存在しない。約束は本物だったが、提供はまだ実現していない。
• この世代における初の独立スコアが発表されました。 Artificial AnalysisはQwen3.8-MaxをIntelligence Index 56、タスクあたり約1.14ドルと評価——発売から間もないフラッグシップならではの注意点はあるものの、確かに優れた結果です。
我々が27Bについて実際に知っていること
正直に要約すると、「Qwen3.8-27B」はまだほとんど名前とパラメータ数にすぎない。確認されている事実は、約270億パラメータのモデルであり、Qwen3.8世代のオープンウェイトメンバーであり、数百GPUクラスタではなくシングルGPUやオンプレミスでの利用を想定したサイズであることだ。UnslothのDaniel Han氏によれば、リリース時には約17GBのVRAMに収まる見込みで、これはプロシューマー向けGPU1枚分である。
その他はすべて未確認だ。Alibabaは、27BがDenseモデルなのかMixture-of-Expertsなのか、コンテキストウィンドウの長さ、対応するモダリティ、独自のベンチマークスコアを一切公表していない。今週変わったのはタイミングだ。Maxと27Bは同じ週にリリースされる約束だったが、届いたのはMaxだけだった。サードパーティのトラッカーは現在、27Bを「延期、新たな日程なし」と報告している——これはAlibabaの公式発表ではなくコミュニティの読みであり、約束された週が完全に終わる前にリポジトリが公開される可能性もまだある。しかし、この記事を書いている時点で、Hugging Face上の公式Qwen組織にはQwen3.8-27Bは存在せず、検索に表示されるいくつかの「Qwen3.8-27B-FP8」「-GGUF」「-MLX」リポジトリは、一桁のダウンロード数のコミュニティのプレースホルダーカードであり、公式リリースではない。
有用な参照点は依然として前世代の27B、つまりオープンウェイトのDenseモデルであり、32Kコンテキストウィンドウを備えたQwen3.5-27Bです。これはQwen3.8-27Bが超えるべき妥当な下限であり、Qwen 27Bクラスのモデルは歴史的に、開発者が実際に所有するハードウェア上で動作するように作られてきたことを思い出させるものです。
Maxは、27Bが受け継ぐかもしれないものの基準点である。

27BはMaxの生の天井には及ばないだろうが、実在のモデルカードに掲載されたMaxの数値は、この世代の改善がどのようなものかへの期待値を示している。Alibaba自身によるオープンウェイトモデルの評価では、Qwen3.8-2.4T-A95BはPaperBenchで93.0、OSworld-Verifiedで86.1、パラメトリックCADで91.5、SWE-bench Proで67.7、Terminal-Bench 2.1で86.6を記録し、ベンダーはClaude Opus 4.8、Claude Fable 5、GPT-5.6 Sol、Gemini 3.1 Proとの同等性を主張している。これらはベンダー報告による数値であり、リリース資料に掲載されたもので、独立した研究所による再現はまだない。APIローンチが主張したエージェント性能の向上——FrontierSWEが単一世代で40.7から73.5へ跳ね上がったこと——は、同じリリース資料に記載されている。その改善の一部でも27Bに波及するなら、そのクラスにおける「優れたローカルコーディングモデル」の意味を塗り替えることになるだろう。
覚えておくべきニュアンスが1つあります。ダウンロード可能なMaxはAPI版のMaxとは同一ではありません。Qwen3.8-2.4T-A95Bはテキストのみで、思考モードが強制されます。一方、Qwen3.8-Max APIは視覚入力、非思考モード、デフォルトの100万トークンコンテキストを追加で備えています。このギャップは、まさに27Bが受け継ぐ可能性が高い類のものです。そして、どのバリアントを指すのかを確認せずに「Qwen3.8」のベンチマーク見出しを読むときには、覚えておく価値があります。
価格こそがMaxが最も守りやすい点である。API上で100万トークンのコンテキスト全体にわたり、トークン100万個あたり$2/$6で、長いプロンプトへの追加料金もない。これはフロンティアAPIとしては攻めた価格設定であり、ルーティングの計算において重要だ。この数字なら、3.8世代は、これまでならより高価なフラッグシップに既定で割り当てられていたワークロードの選択肢になり得る。
実際にそれを実行できるのは何か

27Bについて、Alibabaはまだハードウェア要件を公開していないため、流通している数値はQwen 3.6-27Bの量子化テーブルに基づくコミュニティの予測のままです。つまり推定値であり、仕様ではありません。ほとんどの人が計画の基準にしている動作範囲は変わりません:
• Q4_K_M 量子化、~16GB VRAM — RTX 4090 またはそれに相当するGPUで、多くのローカル開発者がターゲットとする最適な選択肢です。
• Q3_K_M量子化、~13GB VRAM — RTX 3060のような12GBカードには品質を落とせば収まります。
• Q6_K量子化、~21GB VRAM — 24GBカードではほぼ無劣化。
• FP8推論、約27GBのVRAM — 先ほどの見積もりによれば、本番グレードの推論にはL40Sが1台必要です。
• フル精度、H100 80GB — ベンチマーク品質のパスであり、ほとんどのチームが実行するものではありません。
今回の新たな事情は、「Qwen3.8世代を今ならセルフホストできる」というのが事実である一方、人々が計画の前提としていたモデルの話ではないということだ。Maxのオープンウェイトは、まったく別のハードウェアクラスに属する。全精度BF16モデルは約4.9TBで、Unslothの1ビット層別選択的量子化により約397GBまで縮小される——実行は可能だが、RAMとVRAMの合計が410GB以上必要だ。これは本格的なインフラストラクチャであり、プロシューマー向けカードではない。27Bはまさにこのギャップを埋めるためのモデルであり、27Bが依然として登場しないことが、この世代におけるシングルGPUでのローカル実行経路がまだ存在しない理由である。
ライセンスの問題:Maxはまさに先例を打ち立てた
27Bのライセンス問題は依然として未回答だが、「どのような形になるか」はもはや推測ではない。Maxのオープンウェイトは「qwen3.8-max」というカスタムライセンスのもとで公開されており、Apache 2.0ではない。モデルカードで報告されている通り、基本的に商用利用やホスティングは無料だが、大規模になると追加要件が発生する。月間アクティブユーザーが1億人を超える、または月間収益が2000万ドルを超える製品はモデル名を表示する必要があり、年収5000万ドルを超える企業でモデル・アズ・ア・サービスやAIワークアシスタントサービスを提供する場合は、別途ライセンスが必要となる。ライセンスが米国、EU、英国、韓国での使用を禁止しているという噂は誤りであり、ライセンスには地域的な制限は一切含まれていない。
具体的に27Bについては、まだライセンスは明示されていません。しかし、MaxはApache 2.0ではなくカスタムのQwenライセンスでリリースされたため、兄弟モデルについてもApache 2.0を前提とするのは不適切です。旧Tongyi Qianwenライセンス(1億MAU条項付き)は、Maxが採用したものではありません。Maxのライセンスは新しい段階別(スケール階層型)ライセンスです。これを前提に計画を立てる前に、実際のリポジトリ内のLICENSEファイルを必ず読み、27Bのライセンスもリポジトリの公開時に初めて決定されると見込んでおいてください。
ツールチェーンのタイミング:初日サポートが実証されたばかり
サービングエンジンは、リリースされたモデルについては期待通りに迅速に対応した。Qwen3.8-2.4T-A95Bは、SGLang、vLLM、TokenSpeedで動作するサポートを備えてローンチされた。これは、大規模なオープンウェイトのリリースにおける『ほぼ即時にAPI提供が可能』という状態を示している。27Bについても、リポジトリが公開され次第、同じエンジンが最初に対応する可能性が最も高い。Maxのデイワン対応を踏まえると、27Bも同様のサポートを引き継ぐというのが妥当な見込みだ。コミュニティ製のGGUFおよびAWQ量子化は依然として通常1〜2週間遅れるため、27Bのリリース日にOllamaスタイルの『pull & run』体験が実現する可能性はおそらく低い。最初は、手動でのvLLMまたはllama.cppのセットアップがローカルでの利用経路になるだろう。
まだわかっていないこと
正直なリーク記事は、実際に公開されている内容で止まる。その境界は一週間前と比べて、ある方向には広がり、別の方向には狭まっている。すなわち、Maxの質問には回答が得られたが、27Bの質問には得られなかった。
• 新しい発売日。「8月10日の週」が約束だった。その週はほぼ終わりに近づいているが、リポジトリはまだ現れていない。サードパーティのトラッカーは新しい日付なしの遅延を報告しているが、Alibabaは公式声明を出していない。
• アーキテクチャ。27B については Dense か MoE かを指定し、MoE の場合はアクティブパラメータ数を指定する。
• スペックシート。 コンテキストウィンドウ、モダリティ、出力制限、推論モード。
• ベンチマーク。 27Bには公式のスコアがなく、独立した評価もありません。
• ライセンス。27Bのリポジトリが公開されるまで未定。Maxのカスタムライセンスが注視すべき先例である。
• ミラーリスク。プレースホルダーの問題が実際に世の中に現れています。コミュニティの「Qwen3.8-27B-FP8」「-GGUF」「-MLX」カードは、公式ファイルが一切ないまま存在しています。公式のQwen組織がリポジトリを公開するまで、公式組織ページからのみダウンロードしてください。
ビルダーにとっての意味
Qwen3.8世代における実際の区分けは、今や2つではなく3つになっています。今日フロンティアAPIを利用したいなら、Qwen3.8-MaxがOrcaRouter経由で、プロバイダーのリスト価格$2/$6にて、0%マークアップでパススルー提供されています。つまり、表示される価格がそのままAlibabaが設定した価格です。Maxクラスのモデルをセルフホストしたい場合、オープンウェイトは今すぐダウンロードできますが、約4.9TBのフル精度モデルか、約397GBの量子化モデルに対応できるハードウェアが必要です。そして、この世代で期待されていたシングルGPUでのローカルデプロイを望むなら、まだQwen3.8-27Bを待つことになります。これは未だリリースされていません。現時点でAPI側は1つのOpenAI互換キーでカバーでき、27Bのホスティングが決まれば、同じキーでそこにルーティングできます。

最後の点はより一般的な論点であり、未検証で公開が遅れているオープンウェイトのリリースこそ、その試金石となる。まだ出荷されていないモデルには、実績も、独立したベンチマーク一式も、インシデント履歴もない——そして実際に登場したとしても、それはまったく新しいものだ。ルーティングは、顧客向けの経路を賭けに出さずに、それを試す方法である。予想外の挙動を許容できるトラフィックを流し込み、誤動作したら実績のあるモデルへ自動フェイルオーバーし、信頼を勝ち得たらワークロード全体を切り替える。ルーティング層はまた、価格計算を誠実なものにする。Alibabaが、あるエンドポイント経由で呼び出すモデルの価格を引き下げれば、その変更は当日中に反映される。リスト価格がそのまま素通しされるからだ。
何を見るべきか
• 27Bのリポジトリがそもそも現れるかどうか。 Hugging FaceまたはModelScope上の公式Qwen組織での掲載が、この遅延を終わらせる出来事となる — しかし8月10日の週は、その掲載がないままほぼ終わろうとしている。
• 27Bのライセンスファイル。MaxはApache 2.0ではなく、カスタムのスケール階層型ライセンスを同梱していました。27Bがその先例に従うかどうかは、最終的な発表の中でも最も重要な一文です。
• アーキテクチャとコンテキスト長。Dense 対 MoE とコンテキストウィンドウが、27B の用途を決定づける。
• 最初の独立ベンチマーク。Artificial Analysis Intelligence IndexでMaxが記録した56点が基準を打ち立てました。27Bの初の外部評価は、この世代の進歩がコンシューマーサイズでどれだけ生き残るかを教えてくれるでしょう。
• ツールチェーンの対応状況。27BがMaxの初日からのSGLang/vLLM/TokenSpeedサポートを受け継ぐかどうか、そしてコミュニティによる量子化がどれほど迅速に続くか。
よくある質問
Qwen3.8-27Bはもうリリースされましたか?
いいえ。Alibabaは2026年8月3日にそれを発表し、8月10日の週にHugging FaceとModelScopeにウェイトを公開すると約束しましたが、8月13日時点で公式のQwen3.8-27Bリポジトリ、モデルカード、ライセンスはありません。Maxクラスのオープンウェイト — Qwen3.8-2.4T-A95B — は8月13日にリリースされましたが、27Bはリリースされず、第三者トラッカーは新しい日付なしで遅延していると報告しています。
Qwen3.8-27Bを実行するには、どのようなハードウェアが必要ですか?
未確認ですが、Qwen 3.6-27Bの量子化テーブルに基づくコミュニティの予測では、Q4_K_M量子化は約16GBのVRAM(RTX 4090)、Q3_K_M量子化は約13GB(12GBカード)、Q6_K量子化は約21GB(24GBカード)、FP8サービングは約27GB(L40S 1基)とされています。UnslothのDaniel Han氏はリリース時で約17GBと報告しています。公式のモデルカードがハードウェアガイダンスを公開するまでは、これらを推定値として扱ってください。
Qwen3.8-27BはOrcaRouter経由で利用できますか?
まだです。Qwen3.8-27Bはオープンウェイトのセルフホストモデルであり、現在プラットフォームにはありません。同ファミリーの旗艦モデルであるQwen3.8-Maxは、現在OrcaRouter経由で、プロバイダーの$2/$6 per million tokensのリスト価格に0%のマークアップで利用可能です。そして、27Bのホスティングが確定したら、同じOpenAI互換キーに追加できます。
Qwen3.8-27Bを待つべきか、それとも今日Qwen3.8-Maxを使うべきか?
ワークロードがどこで実行されるかによって異なります。今すぐフロンティアAPIが必要なら、Qwen3.8-Maxが稼働中で、100万トークンあたり$2/$6という攻撃的な価格設定です。今日Maxクラスをセルフホストしたいなら、Qwen3.8-2.4T-A95Bが今すぐダウンロード可能ですが、それなりのハードウェアが必要です——フル精度モデルで約4.9TB、量子化で約397GB、RAMとVRAMの合計で410GB以上が必要です。コンシューマー向けGPU1枚でローカルまたはオンプレミスのモデルが必要なら、Qwen3.8-27Bが依然として待つべきモデルです——これは現世代における現実的なセルフホストの道であり、そのリリースは固定日ではなく未確定の問題となっています。
約束された週はほぼ終わりを迎えようとしているが、その半分は実現しなかった。Qwen3.8-2.4T-A95Bはダウンロード可能であり、ライセンスも整い、サービスとして提供できる。Qwen3.8-27Bは存在が確認されており、オープンウェイトへのコミットメントは依然として維持されているものの、リポジトリもライセンスもベンチマークも新しい日付もまだない。約束された週が完全に終わる前に27Bのリポジトリが公開されるかどうか、そのライセンスファイルがMaxのものと並べて何を示すのか、そして最初の独立評価がそれをどう採点するかに注目すべきだ。この3つのシグナルは、これが小さい方のモデルがまだリリースされていない通常の2段階オープンウェイトリリースなのか、それとも計画を立てる価値のある遅延なのかを教えてくれるだろう。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
