「Qwen3.8-27B Release Date」記事のタイトルカード。2026年8月10日の週をリリース予定時期として示すカレンダー、「status: pending」バッジ、2026年8月3日の発表を記すサブタイトル、そして積み重ねられたモデル層のグラフィックが表示されている。
Guides & Insights

Qwen3.8-27B リリース日:8月14日にウェイト公開

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Alibabaは2026年8月14日の夜にQwen3.8-27Bのオープンウェイトを公開し、Apache 2.0ライセンスの下でHugging FaceとModelScopeにリポジトリをアップロードした。これにより、この投稿が8月3日の発表以来追跡してきたリリース日問題は解決し、API利用可能性の最初のデータポイントがもたらされる。モデルは同日、商用APIマーケットプレイスに登場した。Qwen3.8-27Bは、Qwen3.8世代に属するdenseで自己ホスティング可能なモデルであり、Alibabaが2.4兆パラメータのフラッグシップQwen3.8-Maxに対抗して位置づけた兄弟モデルで、広く使われているQwen3.6-27Bの後継モデルでもある。

8月14日の配信が確認したこと

Qwen3.8世代は2026年8月3日に発表された。その日、MoE(mixture-of-experts)方式のフラッグシップモデルであるQwen3.8-Maxが有料APIで提供開始となり、AlibabaはMaxとより小型のQwen3.8-27Bの両方について「約1週間以内」にオープンウェイトを公開すると約束した。この期限は延びたが、ModelScopeのティーザーが8月15日午前0時(00:00 JST)までのカウントダウンを表示したことで、具体的な目標が定まった。公開はそのスケジュールどおり、北京時間8月14日夜にHugging FaceとModelScopeの両方で実現した。

{{1}}確認済みの仕様セット:{{/1}} {{2}}Qwen3.8-27Bは、270億パラメータの高密度(dense)モデルであり、{{/2}} {{3}}ネイティブでマルチモーダル(テキスト、画像、動画、図表、ドキュメント)に対応し、{{/3}} {{4}}ネイティブの262,000トークンのコンテキストウィンドウを備え、YaRNにより100万トークンまで拡張可能です。{{/4}} {{5}}さらに、思考の深さを調整して計算コストを節約できる、設定可能なreasoning_effortモードも備えています。{{/5}} {{6}}これらはリリース資料に記載されたベンダー公称の仕様であり、{{/6}} {{7}}鵜呑みにするのではなく、公開された重みから直接確認できるものです。{{/7}}

Alibaba社の独自評価では、27Bは前モデルを上回り、より大規模なQwen3.7-Plusをも凌駕している:SWE-bench Pro 61.7(Qwen3.6-27Bは53.5)、agentic terminal coding 73.0(同63.4)、JobBench 33.4(同21.8)。これらはベンダー報告の数値であり、独立系ベンチマークが27Bのスコアを公表した例はまだない。したがって、これらはコミュニティがこれから再現を試みるクレームとして扱うべきである。

Artificial Analysis profile page for Qwen3.8-Max, showing an Intelligence Index of 58, an output speed of 48.4 tokens per second, $2.00/$6.00 per-million-token pricing, a 1M-token context window, and a summary describing it as leading in intelligence but slow and verbose.

リリースのどのレイヤーが完了しましたか

オープンウェイトモデルにとって、{{1}}「リリース」には段階があり、それぞれ数日間隔でやってくる。{{/1}}生のウェイトが第一段階で、これは8月14日に公開された。推論フレームワークのサポートが第二段階だ。{{2}}vLLMとSGLangは通常、ウェイト公開から数日以内にサポートを追加する。これこそが、モデルが単にダウンロードできるだけでなく、サービスとして提供できる準備が整ったことを示すシグナルである。{{/2}}コミュニティによる量子化が第三段階で、{{3}}GGUFおよびAWQビルドが含まれ、これらによりOllama、LM Studio、llama.cppでのワンコマンド実行という道が開ける。通常は1〜2週間後だ。{{/3}}

では、「いつウェイトを取得できるのか」という問いへの答えは、今です。「ワンコマンドで実行できるのはいつか」という問いには、フレームワークと量子化レイヤーが答えを示しますが、これらはまだ展開中です。

A two-column infographic for Qwen3.8-27B contrasting 'Confirmed' facts (announced Aug 3 2026, weights promised week of Aug 10, target platforms Hugging Face and ModelScope, ~27B params, successor to Qwen3.6-27B) with 'Unverified' items (architecture, context window, license, benchmarks, quantized VRAM), with a footer noting no official repository had appeared as of Aug 12, 2026.

ライセンスの問題は解決済みです。

ライセンスは、日付以上に重要だった未解決の論点であり、今回のリリースによって決着した。Qwen3.8-27BはApache 2.0のもとで提供される。これは、ユーザー数上限がなく、商用利用に関する協議の引き金もない寛容なライセンスだ。これまで懸念されていた、Qwenのオープンリリースが1億MAU条項を伴うTongyi Qianwenライセンスのもとで行われるのではないかという懸念は、27Bでは現実のものとはならなかった。これにより、モデルを初日から製品やエージェントに組み込む際の主な法的障害が取り除かれた。

最初のAPI可用性データポイント

このリリースでは、27Bに関する最初のAPI利用可能性データポイントも生まれました。重みの公開から数時間以内に、そのモデルは商用APIマーケットプレイスにライブの提供中エンドポイントとして登場しました。この掲載は独立に検証可能です——第三者によるカタログエントリであり、ベンダーの主張ではありません——そして、モデルが単にダウンロード可能なだけでなく、マネージドAPIを通じてデプロイ可能であることを示す最初の証拠となります。

そこでコスト計算に登場するのがOrcaRouterです。現在、この世代でルーティング可能なメンバーはQwen3.8-Maxで、OrcaRouter上でプロバイダー定価にて提供されます。入力トークン100万件あたり2.00ドル、出力トークン100万件あたり6.00ドルで、マークアップは一切ありません。つまり、ベンダー自身の価格がそのまま支払う価格です。1つのAPIキーで、このモデルとカタログ内の200以上のモデルを利用でき、自動フェイルオーバーも備わっています。Qwen3.8-27Bがルーター上での地位を獲得すれば、同じキーでそのモデルにルーティングされます。それまでは、Apache 2.0のウェイトを自己ホストして自由に評価できます。

次に検証すべきこと

ドロップは日付の問題には答えているが、品質の問題にはまだ答えていない。今後数週間で注目すべき点が3つある:

• 推論フレームワークのサポート — Qwen3.8-27Bを挙げるvLLMとSGLangのプルリクエストは、モデルがリポジトリから実行されるだけでなく、大規模にサービス提供できる状態にあることを示すシグナルです。

• 実際のVRAM測定値を伴うコミュニティ量子化 — Unslothや他のコミュニティは通常、GGUFビルドと測定メモリを数日以内に投稿し、プレリリース時の予測値を実際のデプロイに使える数値へと変換します。

• 独立したベンチマーク — Artificial Analysis と LMArena による27Bのスコアは、発表され次第、本番環境での意思決定を左右すべきものであり、Alibaba自身の評価ではない。

今日使えるもの

Qwen3.8-27B は今すぐダウンロード可能です — それが Apache 2.0 リリースの意義です。現在、マネージド API 上でこの世代をベースに構築したいチームには、{{1}}Qwen3.8-Max が OrcaRouter 上でプロバイダー提示価格(入力トークン100万件あたり2.00ドル、出力トークン100万件あたり6.00ドル、マークアップゼロ)で提供されており、自動フェイルオーバーとカタログ全体で使える単一キーを備えています{{/1}}。独立したベンチマークがベンダーのスコアを確認するまでは、{{2}}評価目的で27B ウェイトをセルフホスティングするのが、リスクの低い参入方法です{{/2}}。

OrcaRouter model page for Qwen3.8-Max (qwen/qwen3.8-max), showing the NEW FEATURED badge, Vision and Tools capabilities, $2.00 per million input tokens and $6.00 per million output tokens, a p50 time-to-first-token of 4.84 seconds, a 1M-token context window, and OpenAI-compatible API code samples.

リリース日に関する問いは終了した。Qwen3.8-27Bは2026年8月14日にApache 2.0ライセンスでリリースされ、ネイティブな262Kコンテキストウィンドウと、同日のAPI提供開始というデータポイントを備えている。残る問いは測定可能なものだけだ——サービスの応答品質、量子化の挙動、そして独立した評価がAlibabaのスコアを再現できるかどうか。LICENSEを読み、ウェイトを取得し、フレームワークのサポートとコミュニティビルドを待ってから、本番環境のパスをそれに賭けるべきだ。