
Artificial Analysis における Qwen3.8-27B:まだインデックスはなく、代わりとなるデータ
- z-aiNEWZ.ai: GLM 5.32026-08-1860知能75コーディング
- obsidianNEWQwen3.8 27B2026-08-1552知能68コーディング
- qwenNEWQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNEWDeepSeek: DeepSeek V4 Pro 08132026-08-1253知能69コーディング
- grokNEWSpaceXAI: Grok 4.62026-08-1261知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0557知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0358知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2152知能69コーディング
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137知能49コーディング
- metaMeta: Muse Spark 1.12026-07-1653知能71コーディング
- kimiMoonshotAI: Kimi K32026-07-1560知能76コーディング
- openaiOpenAI: GPT-5.6 Luna2026-07-0952知能71コーディング
- openaiOpenAI: GPT-5.6 Terra2026-07-0957知能77コーディング
- openaiOpenAI: GPT-5.6 Sol2026-07-0961知能77コーディング
- grokxAI: Grok 4.52026-07-0856知能72コーディング
Artificial AnalysisはQwen3.8 27Bをまだインデックスしていません。2026-08-15に確認したところ、artificialanalysis.ai上のモデルページは404を返します — Intelligence Indexも、出力速度も、AA価格も、独立したベンチマークもありません。Apache 2.0ウェイトは8月13〜14日に公開されたため、これはおそらく数日から数週間以内に変わるでしょう。まだ変わっていません。変わるまでは、見つけられるQwen3.8 27Bの数値はすべて、Alibaba自身のモデルカードか、それを引用したニュースメディアのものです。以下に、一言で答え、Qwen3.8ファミリーに関して実際に存在するAAデータ、公式仕様、そして「すべてに勝つ」という見出しの実態についての正直な読み解きを示します。
出典注記: 以下はすべてラベル付けされています。公式とは、AlibabaのQwen/Qwen3.8-27Bモデルカード(Hugging Face、2026年8月)からの引用を意味します。独立とは、外部の第三者によって測定・再現されたものを意味します。27Bについては、まだ該当するものはありません。転載とは、ニュース媒体がベンダーの数値をコピーしたものであり、独立したものではありません。
一言の答え、日付入り
• Artificial Analysis における Qwen3.8 27B: ページなし、スコアなし。 URL artificialanalysis.ai/models/qwen-3-8-27b は、2026-08-15 に確認したところ「404 Page not found」を返しました。
• ネット上で出回っている「Qwen 3.8」のAAスコア(Intelligence 58、Agentic Index #1)は、Qwen3.8-Max、すなわち2.4TパラメータのAPIフラッグシップモデルのものです。27Bのものではありません。
• AAが追跡する直近の27Bは前身のQwen3.6-27Bです。推論モードでのインテリジェンス指数は約37〜38、出力は毎秒約55〜59トークン。これがインデックス登録された27Bの基準となります。

Artificial AnalysisがQwen3.8ファミリーについて実際に示していること
AAのリーダーボードには「Qwen3.8 2.4T A95B」— すなわちQwen3.8-Max — がIntelligence Index 58として掲載されており、この指数で2番目に優れたオープンウェイトモデルである(Artificial Analysisのモデルページ、2026-08-15アクセス)。2026年8月6日、AAのAgentic IndexはQwen3.8-Maxを世界第1位にランク付けした——中国の研究所が首位を獲得したのは初めてで、Claude Opus 5やGPT-5.6を上回った——と、その日のAAのリーダーボードから広く報じられた。
その数値は27Bには引き継がれません。Qwen3.8-Maxは約95Bのアクティブパラメータを備えた2.4Tパラメータの混合専門家(MoE)APIモデルです。一方、27Bは自己ホスト可能なダウンロード版のデンスモデルです。両者は同じ世代ラベルを共有しているだけで、評価は共有していません。
前身モデルがベースラインです:AA上のQwen3.6-27B
AAは数ヶ月間Qwen3.6-27Bを追跡してきた。スナップショットによって、Intelligence Indexの推論モードで約37〜38(非推論モードでは約31)、約55〜59トークン/秒で記録する — 単一GPUモデルでありながら、1年前のミッドクラスのフロンティアモデルに互角に渡り合っている。AAが3.8-27Bをインデックスに追加する際に期待されるデータの形はこれだ:同程度の指数、コンシューマーハードウェアでの速度、そして主にホスティングの選択を反映した価格。これは予測ではなくベースラインとして捉えてほしい — 3.8-27Bはハイブリッドアテンションとネイティブビデオ入力を追加しており、どちらの要素も数値を動かす可能性がある。
公式データ: Alibabaのモデルカード、独立ではない

以下は、Qwen/Qwen3.8-27B モデルカード(Apache 2.0、2026年8月)の検証済み仕様です:
• 27Bのdenseパラメータ(ビジョンエンコーダを含むと28B)、64層、隠れサイズ5,120、語彙サイズ248,320。
• ハイブリッドアテンション: 48個の線形アテンションヘッド(Gated DeltaNet)と16個のフルGated Attentionヘッド — おおよそ3:1の線形対フル分割。
• コンテキスト: ネイティブで262,144トークン、YaRN経由で1,000,000まで拡張可能。
• 入力: テキスト、画像、動画をネイティブ対応。思考モードはデフォルトでオン。
• サイズ: BF16で約55.6 GB、Q4では重み約16〜17 GB — 24 GB GPUが実用的なシングルカードのターゲットです。
同一カードのベンダー報告ベンチマーク(Alibabaの主張、未再現):Terminal-Bench 2.1 73.0;SWE-bench Pro 61.7;LiveCodeBench v6 90.3;GPQA Diamond 89.2;OSWorld-Verified 84.3。
「it beats everything」という見出しの実態
中国のテックニュースリレー(Gate.it、2026年8月中旬)は、「Qwen3.8 27BがMetaのMuse Glimmerを全8ベンチマークで制した」とトップで報じている。Terminal-Bench 2.1では73.0対51.7、SWE-bench Proでは61.7対51.2となり、重複する19件のテストのうち15件でClaude Opus 4.6を上回ったとも主張している。これらの数字は、Alibabaのモデルカードに記載された数値をニュースまとめに転載したものである。外部の研究所はこの27Bを実行しておらず、リレー配信もそのような実行があったとは主張していない。ここで「サードパーティによる報道」とは、サードパーティによる反復を意味しており、サードパーティによる検証を意味するものではない。

27BにAAプライスが存在しない理由 — そしてそれが示すもの
AAはAPIエンドポイントごとにモデルの価格を設定しています。27Bにはまだ公式のホステッドAPIがありません。AlibabaのQwen Cloudホスティングは「近日公開」で、1Mトークンのコンテキストに対応予定です。価格設定するものは何もありません。それがこのモデルの中心にある本当の対比です。 Qwen3.8 27Bはオープンウェイトのダウンロードモデルであり、その価格はあなたの電気代です。 24GBのカードでQ4なら、1トークンあたり$0です。API専用のフラッグシップモデルであるQwen3.8-Maxは、入力100万トークンあたり$2、出力100万トークンあたり$6です。セルフホストモデルがAPI価格インデックスに載らないのは、まさにトークンあたり無料だからです。— これは、AAが価格を設定するすべてのAPIモデルとは逆の状況です。
AAがインデックスするまで何を使えばいいか
• 今日、独立評価済みのQwen 27Bが必要なら:を実行するか、または呼び出すQwen3.6-27B。これはAAインデックス付き(推論モードでインテリジェンス約37〜38)、Apache 2.0、セルフホスト可能で、3.8-27Bが打ち負かすべきモデルです。実行するよりもAPI経由で呼び出したい場合は、OrcaRouterカタログにプロバイダー定価・マークアップ0%で掲載されており、1つのキーで追加契約は不要です。
• APIのフラッグシップをお求めですね: Qwen3.8-MaxはAAインデックス58、エージェント性能第1位、$2/$6(100万トークンあたり)。あなたが支払っているのは2.4T MoEであり、ローカルモデルではありません。
• 3.8-27Bを特に必要としている場合:Apache-2.0のウェイトをダウンロードしてセルフホストしてください。独立したハーネスが公表するまでは、すべてのベンチマークをAlibabaの言い分として扱ってください。AAモデルページ(artificialanalysis.ai/models/qwen-3-8-27b)とオープンハーネスを注視してください — 実際の数字が出たら、それは一目瞭然です。
結論
Qwen3.8 27BにはArtificial Analysisスコアがない。Artificial Analysisがまだ測定していないためだ。また、AA価格もない。セルフホストモデルであり、APIではないからだ。今日見られる「Qwen 3.8がXに勝つ」という見出しはすべて、ニュースの衣をまとったAlibabaのモデルカードにすぎない。この話の中で真に独立した数値は、兄弟モデルに属する。Qwen3.8-MaxはIntelligence 58でAgentic Index第1位、Qwen3.6-27Bは約37~38である。それらを基準にしてください。27B自身の数値は、独立した誰かが実行するまではベンダーの主張として扱ってください。また確認してください — AAが公開した日に、このページは変わります。
