「Qwen3.8-27B と Artificial Analysis の記事用タイトルカード:チップの上にかざされた虫眼鏡と、「データ待ち」と書かれた空のスコアカード。タイトルは「Artificial Analysis における Qwen3.8-27B」、サブタイトルは「まだ独立したスコアはありません — 代わりとなるデータはこちら」」
Guides & Insights

Artificial Analysis における Qwen3.8-27B:まだインデックスはなく、代わりとなるデータ

著者

Magnus Corvin

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Artificial AnalysisはQwen3.8 27Bをまだインデックスしていません。2026-08-15に確認したところ、artificialanalysis.ai上のモデルページは404を返します — Intelligence Indexも、出力速度も、AA価格も、独立したベンチマークもありません。Apache 2.0ウェイトは8月13〜14日に公開されたため、これはおそらく数日から数週間以内に変わるでしょう。まだ変わっていません。変わるまでは、見つけられるQwen3.8 27Bの数値はすべて、Alibaba自身のモデルカードか、それを引用したニュースメディアのものです。以下に、一言で答え、Qwen3.8ファミリーに関して実際に存在するAAデータ、公式仕様、そして「すべてに勝つ」という見出しの実態についての正直な読み解きを示します。

出典注記: 以下はすべてラベル付けされています。公式とは、Ali​babaのQwen/Qwen3.8-27Bモデルカード(Hugging Face、2026年8月)からの引用を意味します。独立とは、外部の第三者によって測定・再現されたものを意味します。27Bについては、まだ該当するものはありません。転載とは、ニュース媒体がベンダーの数値をコピーしたものであり、独立したものではありません。

一言の答え、日付入り

Artificial Analysis における Qwen3.8 27B: ページなし、スコアなし。 URL artificialanalysis.ai/models/qwen-3-8-27b は、2026-08-15 に確認したところ「404 Page not found」を返しました。

• ネット上で出回っている「Qwen 3.8」のAAスコア(Intelligence 58、Agentic Index #1)は、Qwen3.8-Max、すなわち2.4TパラメータのAPIフラッグシップモデルのものです。27Bのものではありません。

• AAが追跡する直近の27Bは前身のQwen3.6-27Bです。推論モードでのインテリジェンス指数は約37〜38、出力は毎秒約55〜59トークン。これがインデックス登録された27Bの基準となります。

A status card for Qwen3.8-27B on Artificial Analysis, checked 2026-08-15: the model is marked NOT INDEXED (no page, no score, no price; the model URL returns 404), while Qwen3.8-Max 2.4T A95B is indexed at Intelligence 58 and Agentic Index #1, and the predecessor Qwen3.6-27B is indexed at Intelligence ~37–38 and ~55–59 tokens/sec.

Artificial AnalysisがQwen3.8ファミリーについて実際に示していること

AAのリーダーボードには「Qwen3.8 2.4T A95B」— すなわちQwen3.8-Max — がIntelligence Index 58として掲載されており、この指数で2番目に優れたオープンウェイトモデルである(Artificial Analysisのモデルページ、2026-08-15アクセス)。2026年8月6日、AAのAgentic IndexはQwen3.8-Maxを世界第1位にランク付けした——中国の研究所が首位を獲得したのは初めてで、Claude Opus 5GPT-5.6を上回った——と、その日のAAのリーダーボードから広く報じられた。

その数値は27Bには引き継がれません。Qwen3.8-Maxは約95Bのアクティブパラメータを備えた2.4Tパラメータの混合専門家(MoE)APIモデルです。一方、27Bは自己ホスト可能なダウンロード版のデンスモデルです。両者は同じ世代ラベルを共有しているだけで、評価は共有していません。

前身モデルがベースラインです:AA上のQwen3.6-27B

AAは数ヶ月間Qwen3.6-27Bを追跡してきた。スナップショットによって、Intelligence Indexの推論モードで約37〜38(非推論モードでは約31)、約55〜59トークン/秒で記録する — 単一GPUモデルでありながら、1年前のミッドクラスのフロンティアモデルに互角に渡り合っている。AAが3.8-27Bをインデックスに追加する際に期待されるデータの形はこれだ:同程度の指数、コンシューマーハードウェアでの速度、そして主にホスティングの選択を反映した価格。これは予測ではなくベースラインとして捉えてほしい — 3.8-27Bはハイブリッドアテンションとネイティブビデオ入力を追加しており、どちらの要素も数値を動かす可能性がある。

公式データ: Ali​babaのモデルカード、独立ではない

A data card for Qwen3.8-27B from Alibaba's official model card: specifications (27B dense, 28B with vision encoder, 64 layers, hidden size 5,120, vocabulary 248,320, 48 linear + 16 full attention heads, 262K native to 1M context via YaRN, text+image+video input, ~55.6 GB BF16) and vendor-reported benchmarks (Terminal-Bench 2.1 73.0, SWE-bench Pro 61.7, LiveCodeBench v6 90.3, GPQA Diamond 89.2, OSWorld-Verified 84.3), labeled Alibaba-reported, unreproduced.

以下は、Qwen/Qwen3.8-27B モデルカード(Apache 2.0、2026年8月)の検証済み仕様です:

• 27Bのdenseパラメータ(ビジョンエンコーダを含むと28B)、64層、隠れサイズ5,120、語彙サイズ248,320。

• ハイブリッドアテンション: 48個の線形アテンションヘッド(Gated DeltaNet)と16個のフルGated Attentionヘッド — おおよそ3:1の線形対フル分割。

• コンテキスト: ネイティブで262,144トークン、YaRN経由で1,000,000まで拡張可能。

• 入力: テキスト、画像、動画をネイティブ対応。思考モードはデフォルトでオン。

• サイズ: BF16で約55.6 GB、Q4では重み約16〜17 GB — 24 GB GPUが実用的なシングルカードのターゲットです。

同一カードのベンダー報告ベンチマーク(Ali​babaの主張、未再現):Terminal-Bench 2.1 73.0;SWE-bench Pro 61.7;LiveCodeBench v6 90.3;GPQA Diamond 89.2;OSWorld-Verified 84.3

「it beats everything」という見出しの実態

中国のテックニュースリレー(Gate.it、2026年8月中旬)は、「Qwen3.8 27BがMetaのMuse Glimmerを全8ベンチマークで制した」とトップで報じている。Terminal-Bench 2.1では73.0対51.7、SWE-bench Proでは61.7対51.2となり、重複する19件のテストのうち15件でClaude Opus 4.6を上回ったとも主張している。これらの数字は、Ali​babaのモデルカードに記載された数値をニュースまとめに転載したものである。外部の研究所はこの27Bを実行しておらず、リレー配信もそのような実行があったとは主張していない。ここで「サードパーティによる報道」とは、サードパーティによる反復を意味しており、サードパーティによる検証を意味するものではない。

A screenshot of the Qwen/Qwen3.8-27B model card on Hugging Face, showing the Apache 2.0 license, the model type 'Causal Language Model with Vision Encoder', BF16 tensor type, the note that the Qwen Cloud hosted version is coming soon with 1M context, and 4 adapters, 46 finetunes and 304 quantizations.

27BにAAプライスが存在しない理由 — そしてそれが示すもの

AAはAPIエンドポイントごとにモデルの価格を設定しています。27Bにはまだ公式のホステッドAPIがありません。AlibabaのQwen Cloudホスティングは「近日公開」で、1Mトークンのコンテキストに対応予定です。価格設定するものは何もありません。それがこのモデルの中心にある本当の対比です。 Qwen3.8 27Bはオープンウェイトのダウンロードモデルであり、その価格はあなたの電気代です。 24GBのカードでQ4なら、1トークンあたり$0です。API専用のフラッグシップモデルであるQwen3.8-Maxは、入力100万トークンあたり$2、出力100万トークンあたり$6です。セルフホストモデルがAPI価格インデックスに載らないのは、まさにトークンあたり無料だからです。— これは、AAが価格を設定するすべてのAPIモデルとは逆の状況です。

AAがインデックスするまで何を使えばいいか

今日、独立評価済みのQwe​n 27Bが必要なら:を実行するか、または呼び出すQwen3.6-27B。これはAAインデックス付き(推論モードでインテリジェンス約37〜38)、Apache 2.0、セルフホスト可能で、3.8-27Bが打ち負かすべきモデルです。実行するよりもAPI経由で呼び出したい場合は、OrcaRouterカタログにプロバイダー定価・マークアップ0%で掲載されており、1つのキーで追加契約は不要です。

APIのフラッグシップをお求めですね: Qwen3.8-MaxはAAインデックス58、エージェント性能第1位、$2/$6(100万トークンあたり)。あなたが支払っているのは2.4T MoEであり、ローカルモデルではありません。

3.8-27Bを特に必要としている場合:Apache-2.0のウェイトをダウンロードしてセルフホストしてください。独立したハーネスが公表するまでは、すべてのベンチマークをAlibabaの言い分として扱ってください。AAモデルページ(artificialanalysis.ai/models/qwen-3-8-27b)とオープンハーネスを注視してください — 実際の数字が出たら、それは一目瞭然です。

結論

Qwen3.8 27BにはArtificial Analysisスコアがない。Artificial Analysisがまだ測定していないためだ。また、AA価格もない。セルフホストモデルであり、APIではないからだ。今日見られる「Qwe​n 3.8がXに勝つ」という見出しはすべて、ニュースの衣をまとったAli​babaのモデルカードにすぎない。この話の中で真に独立した数値は、兄弟モデルに属する。Qwen3.8-MaxはIntelligence 58でAgentic Index第1位、Qwen3.6-27Bは約37~38である。それらを基準にしてください。27B自身の数値は、独立した誰かが実行するまではベンダーの主張として扱ってください。また確認してください — AAが公開した日に、このページは変わります。

© 2026 OrcaRouter

プロバイダー向け

推論プラットフォームを運営していますか?OrcaRouter にモデルを掲載しましょう。

providers@orcarouter.ai

コミュニティに参加

Discordsupport@orcarouter.aiXGitHubYouTube