Step 5 Preview vs Qwen 3.8 Max Prime 向けに生成されたタイトルカードは「1インデックスポイント、4ドル38セント」と表示され、3つの統計チップを備えている。Artificial Analysis Intelligence Index は44対45、インデックスタスクあたりのコストは$1.03対$5.41、出力価格は100万トークンあたり$2.70対$9.902。OrcaRouter のロゴは右下の白い帯に配置されている。
Guides & Insights

Step 5 Preview 対 Qwen 3.8 Max Prime:インデックスポイント1点、4ドル38セント

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

まずは検索ボックスが教えてくれないことから始めよう。Qwen 3.8 Max Primeはモデルではない。それはサービングレーンだ——Qwen3.8-Maxの重みは、ベンダーが2026年8月3日に一般提供へと踏み切ったものだが、それを2つ目のモデルIDで、国際料金表のちょうど2倍で売っているのだ。Step 5 Previewは、StepFunのクローズドな旗艦であり、2026年9月20日にAPIを公開した、普通の意味でのモデルだ。エンドポイントは1つ、価格は1つ、そして手にすることのできない重みが1組。つまりこの対決を正直に描くなら、測定済みのモデルと測定されていないティアを突き合わせることになり、そこから出てくる算術は、どちらのベンダーもスライドには載せないような率直さだ。独立系のArtificial Analysis Intelligence Indexでは、両者はわずか1点差、44対45。完了したタスクにかかるコストでは、1.03ドル対5.41ドル。1点、4ドル38セント、タスク1件あたり——しかもこれは、Primeが実際に対価を取っているスピードを一切買う前の話だ。

以下ではその数字を分解します。それがどこから来るのか、なぜ標準のQwen IDが、Primeが何かを2倍にする前からすでに比較の高価な側なのか、そしてタスクあたりの追加4ドルが何を買い、何を買っていないのか。

その名前は、製品が果たしていない役割を果たしている

Alibabaは2026年9月22日のYunqi ConferenceでPrime — 优速模式(高速モード)— を発表し、Model Studioの料金表の1行として公開した。Alibaba自身のドキュメントは、何が変わるかを明確にしている。出力速度は標準APIの1.5~2倍に上がり、ベンダーの言葉を借りれば、機能と利用制限は元のモデルと同一である。新しいパラメータ数も、新しいエンドポイント契約も、標準IDに欠けている機能もない。リクエストボディのモデル名を変更すれば、高速レーンに乗れる。

Generated two-column comparison scoreboard for Step 5 Preview and Qwen 3.8 Max Prime across six shared rows: what the name refers to, 'a model' against 'a serving lane for Qwen3.8-Max'; Artificial Analysis Intelligence Index 44 against 45, measured on the standard Qwen ID with no Prime row; cost per index task $1.03 against $5.41; output price $2.70 against $9.902 per million tokens; output speed 87 against 35.4 tokens per second, again measured on the standard ID; and weights, 'proprietary, BF16 checkpoint promised 15 October' against 'proprietary, none'. A footer reads that index, speed and cost-per-task figures are per Artificial Analysis and were measured on the standard Qwen3.8-Max ID rather than on Prime, and that rate cards are Alibaba's international list price and StepFun's own. The OrcaRouter logo sits in a white strip at the bottom right.

それにより、その検索語は罠になる。Qwen3.8-Max より新しい Qwen のフラッグシップを探している人が「Prime」を見つけ、それをバージョン番号と解釈する。それは価格だ。その名が能力について示唆するすべては、Qwen3.8-Max 自体によって提供されている。すなわち、2.4兆パラメータのスパースなエキスパート混合モデルで、トークンあたり約950億パラメータが有効になり、層あたり512のエキスパートを備え、独立委員会がテストした構成では983,616トークンのコンテキストを持つ。

Step 5 Preview には同様の曖昧さはなく、むしろ逆の問題を抱えている。StepFun は、総パラメータ数約6000億、アクティブ約270億、テキスト・画像・動画入力、100万トークンのコンテキストウィンドウ、文書化された64,000トークンの出力上限を備え、推論エフォートを低・中・高から選択できると記載している。これはプロプライエタリである。BF16チェックポイントは2026年10月15日に向けて約束されているが、まだリリースされていない。BF16ビルドのコミュニティミラーは、APIが公開された日から Hugging Face 上に出回っているが、再アップロードはリリースではなく、StepFun はオープンウェイトに関する発表を一切公表していない。

つまり、ベンチマークが1つも出る前から、この二者は本当に釣り合いが取れていない。ダウンロード可能になるかもしれないプレビュー版モデルと、そうはならないモデルの、価格が改定されたサービング階層だ。

1インデックスポイントにかかるコスト

両モデルは同じ独立系評価者によって実行されており、ここが、トークン単価が安いという話にとって比較が厄介になる点です。続きは2026年10月10日をお読みください:

• Index — Step 5 Preview 44、同種モデルの中央値26を大きく上回る。0902ビルドのQwen3.8-Max、45。1点差。

• 完了したインデックスタスク1件あたりのコスト — 1.03ドル対5.41ドル。5倍以上優れている。

• 出力価格 — 標準IDでは100万トークンあたり$6.00に対して$2.70、Primeに移行すると$9.902になります。Step 5 Previewは標準より2.2倍安く、Primeより3.7倍安いです。

• 入力価格 — $1.00 に対して、標準は $2.00、Prime では $3.301。出力列の鏡像であり、下のコスト内訳を読めばより重要になるものだ。

• キャッシュヒット — Step 5 Previewでは100万トークンあたり$0.10、90パーセントの割引。Qwen3.8-Maxでは$0.25、87.5パーセントの割引で、ベンダー自身のページでは88パーセントに丸められている。

• 1秒あたりの出力トークン — 87 対 35.4。ここでは Qwen が遅い方で、その差は約2.5倍です。

トークン単位の列とタスク単位の列は一致しておらず、信じるべきはタスク単位の列です。その理由は、コスト内訳を開いて初めて見えてきます。Step 5 Preview のインデックス実行では、$1.03 のうち $0.85 が入力側で、$0.17 が出力です。Qwen3.8-Max の場合は、$5.41 のうち $4.76 が入力側で、$0.65 が出力です。定価はおよそ2倍の差しかありませんが、タスクごとの請求額は5倍の差があります。なぜなら、Qwen の実行では約99億の入力トークンがハーネスを通されたのに対し、Step 5 Preview では55億だったからであり、またその量の大半は、表示料金ではなくベンダーが適用する割引率で再読み込みされるキャッシュトラフィックだからです。

ステップ5プレビューは、ボードによって非常に冗長だと評されており、スイート全体で約1億6,000万出力トークンで、中央値は8,200万です。Qwen3.8-Maxもまったく同じ言葉で評されており、約1億9,000万で、同じ中央値です。これらのどちらも、簡潔に答えるモデルではありません。出力長こそ最適化したいと考えていたなら、どちらの列も役には立ちません。

Screenshot of the Artificial Analysis model page for Qwen3.8 Max (0902), showing an Intelligence Index of 45 ranked 32 of 227 with a comparable-model median of 26, speed ranked 190 of 227, cost ranked 105 of 227 and verbosity ranked 103 of 227, pricing of $2.00 per million input tokens and $6.00 per million output tokens with an 88 percent cache discount, a measured cost of $5.41 per index task, 190 million output tokens generated across the run against an 82 million median, about 35 output tokens per second, and a 984k-token context.

その比較には穴があり、それはPrimeの形をしている

前節のすべての数値は、標準のQwen3.8-Max IDで測定されたものです。Primeで測定されたものは一つもありません。

それは技術的な細かい話ではない。Primeの主張全体は、トークンがより速く到着するというものだ。そして、このファミリーについてボードにある唯一の速度数値は、標準IDの毎秒35.4出力トークンだ — ここで取り上げた3つのIDのうち大差で最も遅く、Qwen3.8-Maxが単に高価なだけでなく明らかに性能不足している唯一の行である。Primeがアリババの公称範囲の上限を実現すれば、その35.4は70程度になるが、それでもStep 5 Previewの87を下回り、しかも出力トークンあたりのコストは3.7倍だ。範囲の下限を実現すれば、約53になる。

これらはベンダーが示した倍率に基づく推定値であり、実測値ではない。そのため、そのように明記されるべきだ。我々が探した限りでは、Prime mode の独立したスループットテストを公表した者はいない。1.5~2倍という数字は Alibaba 自身によるものであり、このティア全体を支える唯一の主張である。

Primeに有利に働く唯一の構造的詳細はスロットリング規則であり、それは見落としやすい。Alibabaのドキュメントには、Primeでは呼び出し量がレート制限に達したとき、プラットフォームにまだ余剰リソースがあればリクエストはスロットリングされない、したがって利用可能なスループットが明記された制限を下回ることはないと記されている。それは硬い下限を伴う柔らかい上限だ。競合下では制限値が得られ、空き容量下ではそれ以上を得られる。何十回もの逐次呼び出しを行うエージェントループでは、これは中央値よりも重要な意味を持つ。なぜなら、ループがいつ終わるかは最も遅い呼び出しが決めるからだ。また、Primeがなぜ製品として存在するのかを最も明確に説明するものでもある。Alibabaは、すでに構築した容量から行列の順番を売り、そこから最初に処理される権利に倍額を課している。

2つの料金表を並べてみると、何が読み取れるか

アリババはQwenの行を隣接して公開しているため、このティアの計算は異常に明確です。国際ページでは、Primeの行は100万トークンあたり入力$3.301、出力$9.902となっており、標準IDとその0902ピンでは$1.65と$4.951です。これは両方の列でちょうど2.0です — 四捨五入された近似値ではなく、公開された数値の文字通りの比率です。StepFunの英語の価格ページでは、Step 5 Previewを入力$1.00、キャッシュヒット時$0.10、出力$2.70と記載しており、キャッシュミス入力には新しいコンテンツをキャッシュに書き込むコストが含まれます。ベンダーが公開しているキャッシュヒットの数値は90パーセントの割引です。独立した委員会は同じ資料から95パーセントを記録しており、どちらをモデリングの基準にしているかを知っておく価値があります。

3枚のカードを1列に並べると、形がはっきり見える。Primeの出力は$9.902。標準Qwenの出力は、掲示板の記録では$6.00、Alibaba自身の国際ページでは$4.951。Step 5 Previewの出力は$2.70。そして、誰も宣伝していない安価なレーンでは、Step 5 Previewのキャッシュ読み取りは$0.10で、Qwenの$0.25に対して——プレフィックスを繰り返すあらゆるワークロードにとって、これは出力列よりも重要だ。

古い数字に関する警告が1つあります。このファミリーは7週間のうちに複数回価格改定されているからです。Qwen3.8-Maxについて広く引用されている入力$2、出力$6は8月のローンチ時の見出し価格で、今もAlibabaのシンガポールタブが表示している内容です。インターナショナル行とグローバル行は現在$1.65と$4.951になっています。支出をモデリングする場合は、あなたの地域の料金表を使い、契約する日にそれを再確認してください。

2×の2通りの読み方

Primeはstandard IDの2倍の価格で同じモデルなので、その割増は価格設定しやすい一方で正当化しにくい。Alibabaのラインナップの上位では、2倍の速度に対して2倍の料金を払うことになり、削減したレイテンシ1秒あたりではコスト中立だ。下位では1.5倍の速度に対して2倍の料金を払うことになり、節約した1秒あたり33パーセントの割増になる。インタラクティブな作業ならどちらの端も不合理ではないが、夜間バッチにはどちらも正当化できない。だからこそ、このティアに関する定石の助言——レイテンシに敏感な呼び出しはPrime、それ以外はすべてstandard ID——が、正しい助言でもあるのだ。

Step 5 Previewとの比較になると、推論の形が変わる。そしてこれこそが、「vs」という枠組みによって見えてくる部分だ。Primeは、価格でStep 5 Previewと競っているわけではまったくない。standard IDは、出力トークンあたりですでにStep 5 Previewより高く、完了タスクあたりでは5倍高く、しかもスコアは1ポイント上だ。Primeは、すでに負けている方程式のコスト側を何倍にもし、Step 5 Previewが無料でより多く持っている速度を買い戻している。このファミリーに速度を求めるなら、正直に言えば、このページの反対側にあるモデルは100万出力トークンあたり$2.70で毎秒87トークンを提供し、fast laneは、Alibaba自身の数値によれば、$9.902で最大70前後に達する範囲を提供する。

それは Step 5 Preview が勝つという主張ではない。それは、Prime の価値が完全に Alibaba 自身の製品ライン内にあり、その根拠が、Qwen3.8-Max の1ポイントのインデックスリード、その983,616トークンのコンテキスト、またはその異なるタスクプロファイルが、1Mトークンの Step 5 Preview コンテキストではできない仕事を果たすワークロードに依存しているという主張である。それはまだ誰も実行できない比較である。なぜなら、Prime の行はどの独立系ボードにも存在しないからだ。

Generated rate-card infographic comparing three published price lists in one column: Qwen 3.8 Max Prime at $3.301 input and $9.902 output per million tokens, the standard qwen3.8-max and qwen3.8-max-0902 IDs at $1.65 and $4.951 on Alibaba's international page against the $2 and $6 still shown on its Singapore tab, and Step 5 Preview at $1.00 input, $0.10 cached input and $2.70 output from StepFun's English pricing page. A footer reads that the Prime row is exactly 2.0 times the standard row on both columns and that all figures are vendor list prices read on 10 October 2026.

これが買い手にとってどう響くか

この2つのどちらも OrcaRouter 上にはありません。Step 5 Preview は StepFun 自社の API と、ごく少数のサードパーティプラットフォームからアクセスできます。Prime は Alibaba Cloud Model Studio のティアで、ワークスペース単位のエンドポイントで提供されています。そして、そのどちらの主張も、読んだその同じ1分のうちに当社のカタログと突き合わせて確認できます。これは、私たちの言葉を鵜呑みにするより、よほど確かな検証方法です。

私たちがルートするのは同じファミリーの別製品であり、それはこの記事の計算が繰り返し指し示しているものです。標準のQwen3.8-Maxとその日付付きピンQwen3.8-Max-0902は、カタログ内でその兄弟であるQwen3.8-Max-Preview、Qwen3.8-Flash、Qwen3.8-27Bと同じキーに位置しており、200以上の他のモデルと並んで、そしてプロバイダーのリスト価格は0パーセントのマークアップでそのまま渡されています。そこから2つのことが導かれ、どちらも上記の決定に関わります。第一に、Alibabaでの料金表の変更は、Alibabaが公開した当日に当社側に反映されます。これは、このファミリーを7週間で2度も値下げしたベンダーに求める性質そのものです。第二に、あなたのベースラインは単一ベンダーへの賭けではなくなります。標準IDは、あなたがデフォルトのパスに保持する可能性が最も高い階層であり、それを直接統合ではなくルーティング層の背後に置くことで、Primeの決定が契約単位ではなくエンドポイント単位で可逆になるのです。

この記事のタイトルにある2つの名前のどちらを選ぶかというなら、その分かれ目は単純です。スコア、動画と画像の入力、そして90パーセントのキャッシュ割引が欲しいならStep 5 Previewに手を伸ばし、自分が借りているのはプレビューであって、そのチェックポイントはライセンスではなく10月15日に向けた約束にすぎないと受け入れましょう。Qwen 3.8 Max Primeに手を伸ばすのは、すでにQwen3.8-Maxにコミットしていて、自分のプロンプトで、標準IDの毎秒35トークンこそがコストを生んでいる要因だと測定済みの場合だけにし、その判断は1.5倍ではなく2倍を基準に価格を考えましょう。なぜなら、ベンダーのラインナップの最上位は、本番環境で目にする数字ではないからです。

これを決着させる測定は存在しない。そして、それを飾り立てるのではなく、率直にそう言ってしまう価値がある。誰かが、Step 5 Preview も走らせるハーネスで Prime を実行し、倍率ではなくスループット分布を公表し、それが買うインデックスポイントの隣にタスクあたりコストの数値を置く必要がある。それまでは、双方が共有している唯一の数値は2枚の料金表だけで、それらは正反対の方向から同じことを言っている。ファストレーンは Qwen3.8-Max のトークンを買うには最も高価な方法であり、代替手段が同じ1秒に対して請求するものと比べて、実時間1秒を買うには最も遅い方法だ。

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新