生成されたヒーローカード。タイトルは Claude Sonnet 5.5 vs Qwen 4 Max、サブタイトルは一方のモデルにはカードがあり、もう一方には名前がある。3枚のカードには次のように書かれている:Claude Sonnet 5.5 は 2026-09-28 にリリース、Qwen 4 Max はモデルカードなしで発表、Qwen3.8 Max は $2.00 / $6.00 で呼び出せる Qwen。フッターには次のように書かれている:Qwen 4 Max は 2026-09-22 に発表され、価格、コンテキストウィンドウ、重み、スコアは公開されていない。
Guides & Insights

Claude Sonnet 5.5 対 Qwen 4 Max:一方のモデルにはカードがあり、もう一方には名前がある

著者

Magnus Corvin

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

このタイトルの前半と後半は同じ種類の対象ではなく、それが読者にとってまず知っておくべきことです。Claude Sonnet 5.5は2026年9月28日にリリースされました。API識別子、料金表、コンテキストウィンドウ、公表された提供終了の下限、そして独立系リーダーボード上の一行があります。Q​wen 4 Maxは2026年9月22日、杭州のYunqiカンファレンスで、発表された4モデル構成のQ​wen 4シリーズの旗艦としてプレビューされました。そして今日時点では、価格も、コンテキストウィンドウも、公表されたスコアも、モデルカードも、Artificial Analysisで開けるページもありません。それは不祥事ではありません。あるティアが発表されるとはそういうものです。しかしそれは、有用な比較がどのような形になるかを変えます。する価値のある比較は、最新リリースのSonnetと、今日実際に呼び出せるQ​wenモデル、つまりQwen3.8 Maxとの間のものです。なぜなら後者には料金表があり、その料金表が示唆に富むからです。

アリババが実際に提示したもの

Qwen 4 Maxは、製品としてではなく、ラインナップにおける一つの名称として示されていた。カンファレンスのプレビューではQwen 4ファミリーのティア構造が紹介されたが、それ以降、開発者が計画の基準にできる仕様へと変換されたものは何もない。100万トークンあたりの価格も、コンテキストウィンドウのサイズも、最大出力も、ベンチマーク表も、Hugging Faceリポジトリも、ベンダー自身のモデル一覧への記載もない。クローズドなAPIティアとして提供されるのか、オープンウェイトとしてなのか、それともその両方の形なのかは、ベンダーが公開したどこにも明言されていない。ティアがこれほど初期段階にあるとき、その仕様について記事が正直に言える唯一のことは、仕様が存在しないということだ。そして、今この時点でQwen 4 Maxの仕様表を提供しているページは、予測を掲載しているにすぎない。

Generated comparison scoreboard titled Claude Sonnet 5.5 vs Qwen 4 Max, the scoreboard, with six matched rows. Claude Sonnet 5.5: released 2026-09-28, $2.00 input, $10.00 output, Intelligence Index 56, 1,000,000-token context window, closed weights. Qwen 4 Max: announced with no model card, input and output price not published, no score published, context window not published, weights not stated. A footer reads Qwen 4 Max was announced 2026-09-22 with no specification published; Claude Sonnet 5.5 figures per Artificial Analysis v4.3.2 and Anthropic.

この発表が有益に確立している唯一のことは、方向性だ。アリババの最新の出荷中フラッグシップである Qwen3.8 Max は、ベンダー自身の移行ガイドによって、GPT-5.5、Claude Opus 4.7、Gemini 3.1 Pro に直接対抗する位置づけにあり、Qwen 4 Max が置き換えるために作られているティアでもある。したがって、後継モデルの標的は、その数値が読めなくても判別できる。そして、価格で打ち負かさなければならないモデルは、すでに販売されているものだ。

今日利用できるQwen、新しいSonnetと比較した価格設定

Qwen3.8 Max は 2026年8月3日から一般提供されています。これまでで Alibaba の最高性能ティアであり、テキスト・画像・動画を入力しテキストを出力するネイティブなマルチモーダル対応、1,000,000トークンのコンテキストウィンドウ、思考モード、関数呼び出し、組み込みツール、構造化出力を備え、OpenAI 互換・Anthropic 互換およびネイティブの DashScope エンドポイント経由で提供されます。Alibaba はこれを、同社が Claude Sonnet 5.5 を想定しているのと同じ、要求の厳しい多段階分析やエージェント的作業向けに位置づけており、両者はほぼまったく同じ代表的な料金に着地します——ここからが、この比較が面白くなるところです。

• 入力価格 — Claude Sonnet 5.5 は100万あたり$2.00、Qwen3.8 Max も100万あたり$2.00で、同一

• 出力価格 — Claude Sonnet 5.5 $10.00 vs Qwen3 Max $6.00

• キャッシュ読み取り — Claude Sonnet 5.5 は100万あたり$0.20、Qwen3.8 Max は100万あたり$0.25

• キャッシュ書き込み — Claude Sonnet 5.5 100万トークンあたり$2.50 対 Qwen3.8 Max 100万トークンあたり$2.50

• コンテキスト — ベンダーの仕様書では Claude Sonnet 5.5 1,000,000 トークン 対 Qwen3.8 Max 1,000,000 トークン;Artificial Analysis は、測定したスナップショットを 983,616 として記録している

最大出力 — Claude Sonnet 5.5 は同期で128,000、Batchesでは300,000。一方、Qwen3.8 Max はベンダーから公開されていない。

• 入力モダリティ — Claude Sonnet 5.5 はテキスト、画像、ファイル、Qwen3.8 Max はテキスト、画像、動画

入力単価は同一で、出力単価は40%安い——これは紛れもなく強力な価格ポジションであり、Qwen3.8 Max がフロンティアモデルとの比較にたびたび登場し続ける理由でもある。ところが、独立した測定結果に目を向けると、その優位性はまったく別のところへ移ってしまう。

独立した数字が価格優位性について語るもの

両モデルは同一のArtificial Analysis Intelligence Index(リビジョンv4.3.2)に基づいており、いずれも推定値ではなく実測値です。

• インテリジェンス指数 — Max Effort 時の Claude Sonnet 5.5 が 56、9月2日時点のスナップショットで Qwen3.8 Max が 45

• Indexタスクあたりのコスト — Claude Sonnet 5.5 $7.60 対 Qwen3.8 Max $5.41

• 出力速度 — Claude Sonnet 5.5 138.7 トークン/秒 対 Qwen3.8 Max 38.2 トークン/秒

• 最初のチャンクまでの時間 — Max Effort の Claude Sonnet 5.5 は 370.8 秒、Qwen3.8 Max は 3.0 秒

• Index全体で生成された出力トークン — Claude Sonnet 5.5 410M 対 Qwen3.8 Max 190M。ボードは、中央値88Mに対して非常に冗長だと指摘している

• GPQA Diamond — Claude Sonnet 5.5 は現在のボードに未掲載、Qwen3.8 Max は 92.8%

• Humanity's Last Exam — Claude Sonnet 5.5 55.0% 対 Qwen3.8 Max 43.1%

• 長文コンテキストの想起 — Claude Sonnet 5.5 82.7% 対 Qwen3.8 Max 80.3%

際立っている点が2つあり、どちらも価格ではない。1つ目は、出力レートが40%安くても、トークン数を考慮に入れるとタスクあたりでは30%安くなるにとどまるという点だ — Qwen3.8 Max はインデックス全体で190Mトークンを出力するのに対し、Claude Sonnet 5.5 は410Mで、Qwenのほうが少ないが、レート差をそのまま維持できるほど少ないわけではない。2つ目は速度で、ここでは形勢が大きく逆転する。Claude Sonnet 5.5 は Qwen3.8 Max より3.6倍速く出力を生成し、毎秒138.7トークン対38.2トークンだ。長い生成では、それが1分と数分の違いになり、これはトークン単位の割引では埋め合わせられない違いだ。

初回トークンの数値は逆方向に作用するため、その注意点は率直に述べておく価値がある。370.8秒は、Claude Sonnet 5.5 を Max Effort かつデフォルトのフォールバックで使った場合の値であり、回答前に非常に大きな思考予算を費やす推論構成でのものだ。より低いエフォートを設定した呼び出し元なら、初回トークンは数秒で得られる。Qwen3.8 Max の3.0秒は、思考挙動が異なるモデルで測定されている。この比較は現実のものだが、比較しているのは構成であり、ベンダーではない。

Artificial Analysis model page for Qwen3.8 Max (0902), a proprietary model released September 2026, showing an Intelligence Index of 45, an output speed of 38.2 tokens per second, $2.00 per million input tokens and $6.00 per million output tokens, $5.41 per Intelligence Index task, 190M output tokens generated during the Index evaluation described as very verbose, and a 984k-token context window.

消えたSonnet移行コストはどこにのしかかるのか

上記のどの行にも現れない運用上の違いが1つあり、稼働中のコードを抱える人にとっては価格差よりも重要です。Claude Sonnet 5.5 は Claude Sonnet 5 と比べて6つの挙動を変更し、そのうち5つは既存の統合を壊します。デフォルト以外の temperature、top_p および top_k は 400 を返すようになりました。thinking: {"type": "disabled"} は 400 を返すため、between_tools に変更し、effort を low、medium、high のいずれかに限定する必要があります。"any" または名前付きツールの強制ツール選択は拒否されるため、ループはauto に移行し、厳格なツール使用または構造化出力を使う必要があります。computer_20251124 コンピュータ使用ツールは Claude API および Google Cloud で拒否されます。また、thinking ブロックは生成元のモデルとアカウントに紐づけられるようになったため、推論は Sonnet 5 から引き継がれますが、別のファミリーへは引き継がれません。6つ目の変更は何も失敗させないため、壊れたまま出荷しやすいものです。ツール呼び出し間のテキストが thinking ブロック内で返されるようになったので、ストリーミングアプリケーションは、表示値を設定するか事前の thinking を無効にするまで、呼び出しの間沈黙します。

Qwen3.8 Max は、Qwen の呼び出し元にそのようなものを一切求めません — これは完全なサンプリング機能の全範囲と標準的なツール呼び出しの形式を備えた OpenAI 互換エンドポイントであり、その Anthropic 互換エンドポイントが存在するのは、まさに Claude 向けに書かれたコードがベース URL の変更だけでそこを指せるようにするためです。すでに Sonnet 5 を使っているチームにとって、Sonnet 5.5 への移行は、確認すべき 5 項目のリストを伴う 1 日分の移行作業です。一方、Qwen3.8 Max への移行は設定変更であり、リスクの性質が異なります。主に API の形ではなく、振る舞いのドリフトに関するものです。

到達可能なものを同じキーに乗せる

2026年9月下旬の現実的なパイプラインが、これらのどちらか一方を選ぶことはない。エージェント経路にはClaudeモデルを走らせ、動画入力や価格が問題になる箇所にはQwenモデルを走らせる。そしてその構成のコストは通常、2つの契約、2つのキー、2つのレート制限面、そしてリクエストが失敗しうる2つの箇所である。OrcaRouterはそれを、200以上のモデルにまたがる単一のOpenAI互換エンドポイントへと集約する。プロバイダの定価をそのまま通し、マークアップを一切加えないため、どちらか側のベンダー料率変更は次回の更新時ではなくその日のうちにここへ反映される。さらに、上流プロバイダ間の自動フェイルオーバーと、複数のモデルから呼び出しを組み立てるためのルーティングDSLを備えている。

Qwen3.8 Max は本日時点で、ここから qwen/qwen3.8-maxとしてルーティングできます。A​libaba の入力 $2.00/出力 $6.00 で、100万トークンのウィンドウ全体をカバーします。また、Artificial Analysis が計測した9月2日時点のスナップショットは qwen/qwen3.8-max-0902として指定できます。スコアが取得された正確なリビジョンが必要なときにどうぞ。当カタログには Q​wen 4 Max も、その他の Q​wen 4 系もありません。A​libaba がルーティング可能なものを公開するまで、Q​wen 4 系が追加されることはありません。Claude Sonnet 5.5 もカタログにはありません——登場からまだ1日で、その経路は A​nthropic 自身の API です。当面は、A​nthropic の $2.00/$10.00 でここから利用できる Claude Sonnet 5がフェイルオーバー先となります。Q​wen3.8 Max はこのカタログを通じて週あたり 52.0 百万トークンのトラフィックを処理しており、Claude Sonnet 5 は 7.9 百万トークンです。これが上記の主張の実践版です。Q​wen の階層は名ばかりのフォールバックではありません。

OrcaRouter model page for qwen/qwen3.8-max, dated 2026-08-03, showing text, image and video input, a 1M-token context window, $2.00 input and $6.00 output per million tokens, a p50 time to first token of 2.27 s, and 52.0M tokens of recent traffic.

発表されたティアのルール

発表されたティアは、調達の選択肢ではなく、スケジューリング上の入力として扱いましょう。Qwen 4 Max は追跡する価値があります。Alibaba のフラッグシップがどこへ向かっているかを示しており、やがてラインナップの頂点で Qwen3.8 Max に取って代わるからです。しかし、それに照準を合わせて計画する価値はありません。計画の拠り所となるものが何もないからです。識別子も、価格も、コンテキストウィンドウも、重みも、測定済みスコアもありません。それを現実のものにする証拠は具体的で、容易に認識できます。すなわち、Alibaba 自身のモデル一覧への記載、価格行、公開されたコンテキストウィンドウ、重みがオープンであれば Hugging Face リポジトリ、そして Artificial Analysis のページです。誰も測定していないモデルは、比較できるモデルではないからです。

それまでは、どちらも実在する2つのモデルの間で決めることになる。あなたの仕事がエージェント的なら、17のIndexポイントと3.6×の出力速度こそが買う価値であり、Claude Sonnet 5.5のタスクあたりコストが高いのは、その代価だ。あなたの仕事が動画入力を受け取り、Q​wenの請求でネイティブのAnthro​pic互換エンドポイントを必要とするか、あるいは単に10ドルの出力レートを正当化できないなら、Qwen3.8 Maxは今、同じ入力価格で、出力は40%安く、最初のトークンが数秒で届くという条件でセール中だ——そして正直な注意点は、生成が始まると遅く感じられることだ。それが、より安い料金と引き換えに得られるトレードオフである。

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新