
Dots 対 Qwen 3.8 Max:違いは、それをどこへ動かすことを許されるかにある
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 349 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2237知能
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- xAINEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 210 tok/s
- OrcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- xAISpaceXAI: Grok 4.62026-08-1244知能77コーディング
Qwen 3.8 Maxは2026年8月3日に公開され、Alibabaがこれまでに提供した中で最高性能のティアである。ネイティブにマルチモーダルで、テキスト、画像、動画を受け取り、テキストを返し、1,000,000トークンのコンテキストウィンドウに対応する。北京、シンガポール、東京、フランクフルト、バージニアから、OpenAI互換、Anthropic互換、ネイティブDashScopeという3つのワイヤーフォーマットで提供され、価格は入力トークン100万あたり2.00ドル、出力トークン100万あたり6.00ドル、キャッシュ読み取りは0.25ドルである。Dotsは同社の常時稼働エージェントで、2026年9月29日のDevDayで発表された。専用のクラウドコンピュータとブラウザを備え、4,000を超えるアプリに到達し、GPT-6 Astra上で動作し、ProとBusiness Premiumに含まれる。並べて比べたとき、興味深い問いはどちらがより高性能かではない。それぞれがどれだけ多くの場所に存在することを許されるのか、そして誰が決めるのかである。
それは抽象的な区別ではない。あるツールがあなたの市場でそもそも利用できるかどうか、あなたのコンプライアンスチームがそれを監査できるかどうか、そしてその上に築いた仕事が規約変更を乗り越えて残るかどうかを決める区別だ。機能性はこの比較のやさしい部分であり、ポータビリティは遅い段階で高くつく形で決着する部分だ。
1つのモデルを呼び出す3つの方法
ワイヤーフォーマットは、アプリケーションをベンダー間で移行しなければならなくなるまでは、小さなエンジニアリング上の詳細のように思える。OpenAI 互換のサーフェスとは、既存のクライアントライブラリが変換レイヤーなしで動作することを意味する。Anthropic 互換のサーフェスとは、別のベンダーのメッセージ形状に合わせて書かれたコードベースを書き直す必要がないことを意味する。ネイティブの DashScope インターフェースは、thinking トグルを含む全機能セットを公開する。1つのモデルに対して3つのサーフェスがあるということは、切り替えのコストが base URL とキーであり、リファクタリングではないということを意味する。
それが最も重要になるのは、それが存在しないときだ。dot には、フォーマットや URL、キーを提供するものは何もない。なぜなら dot は呼び出すものではなく、誰か他人のインターフェースの中で話しかけるものだからだ。あなたのエージェントロジックを別の場所へ移すということは、それを再構築し、次にそれが依存していた 4,000 個のコネクタを再接続し、次にそのうちどれがあなたの書き留めていなかった振る舞いをしていたのかを突き止めることを意味する。
• 購入するもの — ChatGPT、Slack、Teams 内で動くホスト型ワーカー(Dots) 対 どこからでも呼び出せるモデルエンドポイント(Qwen 3.8 Max)
• インターフェース — ドット向けには、OpenAI 互換、Anthropic 互換、およびネイティブ DashScope サーフェスに対する公開は何もありません(Qwen 3.8 Max)
• 実行環境 ― 独自のブラウザを備えた OpenAI のクラウドコンピュータ(Dots)を、アジア、ヨーロッパ、北米にまたがる 5 つの提供リージョンと対戦させた(Qwen 3.8 Max)
• 推論制御 — ドットでは公開されておらず、enable_thinking トグルや reasoning.effort(Responses API 上、Qwen 3.8 Max)とは対照的です
• 単価 — 最初のドットは Pro または Business Premium に含まれ、許容量は未公開(Dots)である一方、100万入力あたり$2.00、100万出力あたり$6.00、キャッシュ読み取りは$0.25(Qwen 3.8 Max)
• 独立したエビデンス — ベンダーのデモと能力に関する主張のみで、ベンチマークは皆無。これに対し、Artificial Analysis Intelligence Index は 45.4 で、測定された 145 モデル中 15 位、GPQA Diamond では 92.8(Qwen 3.8 Max)
モデルがたどり着く先を、確認できる数字で
Qwen 3.8 Maxの公表プロファイルは中位フロンティアに位置するもので、印象論ではなく正確に読む価値がある。AAインテリジェンス指数45.4は、測定対象145モデル中15位という順位づけであり、トップ10%圏内に入れつつも首位には置かない。AAコーディング指数76.2は138中9位でより強く、Terminal-Bench 2.1での88.8は真に高いエージェント実行の数値だ — 同じボードでのGPT-5.6 Solの88.0を上回る。比較的弱いのは長文脈リコールの80.3で、これは同程度のウィンドウサイズにもかかわらずKimi K3の88.7とMiniMax M3の83を下回っており、そしてSciCodeの52.1である。
Alibabaは、自社の移行ガイドの中で、このモデルをGPT-5.5、Claude Opus 4.7、Gemini 3.1 Proの直接の対抗馬として位置づけている。そして数字を正直に読めば、これは、強いエージェント的実行力とマルチモーダル入力を組み合わせたものが、知能ランキングで首位に立つことよりも重要なときに選ぶモデルだ。これらの数値はすべて、ベンダーの主張ではなく、出典とともに当社のカタログに掲載されている第三者による測定値である——だからこそ、これらはローンチ用のプレゼン資料以上の価値がある。
欠けている数字が一つあり、それは埋めるのではなく声に出して言うべきものです。当社のカタログには、このモデルの最大出力長が記載されていません。100万トークンのコンテキストは記載されていますが、応答ごとの出力上限は記載されていません。

Dotsがあなたに伝えないこと、そしてそれがデザイン上の選択である理由
OpenAIは、ドットの費用について一文を公表しているが、そこに数字は含まれていない。最初のドットはProとBusiness Premiumに含まれており、最初の月は拡張された上限が適用され、それとの会話ではChatGPTの利用上限が消費されない。それ以外には、許容量の数字も、2つ目のドットの価格も、追加容量の料金も、タスクごとのコストもない。月額500ドルのPro 500ティアは、ドット単位の料金ではなく、利用許容量とUltrafastモードを組み合わせたものであるため、最も高価なプランでさえ、エージェント作業1単位あたりのコストには換算できない。
それをドキュメントの欠落と読むのは誘惑的だ。より正確には、それをカテゴリーの問題として読むべきだ。席単位で価格設定された製品は、単位あたりの価格を持てない。なぜなら、席の要点は、それを使うことの限界費用が見えないことにあるからだ。これは探索的な作業には本当に便利で、プロジェクト、顧客、予算項目に帰属させなければならないものには本当に不便だ。
2つの製品が何に最適化されているかに注目してください。Qwen 3.8 Max は、呼び出し元がすでに話している形式が何であれ、どこからでも、何からでも呼び出されることに最適化されています。A dot は、配管を隠したまま、1つの場所で、1つのインターフェースによって使われることに最適化されています。どちらも首尾一貫した設計であり、ただ異なる問いに答えているだけです。そして、その一方は「これを後で移せるか」という問いにノーと答えています。

「このベンダーが変わったらどうなるか」に対する2つの答え
移植性の問題が具体的になるのは、ベンダーが価格を変更したり、識別子を非推奨にしたり、サブスクリプションに含まれる内容を変えた瞬間です。3つのワイヤ形式を持つ従量制モデルなら、対応は機械的です。クライアントの接続先を別のベースURLに変えるか、1つのモデル文字列を変更すれば、アプリケーションは動き続けます。移植すべきものはほかに何もありません。なぜなら、そのモデルは呼び出し以外の何物でもなかったからです。
dot の場合、規約変更への対応は停止することだ。コンピューター、ブラウザー、コネクター、利用枠はすべて OpenAI のものであり、そのいずれもエクスポートできない。それは製品への批判ではない。レンタルというものの正直な説明である。しかし、それは dot の内部だけで構築したものの移行パスが書き直しを経由することを意味しており、1年間依存するつもりのものを構築する前に、その事実をコストとして織り込む価値がある。
OrcaRouterは前者のケースのために作られています。Qwen 3.8 Maxはqwen/qwen3.8-maxとして、Alibabaのプロバイダー定価を0%のマークアップでそのまま反映した価格でルーティングされ、1つのキーの背後にある200以上の他のモデルと同じカタログにあり、上流プロバイダー間の自動フェイルオーバーと、複数のモデルを1つのリクエストに組み合わせるためのルーティングDSLを備えています。これにより、3リージョンに関する問いは、ベンダー側ではなくあなたの側で答えられるものになります。同じ識別子が、モデルがどこで提供されていてもそのモデルに到達し、Alibabaからの料金変更は次回の更新時ではなくその日のうちにあなたの請求に反映されます。ただし、ドットの内側にあるものには何も到達しません — そのためのエンドポイントも、識別子も、差し替えられる代替の知能も存在しないのです。
コミットする前に問うべき質問
ベンダーがあなたの制御できない何かを変更するその日に、あなたの成果物がどうなるのかを尋ねてください。答えが「文字列を1つ変えて先に進むだけだ」なら、あなたが買っているのはモデルであり、従量課金制のもののほうがよい買い物です。答えが「作り直さなければならない」なら、あなたが買っているのはプロダクトであり、熟慮して買うべきです — あなたが支払っている利便性は、可逆性を代償に得られているのだと知ったうえで。
どちらの答えも間違いではない。決して使わないポータビリティを買うことは、逃げ出さなければならなくなる便利さを買うことと同じくらい無駄だ。間違いは、自分がどちらを買ったのかを知らないことにある。

この記事で比較したモデル2
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
