
Claude Haiku 5.5 対 Ling 3.0 Flash:これらのモデルのうち1つにはすでに後継が存在する
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258知能
- xAIGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
まずは奇妙な事実から始めよう。それが判断を左右すべき事実だからだ。Ling 3.0 Flash——Ant Groupの1240億パラメータのオープンウェイトモデルで、2026年8月にMITライセンスの下で公開された——は現在、非推奨としてフラグが立てられており、その後継としてLing 3.1 Flashが指定されている。Claude Haiku 5.5は、本稿執筆の2日前である2026年10月7日に登場し、Anthropicは2027年10月より前にこれを廃止しないことを約束している。同じ価格帯にある2つのモデル、そしてそのうちの一方はすでに自らの後継を指し示されている。
その非対称性は品質への判定ではない。Ling 3.0 Flash は、オープンウェイトで特異なアーキテクチャを備えた、紛れもなく高速なモデルであり、いくつかの軸では Anthropic ティアを完全に上回る。しかし、だからこそこの比較には有効期限がある。両者を同じくらい長持ちすると扱う論考は、期限切れになる部分をあなたに売りつけているのだ。
2つのリリース、まったく異なる2つの時代
ここに示す独立系の数値はArtificial Analysisによるもので、ベンダー固有の主張はモデルカードおよびドキュメントに基づくものであり、ラベル付けされています。
• リリース — 2026年8月4日にLing 3.0 Flash、Hugging Faceリポジトリは8月2日付。2026年10月7日にClaude Haiku 5.5。
• ライセンス — Ling 3.0 FlashはMITで、オープンウェイトとしてはほぼ最も寛容なライセンスです。Claude Haiku 5.5はプロプライエタリで、API専用です。
• ステータス — Ling 3.0 Flash には、Ling 3.1 Flash を指す非推奨フラグが付いています。Claude Haiku 5.5 は現行で、2027年10月まで廃止しないことを確約しています。
• 採用状況 — Ling 3.0 Flash リポジトリは11,797ダウンロードと427いいねを獲得しています。これは現実的ではあるものの控えめな足跡であり、このモデルをめぐってサードパーティ製ツールがどれだけ成長したかを示す妥当な代理指標です。
時間の隔たりは、6週間という数字が示す以上に重要な意味を持つ。Ling 3.0 Flash は、自らのファミリーがすでに動き出していた時期に出荷された。一方、Claude Haiku 5.5 は、後継機が一切発表されていない系統の最新メンバーとして出荷された。
アーキテクチャこそ、二度読む価値のある部分だ

Ling 3.0 Flashは、総パラメータ数1,240億、トークンあたり有効パラメータ数51億のmixture-of-expertsモデルです。この比率こそが経済性の根拠のすべてです。大規模モデルのメモリフットプリントに収めながら、小規模モデルの計算コストで済みます。公開されている構成は具体的であり、標準的なトランスフォーマーを焼き直したものではありません:
• レイヤリング — 5:1 の比率で 7 個の Gated MLA 層を伴う 35 個の KDA 層、さらに 2 個の dense 層。公開されているトレーニングレシピでは、長いウィンドウをゼロからトレーニングするのではなく、コンテキストウィンドウを 8K から 32K、さらに 256K へと段階的に移行する。
• エキスパート — 512のルーティングされたエキスパートと1つの共有エキスパート、トークンあたり8つが活性化、隠れサイズ2,560、エキスパート中間サイズ768、デンス中間サイズ6,144。語彙は157,184トークンです。
• サービング — カードのリファレンスデプロイメントでは SGLang を --context-length 262144 と共に使用しており、Mooncake キャッシュを用いた HiCache は長い入力において初回トークンまでの時間を 60~80% 以上短縮すると報告しています。これはベンダーによる報告値であり、そのように明記されています。
それらのどれもギミックではない。5.1BのアクティブフットプリントがあるからこそLing 3.0 Flashは到達するスループットで提供でき、キャッシュへの取り組みがあるからこそ長いプロンプトでの初回トークンレイテンシが実用的なまま保たれる。Claude Haiku 5.5のアプローチは逆だ。APIの背後にある単一の高密度なプロプライエタリモデルで、1,000,000トークンのウィンドウを持ち、リクエストごとにどれだけの作業を行うかを適応的に考える。同じコストの問いに対する、首尾一貫した2つの答えである。
数字を横に並べて

• 独立スコア — Intelligence Indexで43のClaude Haiku 5.5は、182中2位。Ling 3.0 Flashは20で、自クラス65中3位。
• 100万トークンあたりの入力価格 — Claude Haiku 5.5 は10万トークンまで$0.10、それを超えると$0.50。Ling 3.0 Flash は$0.075、キャッシュ割引80%付き。
• 100万トークンあたりの出力価格 — Claude Haiku 5.5 は10万トークンまで $0.50、それを超えると $2.50。Ling 3.0 Flash は $0.22。
• ブレンドコスト — ボード独自のブレンドでは、Ling 3.0 Flash が100万トークンあたり$0.05であるのに対し、Claude Haiku 5.5 は$0.08です。
• 速度 — Ling 3.0 Flashは毎秒333.6出力トークンで、同クラス65モデル中トップ、Claude Haiku 5.5の240.4に対する数値です。初回トークンまでの時間はほぼ互角:2.50秒 対 ボードによるアンソロピックのモデルの測定値。
• コンテキスト — Ling 3.0 Flashは262,000トークン、Claude Haiku 5.5は1,000,000トークン。
• 入力モダリティ — Ling 3.0 Flash はテキストのみ。Claude Haiku 5.5 はテキストと画像。
• 重み — Ling 3.0 Flash は MIT ライセンスでダウンロード可能。Claude Haiku 5.5 はプロプライエタリ。
Lingの売りはスピードと価格であり、深さではない
43と20の間にある23ポイントのIndex差が最大の注目点であり、それはこの種のあらゆる比較と同じ方向を指している。Claude Haiku 5.5のほうがより強力なモデルで、その差は小さくない。しかしLingの列は2つの行で明確に勝っており、どちらも請求書やレイテンシ予算に現れる類のものだ。
まず、スループットです。毎秒333.6トークンはリーダーボード上で同クラス最速で、Claude Haiku 5.5 を約39%上回ります。さらに、より低い混合コストと組み合わせると、大量生成——分類スイープ、データラベリング、大量の構造化抽出——を Ling 3.0 Flash で実行する方が、計測できるほど安上がりになることを意味します。タスクが十分に規定されていて、失敗モードが明白な場合、23 Indexポイント後れを取っているモデルでも、依然として正しい選択になり得ます。
第二に、80% のキャッシュ割引です。大きな安定したプレフィックスと小さく変動するテールを持つワークロードでは、Ling 3.0 Flash の実効入力レートは表示価格を大きく下回り、モデルカードのキャッシュ設計はまさにそのパターンを狙っています。Claude Haiku 5.5 の $0.01 というキャッシュ読み取りレートは絶対額では安いものの、キャッシュ書き込みには $0.125 かかり、またこのモデルには Ling にはない 100,000 入力トークンでの段階的価格設定があります。
つり合いを取る要因は冗長性であり、それはAnthropicモデルにも当てはまる同じものだ。Artificial Analysisは、Ling 3.0 FlashでIndexを実行した際に2億6,000万出力トークンを記録し、中央値の1億トークンと比べて、それを冗長だと指摘している。トークン単位課金のモデルでは、これは料金上の優位性を損なう——出力単価が2.3倍安くても、より多くのトークンを書くモデルによって一部が相殺されるなら、その優位性はカードが示唆するほど大きくはない。
ベンダーのベンチマークが謳うこと、そして謳わないこと
Ling 3.0 Flash 自身のカードは、強力な数値セットを報告している:MathArena AIME 2026 は 93.2、HMMT February 2026 は 87、SWE-Bench Pro は 56.6、SWE-Bench Multilingual Resolved は 72.4、Humanity's Last Exam は 22.7。これらの数値はすべてベンダー報告であり、ここで独立に再現されたものは一つもない。また、同じハーネス上で Claude Haiku 5.5 と比較して測定されたものでもない——Anthropic は独自の数値セット(GDPval-AA v2.1 は 1620、OSWorld 2.1 は 72.4%、Terminal-Bench 4.0 は 39.2%)を公開しており、両ベンダーは異なるスイートを実行した。唯一共有されている測定は独立系ボードであり、そこでの答えは明白だ。
数学のスコアと併せて注目すべき点:HLEの22.7という数値は、AnthropicがClaude Haiku 5.5について報告しているツールなしの45.9を大きく下回っている。異なるハーネスなので直接比較はできないが、ハーネスの選択で説明がつくほどの差でもない。

後継者問題
これは、現在の四半期より先を見据えて計画を立てる人にとって、比較の判断を左右する部分であり、ベンチマークとは一切関係がない。
Ling 3.0 Flash は Ling 3.1 Flash に取って代わられ、非推奨となりました。とはいえ、動作しなくなるわけではありません。オープンウェイトは期限切れになりませんし、MIT ライセンスは取り消せません。しかし、それを取り巻くエコシステムが徐々に移り変わっていくことは意味します。推論フレームワークのサポート、量子化リリース、バグ修正、コミュニティツールはどれも現行モデルに追随し、非推奨となったモデルはその関心の最後尾に回されます。今日 Ling 3.0 Flash を使って構築しているなら、あなたは凍結され完成しきったウェイトの上に構築していることになります。これは安定したワークロードには問題ありませんが、改善を期待するものにとっては厄介です。
Claude Haiku 5.5 には、ちょうど鏡像をなす保証のセットがある。重みは手に入らないが、モデルを高速に保ち、パッチを当て、提供し続けることに商業的利害を持つベンダーが手に入る。さらに、2027年10月までの退役しないというコミットメントと、それが終わる際にはいつでも公開される移行パスも得られる。
このルートの両側を、一つの鍵で
正直な提供状況について:OrcaRouter は Ling 3.0 Flash を取り扱っておらず、Claude Haiku 5.5 も取り扱っていません。Ling 3.0 Flash はベンダー自身の配布チャネルおよび複数のサードパーティプラットフォームを通じて提供されており、Claude Haiku 5.5 は Anthropic の API と主要クラウドプラットフォームで利用できます。
残るのは、両モデルが提起するルーティングの問いです。Claude Haiku 5.5(43)と100万トークンのウィンドウは自然なエスカレーション先であり、毎秒333トークンのLing 3.0 Flashは自然なバルク処理レッグです。大量で仕様が明確な作業を高速ティアに送り、長さまたは品質のチェックに失敗したものをより強力なティアへエスカレーションするルートは、まさにルーターが構成する配置です — OrcaRouterでは、AnthropicのClaude Haiku 4.5、Claude Sonnet 5.5、Claude Opus 5.5が本日カタログに掲載されており、さらにDeepSeek V4.1 FlashやGLM 5.3 Flashのような大規模なオープンウェイトの選択肢もあるため、エスカレーション用レッグとバルク用レッグの両方を今すぐ構築して負荷テストできます。1つのキーで、その下に自動フェイルオーバーがあり、プロバイダーの定価は0%のマークアップでそのまま適用されるため、価格変更は当日に有効になります。
2つのうちどちらで、どのくらいの期間ですか?
仕事がオープンエンドなら、画像や100万トークンのウィンドウが必要なら、稼働率について責任を負うベンダーを求めるなら、あるいは次の四半期より先まで計画しているなら、Claude Haiku 5.5 を選びましょう。Index ポイントで 23 ポイント上回っており、非推奨ではなく現行で、価格差はスコア差が支配的になるほど小さいからです。
Ling 3.0 Flash を選ぶべきなのは、ワークロードが大量で、仕様が明確で、レイテンシに敏感な場合、MIT ライセンスやオープンウェイトが重視すべき点である場合、あるいは安定したプレフィックスに対する 80% のキャッシュ割引が請求額の実態を左右する場合だ。これはより高速なモデルで、トークンあたりのコストも安く、20-Index モデルが扱えるタスクは本当に得意だ。ただし、導入するのは保守され続けるモデルではなく完成済みのモデルであり、それが指し示す後継モデルはすでに存在することを承知しておこう。
