
Claude Haiku 5.5 対 Aion 3.5:誰もスコアを付けていないモデルに対して、入力価格は30倍
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258知能
- xAIGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 56 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
Claude Haiku 5.5は、100万入力トークンあたり0.10ドルでリストされている。Aion 3.5は3.00ドルでリストされている。これは、どちらも長いテキストプロンプトを受け取ってテキストを返す2つのモデルについて、入力価格が30倍、出力価格が12倍であることを意味しており、その差は能力では説明できない——各社が何を売っているかで説明できる。2026年10月7日にリリースされたClaude Haiku 5.5は、エフォートダイヤルと独立したスコアを備えたコモディティ価格の主力モデルだ。AionLabsが2026年9月23日にリリースしたAion 3.5は、推論が必須のアンサンブルで、2つのサイズがあり、そのうち1つは本当に安価だ。30倍の割増を払う価値があるかどうかは、ベンダーがまだ答えていない1つの問いに完全にかかっている。
まず不快な点を先に言っておく。Artificial Analysis は Claude Haiku 5.5 を採点しているが、Aion 3.5 のスコアは一度も公表していない。我々が見つけられる限り、他の誰も公表していない。したがってこれは、測定された二つのものの比較ではない。測定された一つのものと、ベンダーの主張一式との比較であり、正直に書くなら、脚注で一度だけではなく、すべてのセクションでそう言うべきだ。
2つのモデルについて、それぞれ1段落で
Claude Haiku 5.5はベンダーの小型モデルで、IDはclaude-haiku-5-5、テキストと画像を入力、テキストを出力し、コンテキストウィンドウは100万トークン、最大出力は128,000トークン(Batch API でベータヘッダーを使用する場合は300,000トークン)、トレーニングデータのカットオフは2026年6月で、Anthropic は2027年10月7日より前にこのモデルを廃止しないことを約束しています。Effort は Low、Medium、High、Xhigh、Max の間で調整可能で、デフォルトは Medium、適応的思考(adaptive thinking)はデフォルトで有効です。キャッシュ読み取りは100万トークンあたり$0.01です。プロンプトが100,000トークンを超えると、入力と出力の両方の料金が5倍になります。
Aion 3.5はAionLabsのフラッグシップモデルで、IDはaion-labs/aion-3.5であり、双方向ともテキスト専用です。コンテキストは262,144トークン——Aion 3.0の131,072から倍増——で、最大出力は32,768トークンです。推論は任意ではなく必須で、デフォルトはhigh、maxに引き上げることもlowに下げることもできます。アーキテクチャ上は、単一の訓練済みネットワークではなく、GLMファミリーのマルチモデルアンサンブルとして説明されています。これが最も興味深い点であり、同時に外部から検証するのが最も難しい点でもあります。価格は100万入力トークンあたり3.00ドル、キャッシュ済み入力が0.75ドル、出力が6.00ドルで、ウィンドウ全体を通じて一律です。同じ日にローンチされたAion 3.5 Miniは、同じ256Kコンテキストで0.70 / 0.18 / 1.40ドル——そしてこの小さな兄弟こそが、この対決を興味深いものにしています。

• 寸法はそれぞれ1行ずつ
• 入力価格 — Claude Haiku 5.5 は100万トークンあたり $0.10、10万トークンまで、それを超えると $0.50 に上昇。Aion 3.5 は256Kウィンドウ全体を通じて $3.00 で均一。
• 出力価格 — Claude Haiku 5.5 は100万あたり$0.50(100Kまで)、その後$2.50。Aion 3.5 は一律$6.00。
• キャッシュ入力 — Claude Haiku 5.5 は読み取り100万あたり0.01ドル、5分間の書き込みで0.125ドル。Aion 3.5 はキャッシュ入力で0.75ドルで、読み取り料金は別途公表されていない。
• コンテキストウィンドウ — 1,000,000トークン対262,144。
• 最大出力 — 32,768に対して128,000トークン
• 入力モダリティ — テキストと画像 対 テキストのみ。
• 推論コントロール — LowからMaxまでの5ポジションのエフォートダイヤルに対し、highがデフォルトとなる3ポジション。
• 独立系スコア — Artificial Analysis Intelligence Index は43、Max構成では43.40で、182モデル中2位。Aion 3.5については公表なし。
• 完了したタスクあたりのコスト — Artificial Analysis インデックスタスク1件あたり Claude Haiku 5.5 で $0.21。Aion 3.5 はスコアなしでは測定不可。
• 出力速度 — Claude Haiku 5.5 は毎秒 243.4 トークン、Aion 3.5 は未報告。
なぜ定額制は見た目ほどの勝ちではないのか
Aion 3.5の256K全体にわたる一律$3.00は、その料金設定で最も明快な点であり、Anthropic側の厄介さへの直接的な答えだ。99,000から101,000トークンに増えるプロンプトは、トークンあたり5倍のコストがかかる。そのため、境界線のはるか下にとどまるか、安価な料金帯を完全に諦めるかのどちらかを迫られる。Aion 3.5には境界線がない。240,000トークンを送っても、4,000トークンに支払うのと同じトークンあたり料金を支払える。
その優位性は、実際のワークロードで計算した瞬間に消え去る。Aion 3.5 での 240,000 トークンの呼び出しは、入力で約 $0.72 かかる。同じ呼び出しをしきい値超で Claude Haiku 5.5 で行うと、約 $0.12 だ。100K 超のペナルティ料率を払ってもなお、Haiku 5.5 は、どちらのモデルが受け付けられる最大プロンプトにおいて、およそ 6 倍安い。定額レートが取り除くのは崖であって、コストではない。
定額料金が本当に役立つのは、予測しやすさの点です。プロンプトサイズが80,000~130,000トークンの間で変動するパイプラインは、段階制プランで予算を組むには苦痛で、定額制ならごく簡単です。そして、もしあなたのパイプラインがそういう形なら、Aion 3.5の定額制は、能力の話になる前からそれだけの価値があります。
Aion 3.5を支持する論拠を、証拠が許す限り強く述べたもの
3つの論点は成り立つ。第一に、高いデフォルト値での必須の推論は、プロンプトエンジニアリングを減らす。調整すべき effort パラメータがなく、低い設定が、誰も再テストしていないタスクを静かに劣化させるリスクもない。第二に、GLMファミリーのアンサンブルは、単一のAnthropicの小型モデルとは本当に異なる障害プロファイルであり、すでに広い範囲で Claude Haiku 5.5 を動かしているなら、入力価格が30倍であっても、相関のないセカンドオピニオンには価値がある——めったにルーティングすることはないのだから。第三に、同じ256Kコンテキストで $0.70 / $0.18 / $1.40 の Aion 3.5 Mini は、信頼に足る低価格ティアであり、フラッグシップだけを見る比較は、間違ったAionモデルを比較していることになる。
成り立たないのは、30倍のプレミアムを30倍の能力の証拠と見なすことだ。AionLabsは、私たちが確認できる限りAion 3.5のベンチマークを公開しておらず、独立したラボがそれを評価したこともなく、アンサンブルに関する主張にも公開された評価は付随していない。Claude Haiku 5.5より強力なモデルを持ち、それを実証できるベンダーなら、実証するはずだ。
Claude Haiku 5.5 が完全に勝利する場面、しかも大差で
一つ目は画像入力だ。Aion 3.5 はテキスト専用だが、Claude Haiku 5.5 は画像を扱える。この違いは、価格の話が出るよりも前に、あらゆるドキュメント、スクリーンショット、図表のワークロードを決めてしまう。 二つ目は最大出力。32,768 に対して 128,000 トークン、さらに Batch では 300,000 トークンのベータ経路がある。 そしてエフォートダイヤル。これは能力ではなくコスト制御の仕組みだ。Low では、Claude Haiku 5.5 が生成する推論トークンがはるかに少なくなり、推論は出力として課金されるため、冗長なエージェントを安価な帯域内に留めておけるのはまさにここだ。
独立系スコアがこの件の最終的な決め手だ。Artificial Analysisのインデックスでは、Claude Haiku 5.5は総合43、Max構成で43.40に位置し、182モデル中2位、インデックスタスク1件あたり0.21ドル、出力は毎秒243.4トークンとなっている。これらは独立して測定された数値だ。Aion 3.5にはそれがなく、備わるまでは、買い手が実際に比べているのは「公開されたスコアと予測できる価格を備えたモデル」対「より高い価格でスコアのないモデル」であり、これは本番導入の判断としては難しいものではない。

配管を二重にすることなく両方を実行する
Aion 3.5は、AionLabs自身のAPIおよび複数のサードパーティプラットフォームを通じて利用できます。Claude Haiku 5.5はAnthropicのAPIを通じて、さらにそこからAnthropicのモデルが再販されているあらゆる場所で利用できます。どちらも現時点でOrcaRouterのカタログには掲載されておらず、そうであるかのように示唆することもありません。この市場の一角から当社がルーティングしているのは、anthropic/claude-haiku-4.5、anthropic/claude-sonnet-5.5、anthropic/claude-opus-5.5、そしてanthropic/claude-fable-5.1 — 本記事で扱っているモデルの1つ上のティアです。
ここでこれが重要になるのは、この組み合わせにふさわしいアーキテクチャは、高価なモデルにトラフィックのごく一部を流す形だからです。パイプラインを100万あたり$3.00のアンサンブルに移行するのではありません。セカンドオピニオンに$3.00を払う価値がある2%の呼び出しをそこに送り、それ以外はすべて安価なモデルに載せておくのです。つまり、2%のワークロードのためにプロバイダーが2社、キーが2つ、請求の窓口が2つになるということで、これはまさにゲートウェイが担うべき形です。OrcaRouter プロバイダーの定価を0%のマークアップでそのまま通すため、ベンダーの価格変更は値上げサイクルを待たずにその日のうちに反映され、A/Bテストも2つ目の統合ではなくモデル文字列の変更で済みます。どちらの系統も当社のカタログにない場合、正直に申し上げれば当社はその用途に適した層ではなく、直接統合こそが求められるものです。

これを解決してくれるものは何だろうか
Aion 3.5に関する独立した評価が1件。欠けているのはまさにそれだけだ。中立的なラボが、タスクあたり0.21ドルで43を出すClaude Haiku 5.5のスコアに近い点をそれにつけたなら、AionLabsは同等性能のために入力価格の30倍を請求していることになり、アンサンブルという話は機能ではなく負債になる。実質的にもっと高いスコアなら、割増は本物であり、正しい動きはそれを必要とするごく一部の呼び出しに使うことだ。その数値が存在するまでは、この2つのどちらかを選ぶ買い手は、公表価格の測定済みモデルを選ぶか、より高い価格の未測定モデルを選ぶかであり——そのペアで擁護できるデフォルトは1つだけだ。
つまり、2パーセントのワークロードのために、2つのプロバイダー、2つのキー、2つの請求の窓口が必要になる。それはまさにゲートウェイが目的とする形だ。
