一張生成的主視覺卡片,標題為「Claude Haiku 5.5 vs Aion 3.5」,眉題為「輸入價格的 30 倍」,副標題為「一個有評分。一個沒有。」,並帶有標籤寫著每百萬輸入 token $0.10 對 $3.00、AA Index 43 對無,以及 1M 對 262K 上下文。
Guides & Insights

Claude Haiku 5.5 對比 Aion 3.5:一款無人評分過的模型,輸入價格卻高達三十倍

作者

Alistair Wren

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

Claude Haiku 5.5 的定價為每百萬輸入 token 0.10 美元。Aion 3.5 的定價為 3.00 美元。對於同樣能接受長文字提示並回傳文字的兩個模型來說,這代表輸入價格是三十倍、輸出價格是十二倍,而這個差距無法用能力來解釋——它取決於兩家公司各自在賣什麼。Claude Haiku 5.5 於 2026 年 10 月 7 日發布,是一款以大宗商品價格提供的主力模型,具備努力程度調節鈕與獨立評分。Aion 3.5 由 AionLabs 於 2026 年 9 月 23 日發布,是一款強制推理的集成模型,有兩種規模,其中一種確實便宜。這三十倍的溢價是否值得付出,完全取決於廠商尚未回答的一個問題。

先說令人不安的部分:Artificial Analysis 已為 Claude Haiku 5.5 評分,卻從未公布 Aion 3.5 的分數。我們能找到的其他單位也都沒有。所以這不是兩項實測結果的比較。這是一項實測結果與一組廠商宣稱之間的比較,而誠實的寫法,是在每一節都如此說明,而不是只在註腳裡提一次。

這兩個模型,各用一段來說明。

Claude Haiku 5.5是供應商的小型模型,ID 為 claude-haiku-5-5,支援文字與圖像輸入、文字輸出,具有 1M token 上下文視窗、128,000 token 最大輸出(在 Batch API 上使用 beta 標頭時為 300,000),訓練資料截止於 2026 年 6 月,且 Anthropic 承諾在 2027 年 10 月 7 日之前不會將其退役。Effort 可調整為 Low、Medium、High、Xhigh 和 Max,預設為 Medium,並預設啟用自適應思考。快取讀取每百萬 token 收費 $0.01。當提示超過 100,000 token 時,輸入與輸出費率皆乘以五。

Aion 3.5 是 AionLabs 的旗艦模型,ID 為 aion-labs/aion-3.5,且雙向皆僅支援文字。上下文為 262,144 個 token——是 Aion 3.0 的 131,072 的兩倍——最大輸出為 32,768 個 token。推理是強制性的而非可選的,預設為 high,可調升至 max 或調降至 low。在架構上,它被描述為 GLM 家族中的多模型集成,而非單一訓練網路,這是它最有趣的地方,也是最難從外部驗證的一點。定價為每百萬輸入 token 3.00 美元、快取輸入 0.75 美元、輸出 6.00 美元,在整個視窗內均一費率。同日推出的 Aion 3.5 Mini,在同樣的 256K 上下文下為 0.70 / 0.18 / 1.40 美元——而正是這個較小的兄弟型號讓這場對決變得有趣。

A capture of the AionLabs documentation page listing available models and their pricing, showing Aion 2.0, Aion 3.0, Aion 3.0 Mini, Aion 3.5 and Aion 3.5 Mini with their context windows and per-million input, cached-input and output rates, including Aion 3.5 at 256K context and Aion 3.5 Mini at the lower tier.

• 尺寸,每行一項

• 輸入價格 — Claude Haiku 5.5 每百萬個 token 為 $0.10,適用於 100K token 以內,超過後調升至 $0.50;Aion 3.5 則在整個 256K 視窗內均一價 $3.00。

• 輸出價格 — Claude Haiku 5.5 每百萬 $0.50,至 100K 後為 $2.50;Aion 3.5 一律 $6.00。

• 快取輸入 —— Claude Haiku 5.5 讀取每百萬 $0.01,五分鐘寫入為 $0.125;Aion 3.5 的快取輸入為 $0.75,且未另行公布讀取費率。

• 上下文視窗 — 1,000,000 詞元,相較於 262,144。

• 最大輸出 — 128,000 個 token,相較於 32,768。

• 輸入模態——文字與圖像對比純文字。

• 推理控制 — 從 Low 到 Max 的五段式投入程度調整,相較於三檔且預設為 high。

• 獨立評分 — Artificial Analysis 智慧指數 43,Max 配置下為 43.40,在 182 個模型中排名第二;Aion 3.5 則未公布任何評分。

• 每項完成任務的成本 — Claude Haiku 5.5 在 Artificial Analysis 指數任務上為 0.21 美元;Aion 3.5 因沒有分數而無法衡量。

• 輸出速度 — Claude Haiku 5.5 為每秒 243.4 個 token;Aion 3.5 未回報。

為什麼固定費率不像表面上看起來那樣划算

Aion 3.5 在 256K 範圍內均一價 $3.00,是其定價中最乾淨俐落的一點,也是對 Anthropic 那邊尷尬處境的直接回應:一個從 99,000 成長到 101,000 個 token 的提示,每 token 成本會變成五倍,這逼得你要嘛遠低於那條界線,要嘛完全放棄便宜費率區間。Aion 3.5 沒有界線。你可以送出 240,000 個 token,而支付的每 token 費率與 4,000 個 token 時相同。

那種優勢,在你針對真實工作負載實際算一下帳的瞬間就煙消雲散了。在 Aion 3.5 上,一次 240,000 個 token 的呼叫,輸入費用約為 $0.72;同樣的呼叫若在 Claude Haiku 5.5 上且超過門檻,則約為 $0.12。即使支付超過 100K 之後的懲罰性費率,在兩個模型都能處理的最大提示上,Haiku 5.5 的成本仍大約只有六分之一。均一費率消除的是一道斷崖,而不是成本。

固定定價真正有幫助的地方,在於可預測性。一條管線的提示大小若在 80,000 到 130,000 個 token 之間浮動,用分層方案來編預算會很痛苦,用固定定價則輕而易舉;而如果你的情況正是如此,那麼甚至在能力進入討論之前,Aion 3.5 的固定定價本身就已經有它的價值。

支持 Aion 3.5 的論據,以證據容許的最強力度加以陳述

有三個論點站得住腳。首先,在高預設值下強制推理意味著較少提示工程:沒有 effort 參數需要調校,也沒有低設定悄悄降低某個沒人重新測試過的任務品質的風險。其次,GLM 家族中的集成模型與單一 Anthropic 小型模型的失敗特徵確實不同;如果你已經在大範圍使用 Claude Haiku 5.5,即使輸入價格高出三十倍,一個不相關的第二意見仍有價值——你只會很少把請求導向它。第三,Aion 3.5 Mini 以 $0.70 / $0.18 / $1.40 的價格提供相同的 256K 上下文,是可信的廉價層級;任何只看旗艦模型的比較,都是在比較錯誤的 Aion 模型。

站不住腳的是,把三十倍的溢價當成三十倍能力的證據。AionLabs 並未發布任何我們能找到的 Aion 3.5 基準測試,沒有任何獨立實驗室為它評分,而該集成(ensemble)宣稱也沒有附上任何公開評估。一家擁有比 Claude Haiku 5.5 更強模型、且能加以證明的供應商,就會拿出證明。

Claude Haiku 5.5 徹底勝出的地方,而且差距還不小

其一,影像輸入。Aion 3.5 僅支援文字,而 Claude Haiku 5.5 可接受影像,這在還沒提到價格之前,就已決定了任何文件、螢幕擷取畫面或圖表的工作負載。其二,最大輸出:128,000 個詞元對上 32,768 個,且在 Batch 上還有 300,000 個詞元的 Beta 路徑。還有 effort 調節盤,它是成本控制機制,而非能力:在 Low 設定下,Claude Haiku 5.5 產生的推理詞元少得多,而由於推理會以輸出計費,這正是讓你讓多話的代理維持在低成本區間的方法。

獨立評分是這件事的最終定論。在 Artificial Analysis 的指數中,Claude Haiku 5.5 的整體得分為 43,在其 Max 配置下為 43.40,在 182 個模型中排名第二,每項指數任務成本 $0.21,輸出速度為每秒 243.4 個 token。這些都是獨立跑出來的數字。Aion 3.5 則完全沒有,而在它有了之前,買家實際上所做的比較是「一個有公開評分、且價格可預測的模型」對上「一個價格更高、卻沒有評分的模型」,這對生產路徑而言並不是個困難的抉擇。

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Aion 3.5 — the scoreboard'. Claude Haiku 5.5 reads input $0.10 to $0.50 per million, output $0.50 to $2.50, 1M-token context, 128K maximum output, AA Index 43, text and image in; Aion 3.5 reads input $3.00 flat, output $6.00 flat, 262K context, 32K maximum output, no published independent score, text only. A footer notes that Claude Haiku 5.5 figures are per Artificial Analysis and Aion 3.5 figures are vendor-reported and unreproduced.

同時執行兩者,而無需加倍底層管線

Aion 3.5 可透過 AionLabs 的 API 及數個第三方平台存取。Claude Haiku 5.5 則可透過 Anthropic 的 API 取得,並從該處在 Anthropic 模型可及的任何地方使用。目前兩者皆未在 Orion 的 API 上架,我們也不會暗示並非如此:我們在這個市場區塊所路由的是anthropic/claude-haiku-4.5、anthropic/claude-sonnet-5.5、anthropic/claude-opus-5.5以及anthropic/claude-fable-5.1——也就是本文所談模型之上的層級。

這裡之所以重要,是因為對這種搭配而言,合理的架構是讓昂貴的模型只承接一小部分流量。你不會把整條管線搬到每百萬次 $3.00 的模型組合上;你會把其中值得花 $3.00 聽取第二意見的那 2% 呼叫送過去,其餘一切都留在便宜模型上。這意味著為了 2% 的工作負載,得用上兩家供應商、兩把金鑰和兩套計費介面,而這正是閘道存在的意義。OrcaRouter 以 0% 加價原樣傳遞供應商標價,因此供應商一調價當天就即時生效,而不是得等重新定價的週期,而 A/B 測試只是一個模型字串,而不是多一套整合。若兩邊都不在我們的目錄中,誠實的答案是:我們不是適合這一層的角色,你要的是直接整合。

A capture of Anthropic's Claude Platform models documentation showing the current Claude lineup — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 — with each model's context window, maximum output and per-million input and output pricing.

「什麼能解決這件事?」

對 Aion 3.5 的一項獨立評估。這就是整塊拼圖中唯一缺少的那一塊。如果一家中立實驗室給它的評分,只要接近 Claude Haiku 5.5 以每項任務 $0.21 得到的 43 分,那麼 AionLabs 就是為了達到同等表現而收取三十倍的輸入價格,而集成式方案的故事就成了負擔,而不是賣點。如果它的得分明顯更高,那麼這個溢價就是真實的,而正確做法就是把它花在那一小部分真正需要它的呼叫上。在這個數字出現之前,買家在兩者之間做選擇,就是在一個有實測數據、價格公開的模型,與一個未經實測、價格更高的模型之間做選擇——而在這組對比中,只有一個站得住腳的預設選項。

這意味著,只為了百分之二的工作負載,就得有兩個供應商、兩把金鑰和兩套計費介面,而這正是閘道器的用途。