
Claude Haiku 5.5 對比 Aion 3.5:一款無人評分過的模型,輸入價格卻高達三十倍
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 56 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
Claude Haiku 5.5 的定價為每百萬輸入 token 0.10 美元。Aion 3.5 的定價為 3.00 美元。對於同樣能接受長文字提示並回傳文字的兩個模型來說,這代表輸入價格是三十倍、輸出價格是十二倍,而這個差距無法用能力來解釋——它取決於兩家公司各自在賣什麼。Claude Haiku 5.5 於 2026 年 10 月 7 日發布,是一款以大宗商品價格提供的主力模型,具備努力程度調節鈕與獨立評分。Aion 3.5 由 AionLabs 於 2026 年 9 月 23 日發布,是一款強制推理的集成模型,有兩種規模,其中一種確實便宜。這三十倍的溢價是否值得付出,完全取決於廠商尚未回答的一個問題。
先說令人不安的部分:Artificial Analysis 已為 Claude Haiku 5.5 評分,卻從未公布 Aion 3.5 的分數。我們能找到的其他單位也都沒有。所以這不是兩項實測結果的比較。這是一項實測結果與一組廠商宣稱之間的比較,而誠實的寫法,是在每一節都如此說明,而不是只在註腳裡提一次。
這兩個模型,各用一段來說明。
Claude Haiku 5.5是供應商的小型模型,ID 為 claude-haiku-5-5,支援文字與圖像輸入、文字輸出,具有 1M token 上下文視窗、128,000 token 最大輸出(在 Batch API 上使用 beta 標頭時為 300,000),訓練資料截止於 2026 年 6 月,且 Anthropic 承諾在 2027 年 10 月 7 日之前不會將其退役。Effort 可調整為 Low、Medium、High、Xhigh 和 Max,預設為 Medium,並預設啟用自適應思考。快取讀取每百萬 token 收費 $0.01。當提示超過 100,000 token 時,輸入與輸出費率皆乘以五。
Aion 3.5 是 AionLabs 的旗艦模型,ID 為 aion-labs/aion-3.5,且雙向皆僅支援文字。上下文為 262,144 個 token——是 Aion 3.0 的 131,072 的兩倍——最大輸出為 32,768 個 token。推理是強制性的而非可選的,預設為 high,可調升至 max 或調降至 low。在架構上,它被描述為 GLM 家族中的多模型集成,而非單一訓練網路,這是它最有趣的地方,也是最難從外部驗證的一點。定價為每百萬輸入 token 3.00 美元、快取輸入 0.75 美元、輸出 6.00 美元,在整個視窗內均一費率。同日推出的 Aion 3.5 Mini,在同樣的 256K 上下文下為 0.70 / 0.18 / 1.40 美元——而正是這個較小的兄弟型號讓這場對決變得有趣。

• 尺寸,每行一項
• 輸入價格 — Claude Haiku 5.5 每百萬個 token 為 $0.10,適用於 100K token 以內,超過後調升至 $0.50;Aion 3.5 則在整個 256K 視窗內均一價 $3.00。
• 輸出價格 — Claude Haiku 5.5 每百萬 $0.50,至 100K 後為 $2.50;Aion 3.5 一律 $6.00。
• 快取輸入 —— Claude Haiku 5.5 讀取每百萬 $0.01,五分鐘寫入為 $0.125;Aion 3.5 的快取輸入為 $0.75,且未另行公布讀取費率。
• 上下文視窗 — 1,000,000 詞元,相較於 262,144。
• 最大輸出 — 128,000 個 token,相較於 32,768。
• 輸入模態——文字與圖像對比純文字。
• 推理控制 — 從 Low 到 Max 的五段式投入程度調整,相較於三檔且預設為 high。
• 獨立評分 — Artificial Analysis 智慧指數 43,Max 配置下為 43.40,在 182 個模型中排名第二;Aion 3.5 則未公布任何評分。
• 每項完成任務的成本 — Claude Haiku 5.5 在 Artificial Analysis 指數任務上為 0.21 美元;Aion 3.5 因沒有分數而無法衡量。
• 輸出速度 — Claude Haiku 5.5 為每秒 243.4 個 token;Aion 3.5 未回報。
為什麼固定費率不像表面上看起來那樣划算
Aion 3.5 在 256K 範圍內均一價 $3.00,是其定價中最乾淨俐落的一點,也是對 Anthropic 那邊尷尬處境的直接回應:一個從 99,000 成長到 101,000 個 token 的提示,每 token 成本會變成五倍,這逼得你要嘛遠低於那條界線,要嘛完全放棄便宜費率區間。Aion 3.5 沒有界線。你可以送出 240,000 個 token,而支付的每 token 費率與 4,000 個 token 時相同。
那種優勢,在你針對真實工作負載實際算一下帳的瞬間就煙消雲散了。在 Aion 3.5 上,一次 240,000 個 token 的呼叫,輸入費用約為 $0.72;同樣的呼叫若在 Claude Haiku 5.5 上且超過門檻,則約為 $0.12。即使支付超過 100K 之後的懲罰性費率,在兩個模型都能處理的最大提示上,Haiku 5.5 的成本仍大約只有六分之一。均一費率消除的是一道斷崖,而不是成本。
固定定價真正有幫助的地方,在於可預測性。一條管線的提示大小若在 80,000 到 130,000 個 token 之間浮動,用分層方案來編預算會很痛苦,用固定定價則輕而易舉;而如果你的情況正是如此,那麼甚至在能力進入討論之前,Aion 3.5 的固定定價本身就已經有它的價值。
支持 Aion 3.5 的論據,以證據容許的最強力度加以陳述
有三個論點站得住腳。首先,在高預設值下強制推理意味著較少提示工程:沒有 effort 參數需要調校,也沒有低設定悄悄降低某個沒人重新測試過的任務品質的風險。其次,GLM 家族中的集成模型與單一 Anthropic 小型模型的失敗特徵確實不同;如果你已經在大範圍使用 Claude Haiku 5.5,即使輸入價格高出三十倍,一個不相關的第二意見仍有價值——你只會很少把請求導向它。第三,Aion 3.5 Mini 以 $0.70 / $0.18 / $1.40 的價格提供相同的 256K 上下文,是可信的廉價層級;任何只看旗艦模型的比較,都是在比較錯誤的 Aion 模型。
站不住腳的是,把三十倍的溢價當成三十倍能力的證據。AionLabs 並未發布任何我們能找到的 Aion 3.5 基準測試,沒有任何獨立實驗室為它評分,而該集成(ensemble)宣稱也沒有附上任何公開評估。一家擁有比 Claude Haiku 5.5 更強模型、且能加以證明的供應商,就會拿出證明。
Claude Haiku 5.5 徹底勝出的地方,而且差距還不小
其一,影像輸入。Aion 3.5 僅支援文字,而 Claude Haiku 5.5 可接受影像,這在還沒提到價格之前,就已決定了任何文件、螢幕擷取畫面或圖表的工作負載。其二,最大輸出:128,000 個詞元對上 32,768 個,且在 Batch 上還有 300,000 個詞元的 Beta 路徑。還有 effort 調節盤,它是成本控制機制,而非能力:在 Low 設定下,Claude Haiku 5.5 產生的推理詞元少得多,而由於推理會以輸出計費,這正是讓你讓多話的代理維持在低成本區間的方法。
獨立評分是這件事的最終定論。在 Artificial Analysis 的指數中,Claude Haiku 5.5 的整體得分為 43,在其 Max 配置下為 43.40,在 182 個模型中排名第二,每項指數任務成本 $0.21,輸出速度為每秒 243.4 個 token。這些都是獨立跑出來的數字。Aion 3.5 則完全沒有,而在它有了之前,買家實際上所做的比較是「一個有公開評分、且價格可預測的模型」對上「一個價格更高、卻沒有評分的模型」,這對生產路徑而言並不是個困難的抉擇。

同時執行兩者,而無需加倍底層管線
Aion 3.5 可透過 AionLabs 的 API 及數個第三方平台存取。Claude Haiku 5.5 則可透過 Anthropic 的 API 取得,並從該處在 Anthropic 模型可及的任何地方使用。目前兩者皆未在 Orion 的 API 上架,我們也不會暗示並非如此:我們在這個市場區塊所路由的是anthropic/claude-haiku-4.5、anthropic/claude-sonnet-5.5、anthropic/claude-opus-5.5以及anthropic/claude-fable-5.1——也就是本文所談模型之上的層級。
這裡之所以重要,是因為對這種搭配而言,合理的架構是讓昂貴的模型只承接一小部分流量。你不會把整條管線搬到每百萬次 $3.00 的模型組合上;你會把其中值得花 $3.00 聽取第二意見的那 2% 呼叫送過去,其餘一切都留在便宜模型上。這意味著為了 2% 的工作負載,得用上兩家供應商、兩把金鑰和兩套計費介面,而這正是閘道存在的意義。OrcaRouter 以 0% 加價原樣傳遞供應商標價,因此供應商一調價當天就即時生效,而不是得等重新定價的週期,而 A/B 測試只是一個模型字串,而不是多一套整合。若兩邊都不在我們的目錄中,誠實的答案是:我們不是適合這一層的角色,你要的是直接整合。

「什麼能解決這件事?」
對 Aion 3.5 的一項獨立評估。這就是整塊拼圖中唯一缺少的那一塊。如果一家中立實驗室給它的評分,只要接近 Claude Haiku 5.5 以每項任務 $0.21 得到的 43 分,那麼 AionLabs 就是為了達到同等表現而收取三十倍的輸入價格,而集成式方案的故事就成了負擔,而不是賣點。如果它的得分明顯更高,那麼這個溢價就是真實的,而正確做法就是把它花在那一小部分真正需要它的呼叫上。在這個數字出現之前,買家在兩者之間做選擇,就是在一個有實測數據、價格公開的模型,與一個未經實測、價格更高的模型之間做選擇——而在這組對比中,只有一個站得住腳的預設選項。
這意味著,只為了百分之二的工作負載,就得有兩個供應商、兩把金鑰和兩套計費介面,而這正是閘道器的用途。
