
Step 5 Preview 對上 Qwen 3.8 Max Prime:一個指數點,四美元三十八美分
- Orca新Orca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 每百萬 tokens
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 113 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 52 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 423 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 399 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
先從搜尋框不會告訴你的事情說起。Qwen 3.8 Max Prime不是一個模型。它是一條服務通道——廠商在 2026 年 8 月 3 日正式推出、同一組 Qwen3.8-Max權重,卻以第二個模型 ID 販售,價格正好是國際價目表的兩倍。Step 5 Preview,StepFun 的閉源旗艦,於 2026 年 9 月 20 日開放其 API,而且是尋常意義上的模型:一個端點、一個價格、一組你無法持有的權重。所以這場對決的誠實版本,是把一個經過實測的模型對上一個未經實測的層級,而算出來的結果比任何一家廠商會放上簡報的都要直白。在獨立的 Artificial Analysis Intelligence Index 上,兩者僅差一分,44 對 45;而在完成一項任務的成本上,兩者相差 $1.03 對 $5.41。一分、四美元三十八美分,每項任務——而這還是在你尚未為 Prime 實際上收費的任何速度付費之前。
接下來是對那個數字的拆解:它從何而來、為什麼在 Prime 讓任何東西翻倍之前,標準 Qwen ID 就已經是這項比較中較貴的那一半,以及每項任務多出的四美元究竟買到了什麼、又沒買到什麼。
這個名字正在做產品本身沒做的事。
阿里巴巴於 2026 年 9 月 22 日在雲棲大會上發表了 Prime——優速模式(fast mode)——並將其列為 Model Studio 價目表上的一個品項。阿里巴巴自家的文件對變更內容說得毫不含糊:輸出速度提升至標準 API 的 1.5 至 2 倍,而且用該供應商的話來說,其能力與使用限制與原始模型完全相同。沒有新的參數量,沒有新的端點合約,也沒有標準 ID 所欠缺的任何能力。你只要在請求主體中更改模型名稱,就上了快車道。

這讓那個搜尋詞變成了一個陷阱。想找比 Qwen3.8-Max 更新的 Qwen 旗艦機型的人,會找到「Prime」,並把它讀成版本號。那是價格。這個名稱所暗示的一切能力,全都由 Qwen3.8-Max 本身提供:一個 2.4 兆參數的稀疏混合專家模型,每個 token 約有 950 億個參數處於作用中,每層有 512 位專家,且在獨立委員會測試的配置上具備 983,616 個 token 的上下文。
Step 5 Preview 沒有同等程度的模糊性,而且它有著相反的問題。StepFun 將其列為總參數約 6,000 億、活躍參數 270 億,輸入支援文字、圖像與影片,具備 100 萬 token 的上下文視窗,以及有文件記載的 64,000 token 輸出上限,推理強度可選低、中或高。BF16 檢查點曾承諾於 2026 年 10 月 15 日發布,但至今尚未推出;自 API 開放當天起,BF16 版本的社群鏡像便在 Hugging Face 上流傳,但重新上傳並非正式發布,而 StepFun 也未發布任何開放權重公告。
所以這對組合在跑任何一項基準測試之前,就已明顯失衡:一邊是可能成為可下載項目的預覽版模型,另一邊則是某個不會如此的模型,而其服務層級已被重新定價。
一個指數點的成本是多少
兩個模型都已由同一位獨立評估者運行,而這正是比較開始對「每 token 更便宜」這個說法變得令人不安的地方。繼續閱讀,2026 年 10 月 10 日:
• Index — Step 5 Preview 44,遠高於同級模型的中位數 26。Qwen3.8-Max 在 0902 版本上為 45。一分之差。
• 每項已完成索引任務的成本——$1.03 對 $5.41。好上五倍以上。
• 輸出價格——每百萬個 token 為 $2.70,而標準 ID 為 $6.00;一旦改用 Prime,就會變成 $9.902。Step 5 Preview 比標準便宜 2.2 倍,比 Prime 便宜 3.7 倍。
輸入價格 — $1.00,相較於標準的 $2.00 與 Prime 的 $3.301。這是輸出欄位的鏡像,而且在你讀完下方的成本拆解後,更是關鍵的那一項。
• 快取命中 — 在 Step 5 Preview 上每百萬個 token 為 $0.10,相當於 90% 折扣;在 Qwen3.8-Max 上為 $0.25,折扣為 87.5%,而廠商自家頁面將其四捨五入為 88%。
• 每秒輸出 token 數 —— 87 對上 35.4。在這裡,Qwen 是較慢的那一方,而且慢了約莫兩倍半。
以每 token 計算的欄位與以每項任務計算的欄位彼此不一致,而該相信的是以每項任務計算的那一欄,原因只有在你打開成本明細時才會顯現。在 Step 5 Preview 的索引執行中,$1.03 裡有 $0.85 屬於輸入端,$0.17 屬於輸出。在 Qwen3.8-Max 的那次執行中,$5.41 裡有 $4.76 屬於輸入端,$0.65 屬於輸出。標價大約相差兩倍;任務帳單卻相差五倍,因為 Qwen 那次執行透過測試框架推送了約 99 億個輸入 token,而 Step 5 Preview 只有 55 億個,也因為其中大部分流量是快取流量,是以供應商給予的折扣價重新讀取,而不是按牌價計費。
Step 5 Preview 被董事會形容為極度冗長,在整個測試套件中約有 1.6 億個輸出 token,而中位數為 8,200 萬——而 Qwen3.8-Max 也被用完全相同的字眼形容,約為 1.9 億,對比同樣的中位數。這兩者都不是回答簡短的模型。如果你希望最佳化的是輸出長度,這兩欄都幫不上你。

這項比較有個漏洞,而且它是 Prime 形狀的。
前一節中的每一項數據都是在標準 Qwen3.8-Max ID 上測量的,沒有一項是在 Prime 上測量的。
這不是什麼技術細節。Prime 的整個賣點就是 token 來得更快,而看板上這個家族唯一的速度數字,是標準 ID 的每秒 35.4 個輸出 token——這是這裡討論的三個 ID 中最慢的一個,而且差距很大,也是 Qwen3.8-Max 不僅昂貴、更明顯表現不佳的那一行。如果 Prime 達到阿里巴巴所述範圍的上限,那個 35.4 就會變成大約 70,仍低於 Step 5 Preview 的 87,而每輸出 token 的成本卻是其 3.7 倍。如果它只達到該範圍的下限,就會變成大約 53。
那些是根據廠商自稱的倍數所建立的估算,不是測量結果,而且應該如此標示。我們能找到的人當中,沒有人發表過 Prime 模式的獨立吞吐量測試。1.5 到 2 倍這個數字是阿里巴巴自己說的,而它是整個層級唯一具支撐作用的說法。
唯一一個對 Prime 有利的結構性細節,就是限流規則,而它很容易被略過。Alibaba 的文件指出,在 Prime 之下,當呼叫量達到速率上限時,若平台仍有閒置資源,請求就不會被限流——因此你能取得的輸送量不會低於所標示的上限。那是有硬性下限的軟性上限:在資源競爭時你拿到的是上限值,在容量閒置時則能拿到更多。對一個會連續發出數十次呼叫的代理迴圈而言,這件事比中位數更重要,因為最慢的那次呼叫決定迴圈何時結束。這也最能清楚說明 Prime 為何會作為一項產品存在。Alibaba 販售的是它早已建好的容量中的排隊順位,並為優先從中獲得服務的權利收取雙倍費用。
當你把兩張費率卡並排放置時,它們說明了什麼
阿里巴巴將其 Qwen 各列並列發布,這使得該層級的計算異常簡潔。在國際版頁面上,Prime 一列顯示每百萬 token 輸入 $3.301、輸出 $9.902,而標準 ID 及其 0902 pin 則為 $1.65 與 $4.951。這在兩欄上都正好是 2.0——不是四捨五入的近似值,而是所公布數字的實際比值。StepFun 的英文定價頁面列出 Step 5 Preview 為輸入 $1.00、快取命中時 $0.10、輸出 $2.70,其中快取未命中的輸入包含將新內容寫入快取的成本。該供應商公布的快取命中數字是 90% 折扣;獨立看板依據相同資料記錄為 95%,而值得知道的是,你是以兩者中的哪一個作為建模依據。
把這三張卡放進同一欄,輪廓就清楚了。Prime 輸出,$9.902。標準 Qwen 輸出,看板紀錄上是 $6.00,阿里巴巴自家國際頁面上則是 $4.951。Step 5 Preview 輸出,$2.70。而在沒人宣傳的便宜賽道上,Step 5 Preview 的快取讀取是 $0.10,Qwen 則是 $0.25——對任何會重複前綴的工作負載來說,這比輸出那一欄更重要。
一個關於過時數字的警告,因為這個系列在七週內已經調價不只一次。廣為引用的 Qwen3.8-Max $2 輸入與 $6 輸出,是八月上市時公布的頭條價格,而 Alibaba 的新加坡頁籤顯示的仍是這個價格。國際與全球欄位現在顯示 $1.65 和 $4.951。如果你在估算支出,請使用你所在地區的價目表,並在實際下單當天重新查看。
兩種解讀 2× 的方式
由於 Prime 與 standard ID 是相同模型,價格卻是兩倍,這筆溢價很容易定價,卻難以證明其合理性。在 Alibaba 產品線的頂端,你付出 2 倍價格換來 2 倍速度,換算下來,每消除一秒延遲,成本是中性的。在最低端,你付出 2 倍價格只換來 1.5 倍速度,等於每節省一秒就有 33% 的溢價。對互動式工作而言,兩端都稱不上不合理;但對隔夜批次處理而言,兩端都站不住腳。這就是為什麼針對這個層級的標準建議——延遲敏感型呼叫用 Prime,其餘都用 standard ID——同時也是正確的建議。
與 Step 5 Preview 的比較,正是推理改變形態的地方,而這正是「vs」框架讓其顯現的部分。Prime 完全不是在價格上與 Step 5 Preview 競爭。standard ID 每輸出 token 就已經比 Step 5 Preview 更貴,每完成一項任務貴上五倍,而且得分還高一分。Prime 把一個原本就已經在輸的方程式的成本端倍數放大,換回來的速度,Step 5 Preview 卻免費擁有更多。如果你需要的是這個家族的速度,誠實的說法是:這一頁另一邊的模型以每百萬輸出 token $2.70 的價格,給你每秒 87 個 token,而快速通道給你的區間,根據 Alibaba 自己的數字,最高約為 70,價格則是 $9.902。
那不是一個能證明 Step 5 Preview 勝出的論點。那是一個論點,主張 Prime 的價值完全屬於阿里巴巴自家產品線的內部範疇,而且支持它的理由取決於某些工作負載——在這些工作負載中,Qwen3.8-Max 領先一分的指數優勢、其 983,616 個 token 的上下文,或其不同的任務特性,能發揮 100 萬 token 的 Step 5 Preview 上下文所無法發揮的作用。而這正是目前還沒有人能執行的比較,因為 Prime 這一列並不存在於任何獨立排行榜上。

這對買家而言意味著什麼
這兩者都不在 OrcaRouter 上。Step 5 Preview 可透過 StepFun 自家的 API 和少數幾個第三方平台存取;Prime 則是 Alibaba Cloud Model Studio 的一個層級,以工作區範圍的端點提供服務;而且你可以在讀到這些說法的同一分鐘內,對照我們的型錄來查核這兩項說法,這比直接相信我們的話是更好的測試。
我們所路由的,是同一系列中的另一款產品,而它恰好是本文的計算不斷指回的那一款。標準版 Qwen3.8-Max 及其帶日期的固定版本 Qwen3.8-Max-0902,在型錄中與同系列手足 Qwen3.8-Max-Preview、Qwen3.8-Flash 和 Qwen3.8-27B 位於同一個鍵下,並與其他 200 多個模型並列,其中供應商標價以 0% 加成原樣傳遞。由此可得出兩件事,而兩者都關係到上述決定。第一,阿里巴巴的價目表變更在阿里巴巴公布的同一天就會出現在我們這邊——這正是你希望從一個已在七週內兩度重新定價此系列家族的供應商身上得到的特性。第二,你的基準不再是一場單一供應商的押注:標準 ID 是你最可能保留在預設路徑上的層級,而將它置於路由層之後,而非直接整合,正是讓 Prime 決策可以逐端點而非逐合約逆轉的原因。
如果你正在這篇文章標題的兩個名稱之間做選擇,取捨其實很簡單。當你想要那個分數、影片與圖像輸入,以及 90% 的快取折扣時,就選 Step 5 Preview,並接受你租用的是一個預覽版本,其檢查點是對 10 月 15 日的承諾,而不是一份授權。只有在以下情況才選 Qwen 3.8 Max Prime:你已經確定要投入 Qwen3.8-Max,而且已用你自己的提示詞實測過,確認標準 ID 的每秒 35 個 token 正是讓你燒錢的原因——並用 2 倍、而非 1.5 倍來衡量這個決定的成本,因為廠商產品線中的頂規數字,並不是你在正式環境中會看到的數字。
能夠一錘定音的測量並不存在,而這一點值得直白說出來,不必加以粉飾。得有人把 Prime 放進一套同樣會跑 Step 5 Preview 的測試框架,公布吞吐量分布而非單一倍數,並在它換來的指標分數旁附上每項任務的成本數字。在那之前,雙方唯一共用的數字就是那兩張費率表,而它們從相反的方向說著同一件事:快車道是購買 Qwen3.8-Max token 最昂貴的方式,也是相對於替代方案對同一秒的收費而言,購買一秒實際時間最慢的方式。
本文中的比較1
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
