
Solar Pro 4 對決 Qwen 3.8 Max:0.03 美元的智能體 vs 阿里巴巴的 2.4T 開放賭注
- meta新Meta: Muse Spark 1.22026-08-0557智能72程式
- qwen新Qwen: Qwen3.8 Max2026-08-0358智能72程式
- deepseek新DeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69程式
- minimax新MiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens · 2147 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
- metaMeta: Muse Spark 1.12026-07-1653智能71程式
- kimiMoonshotAI: Kimi K32026-07-1560智能76程式
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71程式
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77程式
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77程式
- grokxAI: Grok 4.52026-07-0856智能72程式
- tencentTencent: Hy32026-07-0642智能59程式
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42程式
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39程式
- anthropicAnthropic: Claude Sonnet 52026-06-3055智能72程式
- klingKling: Kling 3.0 Turbo2026-06-1757智能52程式57數學
2026年8月3日當週,阿里巴巴推出了Qwen 3.8 Max,這是一款2.4兆參數的稀疏MoE模型,在全球Arena排行榜上排名第2,在Artificial Analysis的編碼指數中排名第12;輸入每百萬tokens收費2.00美元,輸出每百萬tokens收費6.00美元。七天後,Upstage推出了Solar Pro 4,這是一款閉源權重的Agent旗艦模型,定價為0.03美元和0.12美元。兩者都被宣傳為「agentic」模型,專為長時間、多步驟的工作打造。一個是2026年中國夏季最強的開放權重之作,另一個是2026年最便宜的商業「agent model」標籤。它們並不是真的在能力上競爭——而是在競爭開發者在花費第一個token之前,可以對模型做出什麼假設。
兩次發射,兩個假設
Qwen 3.8 Max 於 8 月 3 日從阿里巴巴實驗室問世,具備前沿發佈的所有規格:2.4T 總參數(每個 token 約 95B 活躍參數)、1M token 上下文、原生文字-圖像-影片輸入、Arena 排名第二,以及經審計的 Artificial Analysis Intelligence Index 58 分。根據獨立證據,它屬於全球頂尖的開放權重模型。阿里巴巴表示將遵循 Qwen 一貫模式釋出權重,這將使其成為首個開源的 Max 級 Qwen。以前沿標準來看,這些並不便宜——2/6 美元——但相對於專有前沿模型而言則屬便宜。
Solar Pro 4 於 8 月 10 日上市,帶著一套不同的假設。Upstage 的發布資料描述了相較於 Solar Pro 3 在長篇文件推理、多輪工具使用和終端任務效能上的改進,但未揭露參數數量,也沒有獨立基準測試。它的全部差異化優勢在於價格:$0.03/$0.12 的輸入成本約比 Qwen 3.8 Max 便宜 66 倍,輸出成本便宜 50 倍。Qwen 3.8 Max 要你相信一個經稽核分數的 2.4T 模型,而 Solar Pro 4 要你相信一個價格。

記分板,誠實地看
• 智能指數 — Qwen 3.8 Max:58(AA,已審計);Solar Pro 4:未公布
• 編碼指數 — Qwen 3.8 Max:71.8(126 個中排名第 12,AA);Solar Pro 4:尚未評測
• 上下文 — Qwen 3.8 Max:1M tokens;Solar Pro 4:524K
• 輸入模態 — Qwen 3.8 Max:文字、圖像、影片;Solar Pro 4:以文字為主
• 權重 — Qwen 3.8 Max:承諾開放釋出;Solar Pro 4:封閉
• 價格 — Qwen 3.8 Max:$2.00/$6.00 每1M;Solar Pro 4:$0.03/$0.12 每1M

這種不對稱性十分顯而易見,但這不是 Solar Pro 4 的錯。Qwen 3.8 Max 自 8 月 3 日起便已有可測量的數據;Solar Pro 4 則自 8 月 10 日起才有。未經測量的模型並不代表它是個糟糕的模型——它只是尚未被測量而已。但當下的這個具體比較,是「經查核的證據」對上「發布價格的宣稱」,而要誠實看待任何正面對決,就該把這點說清楚。
100倍的差距實際能買到什麼
這裡有趣的數字不是每個 token 的價格,而是這個價格在架構層面上解鎖了什麼。以 Solar Pro 4 的費率而言,在 agent 迴圈的每一輪都把完整的 500K token 文件集保留在上下文情境中,已經不再是一個成本決策。用三種不同的 temperature 跑同一個 prompt 並保留最佳的結果——這個經典的便宜模型技巧——也變得幾乎免費。這是一種真正不同的開發姿態:你以「算力幾乎免費」的前提來設計,就像當年團隊面對第一批 GPT-3.5 等級的便宜模型時那樣。
代價在於,你等於是把生產環境的工作負載,押注在一個未經證實的品質宣稱上。Qwen 3.8 Max 的 58 分 Intelligence Index 與 Arena 排名第 2 並非故事的全貌——阿里巴巴自家的基準測試套件所包含的內部數據,也該以同樣的「廠商自報」標準來解讀——但那些數字確實有其分量。Solar Pro 4 目前還沒有任何這類依據。如果它的品質與 Qwen 相差無幾,那它就是目前市場上最划算的選擇;如果不是,$0.03 的價格正好會說明它為什麼只值 $0.03。

開放權重的分支
這就是兩款模型在結構上產生分歧的地方,也是六個月後決定這場對決結果的關鍵。Qwen 3.8 Max 的開放釋出一旦正式推出,便使其成為可部署的資產:可以自行託管、微調、以邊際成本提供服務,並將資料保留在自己的硬體上。Solar Pro 4 永遠不會如此——封閉就是封閉。對於有資料駐留要求或長期成本曲線考量的企業來說,「Qwen 3.8 Max 最終能部署在你自己的叢集中」是一個任何按 token 計價都無法比擬的策略選項。
對於只想今天就呼叫模型的團隊來說,這個開放問題是學術性的。兩者都支援 OpenAI 相容的 API,也都可透過供應商自家的 API 以及數個第三方平台取得。路由的答案——一個 API 涵蓋 200 多個模型、供應商列表價格以零加成轉傳、自動容錯切換——讓你可以把這視為成本圖表,而不是忠誠度決策:將廉價的大量流量送往 $0.03 模型,高風險推理送往 Qwen 3.8 Max,並用路由 DSL 指定哪個工作負載該去哪裡。
底線
Qwen 3.8 Max 是更好的模型、證據更充分的模型,也是你未來可以擁有的模型。Solar Pro 4 的價格便宜了兩個數量級,但必須誠實地加上星號附註:其品質宣稱截至本週尚未被複現。如果你的工作負載需要經審計的前沿效能,就付費使用 Qwen 3.8 Max。如果你的工作負載受容量限制且能容忍失敗,那麼 0.03 美元的智能體是理性的賭注——當第一批獨立的 Solar Pro 4 數據出爐時再重新檢視,屆時這項比較也不再是蘋果比橘子,而是真正的選擇。
